全部技能 / 内容创作 / ai-image-generation
内容创作 · 101-skills/superpowers

ai-image-generation

Generate AI images with GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve and 50+ models via inference.sh CLI. Models: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Capabilities: text-to-image, image-to-image, inpainting, LoRA, image editing, upscaling, text rendering. Use for: AI art, product mockups, concept art, social media graphics, marketing visuals, illustrations. Triggers: flux, image generation, ai image, text to image, stable diffusion, generate image, ai art, midjourney alternative, dall-e alternative, text2img, t2i, image generator, ai picture, create image with ai, generative ai, ai illustration, grok image, gemini image, gpt image, openai image, chatgpt image

风险提醒:橙色 · 评估后使用AI 侦查报告
作者 101-skillsGitHub 101-skills/superpowers ↗许可 MIT(仓库 README 徽标 'License: MIT' 与 .claude-plugin/plugin.json 中 "license": "MIT" 声明;但 pin 树内无 LICENSE 文件,GitHub API 对两 fork 亦报无 license —— 授权只出现在元数据/徽标,无正式许可文本)commit becc256497
agent 宿主通常会约束 skill 执行权限;风险提醒为 AI 侦查观点,不构成质量或安全保证。第三方 skill 仅作拆解与展示,安装使用风险自负,版权归原作者。

1实现原理 · 为什么它能做到

与其他工具 skill 同一骨架:belt CLI 白名单执行 + 『50+ 模型』目录表(表内 16 个 app-id 行:GPT-Image-2/FLUX 系/P-Image 系/Gemini/Grok/Seedream/Reve/ImagineArt/Topaz),agent 填 --input JSON 即触发远端推理。

tools/image/ai-image-generation/SKILL.md
belt app run falai/flux-dev-lora --input '{"prompt": "a cat astronaut in space"}'
注:Quick Start 与 twitter/video 系列完全同构——本仓库工具 skill 是同一模板的不同『目录页』。

『同一模型多个能力』用输入键切换表达:gpt-image-2 只传 prompt=文生图,追加 images:[...]=图像编辑/局部修改;P-Image-Edit、Reve 等则是独立 app 承载编辑。

tools/image/ai-image-generation/SKILL.md
"prompt": "change the background to a beach at sunset",
注:输入契约无 schema 文件,全部靠示例 JSON 示范——模型从例子推断参数键(quality/images/size/aspect_ratio/width/height)。

差异化卖点被写成可复现示例:文本渲染(Reve 的 'HELLO WORLD' 海报)、4K 档(Seedream 4.5)、极低价(FLUX Klein $0.0001/image)各配一段命令,供 agent 按需挑模型。

tools/image/ai-image-generation/SKILL.md
"prompt": "A poster that says HELLO WORLD in bold letters"
注:选型理由(ultra-cheap/2K-4K/text rendering)直接注在表格行里,构成路由决策层。

后处理/工具类 app 并入同一入口:Topaz 放大、stitch-images 拼图与生成模型并列在表中,说明『图生图后处理』也被平台 app 化。

tools/image/ai-image-generation/SKILL.md
belt app run infsh/stitch-images --input '{
注:拼接/放大不需要本 skill 之外的任何本地图像工具,进一步压缩了对本地依赖的需求。

生态定位是『内容链的素材源』:Related Skills 除平级图像包(p-image/gpt-image/flux-image/upscaling/background-removal)外,还互链 ai-video-generation(图生视频的输入)、ai-avatar-video(头像素材)与 twitter-automation(发图)。

tools/image/ai-image-generation/SKILL.md
npx skills add inference-sh/skills@background-removal
注:README 亦把本 skill 列为『Tools』组代表项之一,与视频/搜索并列。

2核心能力

01文生图:GPT-Image-2、FLUX Dev/Klein、Gemini 3 Pro/2.5 Flash、Grok、Seedream、Reve、ImagineArt
02图像编辑/局部修改(gpt-image-2 传 images[]、P-Image-Edit、Reve 自然语言编辑)
03LoRA 风格化(flux-dev-lora/flux-2-klein-lora/p-image-lora 预设 LoRA 风格)
044K/文本渲染等卖点模型选择(Seedream 4.5 2K-4K、Reve text rendering)
05后处理:Topaz 图像放大、stitch-images 多图拼接
06与视频/头像/社交发布技能拼接的素材生产

3外部依赖

类型依赖
clibelt(inference.sh CLI)
packagebelt-sh/cli(npx skills add 安装)
api平台图像模型/工具 app:openai/gpt-image-2、falai/flux-dev-lora、falai/flux-2-klein-lora、pruna/p-image(-lora/-edit)、google/gemini-3-pro-image-preview、xai/grok-imagine-image、bytedance/seedream-4-5、falai/reve、falai/imagine-art-1-5-pro-preview、pruna/flux-klein-4b、falai/topaz-image-upscaler、infsh/stitch-images
network平台文档(docs/apps/running、image-generation example)
network安装说明托管

4风险提醒 风险提醒:橙色 · 评估后使用

风险提醒:橙色 · 评估后使用
  • 素材与成品全部出网 — 参考图(编辑/风格化输入)与生成结果经第三方平台流转,保密素材不适合;无本地运行选项。
  • '50+ models' 名实差距 — 表内 16 行,超出部分依赖 belt app list 运行时发现;表格是快照可能过期。
  • 计费与生成内容合规 — 4K/Pro 档单价高,批量调用需预算意识;无内容过滤/水印参数说明,违规内容合规由平台兜底、责任在调用方。
  • 平台与供应链依赖 — belt CLI 经 npx 分发无 pin;本 fork 为 inference-sh/skills 未改名镜像、树内无 LICENSE 文件。
风险提醒:橙色,评估后使用。与仓内工具 skill 一致:无脚本、无凭证读取、无直连网络代码,执行面为白名单 belt CLI,外发对象可预期(inference.sh 及其背后图像模型厂商)。留意点:① 每次生成消耗账号额度,高价档(4K/Pro 预览模型)尤甚;② 参考图/成品图出网至第三方,素材保密性无法保证;③ 供应链同前(npx 无 pin、inference-sh 未改名镜像、无 LICENSE 文件)。按统一分档准则:本 skill 调用的 `belt` 是第三方 npm/npx 分发的 CLI(`npx skills add belt-sh/cli` 安装),以 `belt login` 登录态运行并消耗 inference.sh 账号配额/计费——属『调第三方 CLI 且触配额/登录态』,故取橙色(评估后使用);skill 源码本身不含任何 token/密钥读取。

5第二遍独立确认

  • [discrepancy] description 宣称 50+ models — 表内可数 app-id 行为 16,'50+ models' 在本 SKILL.md 无法定位核实,属平台注册表层面宣称(belt app list --category image 可查全量)。
  • [ok] Models 名单逐项定位 — GPT-Image-2/FLUX Dev LoRA/FLUX.2 Klein/Gemini 3 Pro/Gemini 2.5 Flash/Grok Imagine/Seedream 4.5/Reve/ImagineArt 均在表中有行;description 提到 'Seedream 4.5' 而表内另含 4.0/3.0,无冲突。
  • [ok] 能力声明示例支撑(i2i/inpainting/LoRA/editing/text rendering/upscaling) — 编辑由 gpt-image-2 的 images[] 示例与 P-Image-Edit/Reve 支撑;LoRA 由 flux-dev-lora/flux-2-klein-lora/p-image-lora 支撑;text rendering 由 Reve HELLO WORLD 示例支撑;inpainting 仅在 description/表行出现,无独立示例(同 gpt-image-2 编辑能力,未单列)——记为部分 ok。
  • [ok] 无脚本/无凭证/无直连网络 — 目录仅 SKILL.md;curl/wget/密钥 token 零命中;执行面 allowed-tools: Bash(belt *)。
  • [ok] 本地文件写入面 — 本文件示例无 shell 重定向,不写本地文件。
  • [ok] 图像输入全远程 URL — images/image_url 值均为 https://…;无本地上传/路径读取指令。
  • [ok] license/stars/commit 元数据 — pin == 本地 HEAD == becc25649700;101-skills/superpowers stars=0、pushed_at 2026-08-31T22:58:53Z;MIT 声明见 plugin.json/README 徽标,树内无 LICENSE 文件。
  • [unlocatable] installs 安装量 — 无公开安装量数据源,置 null。

6结论

  • 单入口覆盖主流模型家族:OpenAI/fal/Google/xAI/ByteDance 的图像模型统一成一个 belt 调用面,无需逐家接 SDK。
  • 成本锚点前置:$0.0001/image 的 FLUX Klein 等低价档写进表,成本敏感用户可自选档位。
  • 卖点可复现:文本渲染/4K/编辑/LoRA 各配最小示例,agent 能照抄出稳定结果。
  • 生态互链使『出图→生视频→发帖』可一条龙,本 skill 是内容链的素材源节点。
  • 适合:适合营销/设计/内容团队在 agent 工作流里批量产出与编辑图像(产品图、社媒图、概念图),需要多模型横向对比出图或想用 LoRA/4K/文本渲染等卖点能力的用户;也是落地页/视频/头像等下游 skill 的素材源。
    不适合:不适合要求图片不出内网/本地生成的场景;不适合高频免费试用(一切按量计费);不需要多模型切换的轻量用户直接用单一官方产品(如 ChatGPT/Gemini)更省事;不适合需要精细控制提示词安全策略与内容审核策略的企业级合规场景。
    安装 agent 直装可复制
    ① 本站镜像 更新 2026-09-09
    方式 A · 人下载镜像包下载 ai-image-generation.tar.gz
    sha256: f66b680166c1a445…
    方式 B · JSON 格式安装指南,复制给 agent
    安装指南
    agent 读 JSON 指南后会自动从本站下载安装,无需更多说明。
    ② 上游 GitHub · 原始来源
    能访问 GitHub?直接去上游安装(实时版,可能已更新)GitHub 原始 ↗
    本页镜像锁定 commit becc256497;上游为实时仓库。
    来源信息 GitHub 原始
    作者 / 仓库101-skills / 101-skills/superpowers
    Stars0
    最近推送2026-08-31
    本 skill commitbecc256497
    许可MIT(仓库 README 徽标 'License: MIT' 与 .claude-plugin/plugin.json 中 "license": "MIT" 声明;但 pin 树内无 LICENSE 文件,GitHub API 对两 fork 亦报无 license —— 授权只出现在元数据/徽标,无正式许可文本)
    本站信息
    收录日期2026-09-06
    分类内容创作
    侦查报告AI 侦查 · 2 遍 · 2026-09-06
    本站镜像与 GitHub 原始是不同来源:本站锁定 commit 快照经 /r2 分发;GitHub 为实时上游,内容可能已更新。
    同分类邻近