全部技能 / 内容创作 / gpt-image-edit
内容创作 · prime-skills/runcomfy-agent-skills

gpt-image-edit

Edit images with OpenAI GPT Image 2 (the `/edit` endpoint of ChatGPT Images 2.0) on RunComfy — bundled with the model's documented prompting patterns so the skill gets sharper output than naive prompting against the same model. Documents GPT Image Edit's strengths (preservation language, multilingual in-image text editing, multi-reference up to 10 images, layout / typography precision), the schema, and when to route to Nano Banana Edit / Flux Kontext / GPT Image 2 t2i instead. Calls `runcomfy run openai/gpt-image-2/edit` through the local RunComfy CLI. Triggers on "gpt image edit", "gpt-image-edit", "chatgpt image edit", "edit with gpt image 2", or any explicit ask to edit with this model.

风险提醒:橙色 · 评估后使用AI 侦查报告
作者 prime-skillsGitHub prime-skills/runcomfy-agent-skills ↗Stars 48许可 MIT(仓库根 LICENSE:Copyright (c) 2026 RunComfy / agentspace-so;GitHub API spdx=MIT)commit fca19ae084
agent 宿主通常会约束 skill 执行权限;风险提醒为 AI 侦查观点,不构成质量或安全保证。第三方 skill 仅作拆解与展示,安装使用风险自负,版权归原作者。

1实现原理 · 为什么它能做到

实现方式是「零代码 + 外部 CLI 委托」:gpt-image-edit/ 只有一份 SKILL.md,无脚本;运行时由宿主 agent 用 Bash 执行 `runcomfy run openai/gpt-image-2/edit --input '<JSON>' --output-dir <path>`。skill 的增量价值是把 GPT Image 2 /edit 的 schema(3 个字段)与多语言文字排版提示法固化成可照抄文档,本地不做任何图像处理。

gpt-image-edit/SKILL.md
The skill invokes `runcomfy run openai/gpt-image-2/edit` with a JSON body matching the schema.
注:git ls-tree HEAD 核实 gpt-image-edit/ 下只有 SKILL.md 一个 entry;同仓 runcomfy-cli/SKILL.md 是 CLI 自身的说明书,本技能只做单模型封装。

schema 只有三个字段:prompt(必填)、images(string[],最多 10 张公开 HTTPS URL,首张为主、其余为辅助线索)、size(auto / 1024_1024 / 1024_1536 / 1536_1024)。极简字段把能力差异全部交给提示词,因此文档把重心放在写法上。

gpt-image-edit/SKILL.md
| `images` | string[] | yes | — | **Up to 10** publicly-fetchable HTTPS URLs. First is primary; rest are auxiliary. |
注:「≤10 张参考」是本技能相对 Flux Kontext(单图)的核心差异;同页还给出 size=auto 的推荐理由(保留输入比例),并说明非枚举取值会 422。

主体内容是「多语言图内文字排版」的操作法:要逐字引用字符并点名书写系统(Japanese kana / Cyrillic / Arabic right-to-left),禁止转述;这条纪律解释了为什么它在多语种广告本地化场景胜过同类模型。

gpt-image-edit/SKILL.md
**Multilingual text — quote the characters, name the script.** `"the headline reads \"コーヒー\" in bold Japanese kana"`, `"the label says \"АРОМА\" in Cyrillic, white on black"`, `"the right-margin caption reads \"تخفيض\" in Arabic right-to-left"`. Don't paraphrase — quote.
注:配套反模式一条就指向这个坑:'Paraphrasing in-image text instead of quoting it → text comes out different.'——文档把失败模式与写法成对给出。

多参考合成靠「编号指代」路由线索:把多张 images 当编号引用(subject from image 1, lighting from image 2, color palette from image 3),模型据此分配各图的作用。

gpt-image-edit/SKILL.md
**Multi-ref numbering.** When passing multiple `images`, refer to them by number: `"subject from image 1, lighting from image 2, color palette from image 3"`. The model routes cues correctly.
注:这条与 flux-kontext 的『单参考』纪律形成家族对照:同一套家族模板用输入形状把两个模型的能力边界写死(≤10 vs 单张)。

定向空间编辑用方向语言表达:move the headline from top-right to bottom-center / remove the leftmost object only / replace the watermark in the bottom-right corner——把布局级修改写成可判定的空间指令。

gpt-image-edit/SKILL.md
**Directional language for spatial edits.** Concrete spatial scopes work: `"move the headline from top-right to bottom-center"`, `"remove the leftmost object only"`, `"replace the watermark in the bottom-right corner"`.
注:这类『可判定位置短语』是同族文档里唯一覆盖『版面重排』的描述,与 Nano Banana Edit 的批量身份保持形成互补。

路由表把兄弟模型分成四种用途(批量 ≤20 → Nano Banana Edit;单参考保真 → Flux Kontext;从零生成 → 同仓 gpt-image-2 技能;批量 SKU → Nano Banana Edit),并在限制段直说人像写实不如 Nano Banana Pro。

gpt-image-edit/SKILL.md
| Generate from scratch with GPT Image 2 | sibling [`gpt-image-2`](../gpt-image-2) skill |
注:相对链接 `../gpt-image-2` 指向同仓目录(已核实存在)。与同族其它四份不同,本技能的表格后没有 'route here regardless' 那句『显式点名无条件回到本技能』的兜底句(见 second_pass 的 discrepancy)。

执行链:CLI 把 JSON POST 到 RunComfy Model API 的 /v1/models/openai/gpt-image-2/edit,轮询后把 `.runcomfy.net` / `.runcomfy.com` 白名单产物下载到 `--output-dir`;Ctrl-C 取消远端请求。

gpt-image-edit/SKILL.md
The CLI POSTs to `https://model-api.runcomfy.net/v1/models/openai/gpt-image-2/edit`, polls the request, fetches the result, and downloads any `.runcomfy.net`/`.runcomfy.com` URL into `--output-dir`. `Ctrl-C` cancels the remote request before exit.
注:编辑所需的多张源图由 RunComfy 服务器抓取(不是本机上传),因此素材保密性由第三方云决定。

2核心能力

01多语种 / 嵌入文字图内改写(逐字引用 + 点名书写系统)
02多参考合成,最多 10 张图(首张主、其余辅助,按编号指代)
03保留优先的定向编辑(先 Keep [face/pose/clothing/brand/framing] unchanged,再写改动)
04布局级定向重排(方向语言:top-right → bottom-center、只删最左物体、替换右下角水印)
05输出尺寸控制(size=auto 保留输入比例;3 个固定尺寸可选,非枚举值 422)
06品牌/身份跨素材保持(同一视觉资产出多语 headline 变体)
07兄弟模型路由决策(批量 ≤20 → Nano Banana Edit、单参考 → Flux Kontext、从零 → gpt-image-2、人像写实 → Nano Banana Pro)
08退出码语义与重试判断(65 schema 不匹配、75 可重试、77 需重登)

3外部依赖

类型依赖
cliruncomfy(RunComfy 官方 CLI)
package@runcomfy/cli(npm 全局包)
packagenpx skills(skills.sh 安装器)
apiRunComfy Model API(OpenAI GPT Image 2 /edit)
networkRunComfy 产物下载白名单
network用户传入的源图/参考图 URL(最多 10 张,由 RunComfy 服务器抓取,非本机)
networkRunComfy 站点/模型页/文档(文档引用,非运行时调用)
networkGitHub(技能源码链接)

4风险提醒 风险提醒:橙色 · 评估后使用

风险提醒:橙色 · 评估后使用
  • 执行面在仓外且无版本 pin — 真实动作由 npm 全局安装的 @runcomfy/cli 完成(安装行不含版本),CLI 内部行为与安全断言无法在本 pin 证实;供应链风险落在 npm 与 RunComfy 两方。
  • 凭证与按次计费 — CLI 以用户 RunComfy token 提交请求;图像编辑按次计费,agent 依 75 退出码自动重试会重复消耗额度。
  • 多图素材出网(最多 10 张) — 所有源图/参考图 URL 由 RunComfy 服务器抓取并进入第三方模型;未发布品牌资产、版式、人脸素材的保密性不本地可控。批量场景下每张都是独立出网对象。
  • 文字改写能力可被滥用 — 本技能的强项是精确改写图内文字(含品牌字样、新闻标题、标语)。若源图非自有或用户要求伪造他人标识/误导性排版,模型可能照做;文档自身不设内容合规门禁,责任落在使用者与宿主。
  • 排名/对比主张无来源 — 'Nano Banana Pro wins head-to-head'(人像写实)、'Strongest in class for face / brand preservation' 等比较口径在仓内无出处,属营销性主张(本报告未独立复现)。
风险提醒:橙色,评估后使用。按本次统一分档准则(同仓 image-edit 已取橙):运行时驱动第三方 npm 包/CLI `@runcomfy/cli`,该 CLI 每次调用读取用户 RunComfy 凭证(~/.config/runcomfy/token.json 或 RUNCOMFY_TOKEN)——命中『调第三方 CLI/远程包且触凭证/配额』档;CLI 实现、Model API 行为、0600 权限、2 GiB 上限、退出码语义等断言全在仓库外,本 pin 内无源码可核,按『拿不准取高一档』定橙。另有多图素材出网(最多 10 张由第三方服务器抓取并参与推理),未发布品牌资产/人脸/版面的保密性不由本地控制;每次调用按次计费。skill 本体纯 markdown、无脚本、无混淆、无隐藏端点,未触红档。

5第二遍独立确认

  • [ok] skill 目录内容 = 仅 SKILL.md — git ls-tree HEAD 与 ls -a 双向核实;仓库根仅 LICENSE + README.md + 31 个技能目录,无 scripts/、plugins/、.claude/。
  • [ok] 全部外部依赖条目回查调用点真实存在 — runcomfy CLI 调用点 3 处(单参考/多语文字/多参考示例)、npm 安装 1 处、npx skills 1 处、model-api 端点 1 处、白名单与外部 URL 抓取各 1 处、文档/模型页/GitHub 链接多处,均实读命中。
  • [discrepancy] 路由兜底句 'route here regardless' 缺失(家族内不一致) — flux-kontext / wan-2-7 / seedance-v2 / happyhorse-1-0 四份在路由表后都有 'If the user said ... explicitly, route here regardless.',本技能的路由表直接接 ## Prerequisites,无该兜底句(触发词仅存在于 frontmatter description 的 'Triggers on ...' 列表)。后果:当用户说『用 GPT Image 编辑这张图』时,是否优先于同族 router 的意图分类由宿主自行判断,家族内无统一行为。
  • [ok] size 枚举与 warning 口径一致 — schema 行列出 auto/1024_1024/1024_1536/1536_1024;正文 'Use `size: "auto"` to preserve input ratio' 与 'asking for `size` outside the 3 fixed values + auto → 422'、Limitations 'size: 3 fixed values + auto — anything else 422s' 三处一致(3 个固定值 + auto 的说法自洽)。
  • [unlocatable] Security & Privacy 的技术断言可在本仓证实 — 0600 token 权限、2 GiB 下载上限、无 shell 展开、下载白名单、退出码语义均为仓外 @runcomfy/cli 行为;仓内无 CLI 源码或版本 pin,只能作为文档自述引用(同仓 runcomfy-cli/SKILL.md 为同源转述,非独立证据)。
  • [discrepancy] 安装一行与 GitHub 链接指向旧仓 agentspace-so/runcomfy-skills — 安装行 `npx skills add agentspace-so/runcomfy-skills --skill gpt-image-edit -g` 与 GitHub 链接 github.com/agentspace-so/runcomfy-skills 均指向旧仓;本仓 pin 在 prime-skills/runcomfy-agent-skills(README 用 runcomfy-agent-skills)。gh api:agentspace-so/runcomfy-skills 仍存在(5★、pushed 2026-04-29、含 gpt-image-edit 目录);prime-skills/runcomfy-agent-skills 与 agentspace-so/runcomfy-agent-skills 为同一仓(相同 stats,full_name=prime-skills/runcomfy-agent-skills)。按文档安装可能装到旧版。
  • [ok] 多语言字符引用写法可执行性 — 正文给出的日文假名(コーヒー / 今日のおすすめ)、西里尔(АРОМА)、阿拉伯(تخفيض)样例在文件内为真实 UTF-8 字符;配套反模式(paraphrase → text comes out different)同页存在,属可执行指引。
  • [discrepancy] 未声明 allowed-tools(执行面未收窄) — frontmatter 无 allowed-tools;同仓 runcomfy-cli/SKILL.md 声明 `allowed-tools: Bash(runcomfy *)`。家族内部工具权限声明不一致。

6结论

  • 多语言图内文字改写是明确的一等能力:逐字引用 + 点名书写系统 + 禁止转述,配日文/西里尔/阿拉伯实例,可直接照抄用于广告本地化。
  • 同类里参考图最多(≤10 张)且给了编号指代法,多图合成有可操作协议。
  • schema 只有 3 个字段,认知负担低;size=auto 保比例的默认建议避免了不必要的 422 与画幅破坏。
  • 版面级编辑有方向词协议(top-right → bottom-center / 只删最左物体 / 右下角水印),把布局修改写成可判定指令。
  • 零代码、单文件:整目录可先审后用,无脚本执行面。
  • 适合:适合:多语种广告本地化(同一视觉资产换不同语言的图内 headline)、品牌安全的 headline/CTA 替换、布局级重排(挪标语、删物体、去水印)、以及需要多张参考图合成(人物取自图 1、场景取自图 2)的编辑任务。前提是已装好 runcomfy CLI 并登录(或配置 RUNCOMFY_TOKEN)。
    不适合:不适合:批量 ≤20 张需一致输出(应换 Nano Banana Edit)、单参考追求源保真的局部微调(Flux Kontext 更契合)、无源图从零生成(应换同仓 gpt-image-2 t2i)、追求人像极致写实(文档自认 Nano Banana Pro 更强);也不适合要求数据不出网、或需要可审计执行代码的合规环境(执行面在仓外且无 pin)。
    安装 agent 直装可复制
    ① 本站镜像 更新 2026-09-15
    方式 A · 人下载镜像包下载 gpt-image-edit.tar.gz
    sha256: c5a2b82fedddc872…
    方式 B · JSON 格式安装指南,复制给 agent
    安装指南
    agent 读 JSON 指南后会自动从本站下载安装,无需更多说明。
    ② 上游 GitHub · 原始来源
    能访问 GitHub?直接去上游安装(实时版,可能已更新)GitHub 原始 ↗
    本页镜像锁定 commit fca19ae084;上游为实时仓库。
    来源信息 GitHub 原始
    作者 / 仓库prime-skills / prime-skills/runcomfy-agent-skills
    Stars48
    最近推送2026-05-15
    本 skill commitfca19ae084
    许可MIT(仓库根 LICENSE:Copyright (c) 2026 RunComfy / agentspace-so;GitHub API spdx=MIT)
    本站信息
    收录日期2026-09-06
    分类内容创作
    侦查报告AI 侦查 · 2 遍 · 2026-09-06
    本站镜像与 GitHub 原始是不同来源:本站锁定 commit 快照经 /r2 分发;GitHub 为实时上游,内容可能已更新。
    同分类邻近