1实现原理 · 为什么它能做到
四模型图像编辑意图路由(家族 router 型):批量身份保持→Nano Banana Edit(默认)、多语种文字改写/多参考合成→GPT Image 2 Edit、单参考高保真局部编辑→Flux Kontext Pro、mask 驱动的区域替换→Z-Image Turbo Inpaint;agent 读表分类后落到对应 route 小节。
| User intent | Model | Why | |---|---|---| | Batch edit 1–20 images consistently (SKU gallery, A/B variants) | **Nano Banana Edit** | Up to 20 input images per call; locked aspect/resolution for series |
Route 1(Nano Banana Edit)与单模型技能 nano-banana-edit 内容同源:同一批 preservation-first 语法、cyberpunk/AURA 示例、image_urls 1–20 的 schema——router 把单模型技能收编为默认路线。
**Model**: `google/nano-banana-2/edit`
Route 2(GPT Image 2 Edit)主打多语种图内文字与多参考合成:images 数组(≤10,首图为主)、4 个固定 size、编号 refs 语法、逐字引用 + 语种点名(Japanese kana/Cyrillic/Arabic right-to-left)。
| `images` | string[] | yes | — | **Up to 10** HTTPS URLs. First is primary; rest are auxiliary. |
Route 3/4 覆盖『单参考精确编辑』与『mask 驱动重绘』两个极端的协议差异:Flux Kontext 单 image 字段 + 单条陈述式指令;Z-Image Inpaint 额外收 mask_image(灰度约定 white=inpaint/black=preserve)+ strength(0.3–1.0 分档语义)+ control_scale。
| `mask_image` | string | yes | **Grayscale mask URL** (white = inpaint, black = preserve). |
品牌转交边界:用户指名具体模型时转 gpt-image-edit / flux-kontext / nano-banana-edit 品牌技能获得更完整处理;多 route 禁止混搭。
- **Brand-specific overrides** — if the user named a specific model, route to the corresponding brand skill (`gpt-image-edit`, `flux-kontext`, `nano-banana-edit`) for fuller treatment.
执行委托 runcomfy CLI + 云端推理:`runcomfy run <model_id>` + 匹配 JSON body;CLI 提交 Model API、轮询、下载产物到 --output-dir。
The skill picks one of Nano Banana Edit / GPT Image 2 Edit / Flux Kontext Pro / Z-Image Turbo Inpaint based on user intent and invokes `runcomfy run <model_id>` with the matching JSON body.
2核心能力
3外部依赖
| 类型 | 依赖 |
|---|---|
| cli | runcomfy(@runcomfy/cli 官方 CLI) |
| package | @runcomfy/cli(npm 全局安装) |
| api | 四个云端编辑模型端点(经 runcomfy CLI + RunComfy Model API) |
| network | RunComfy Model API(请求提交)与生成结果下载 |
| network | 用户提供的源图/参考图/mask URL——由 RunComfy 模型服务器抓取 |
| network | RunComfy 模型页 / 文档站(引用链接) |
4风险提醒 风险提醒:橙色 · 评估后使用
- 接触不可信图像的面最宽:源图/参考图/mask 全部外部 URL 由服务器抓取并进入模型 — 图像提示注入为文档自认风险;批量(≤20 图)与 mask 工作流把更多第三方素材引入生成链。
- 批量与 mask 场景放大素材上云量(未发布 SKU、人脸、品牌资产外发第三方云) — 文档无本地处理选项;涉敏素材须自评。
- 执行面与供应链仓外(CLI、四模型 API、token 读取) — 文档对 CLI 的转述(0600、2 GiB、无 shell 展开)无法在本仓库证实。
- 触发面宽造成与单模型技能竞争:image-edit 与 nano-banana-edit/gpt-image-edit/flux-kontext 的 trigger 词重叠 — 宿主同时装载时可能重复路由或抢单;依赖意图表的 LLM 分类消歧,非确定性保证。
- 『Strongest in class』等比较性宣称无仓内证据 — 路由表 Why 列为营销话术层,实际能力随模型版本变动。
5第二遍独立确认
- [ok] 四个 route 模型 ID 与调用示例、schema 一致 — 四条 Route 的 **Model** 行与各自 `runcomfy run` 示例成对出现:google/nano-banana-2/edit、openai/gpt-image-2/edit、blackforestlabs/flux-1-kontext/pro/edit、tongyi-mai/z-image/turbo/inpainting,无悬空引用。
- [ok] Route 1 与 nano-banana-edit 技能同源 — preservation-first 话术、cyberpunk/AURA 示例、schema 字段与 nano-banana-edit/SKILL.md 逐字一致;此处略去 safety_tolerance/limit_generations 属有意精简,非错误。
- [ok] 品牌 override 目标(gpt-image-edit、flux-kontext、nano-banana-edit)可达性 — 三个目录在仓库根真实存在;Z-Image 无对应品牌技能且未被列入 override,文档未作虚假承诺。
- [ok] Z-Image mask 工作流字段与纪律自洽 — mask_image 必填、strength 0.3–1.0 分档语义、control_scale 0.6–0.9 在 schema 与 prompting tips 两处数字一致。
- [unlocatable] SKILL.md 对 CLI 行为的断言(token 0600、2 GiB、无 shell 展开) — CLI 源码不在本仓库,仅文档自述,无法独立证实。
- [unlocatable] GPT Image 2 / Z-Image 的能力宣称(Strongest in class for multilingual typography 等) — 路由表 Why 列为站外比较性宣称,pin 内无评测证据可复核。
- [discrepancy] 身份/安装链接一致性 — SKILL.md 安装与 GitHub 链接指向 agentspace-so/runcomfy-skills,被 pin 镜像为 prime-skills/runcomfy-agent-skills——来源标识不一致(发布身份漂移,非代码缺陷)。
6结论
173c3a258c664f4a…fca19ae084