1实现原理 · 为什么它能做到
把“封面长什么样”拆成六个可确认的维度(Type/Palette/Rendering/Text/Mood/Font)+ 宽高比,每维都有取值枚举与默认值,最终拼成一份结构化 prompt。
Generate elegant cover images for articles with 5-dimensional customization.
维度缺省时有“内容信号 → 取值”的自动选择表:按关键词命中把内容类型、调色板、渲染手法、文字量、情绪、字体一一映射。
When a dimension is omitted, select based on content signals.
确认是硬门禁:必须用宿主交互工具(AskUserQuestion 或等价物)把选项做成可点选问题,而不是甩一张文字表格。
**MUST use `AskUserQuestion` tool** to present options as interactive selection — NOT plain text tables.
生成前把 prompt 落盘成 prompts/cover.md(含 content context / visual design / text elements / mood / font / composition 分段),frontmatter 里带 references 列表。
Save to `prompts/cover.md`.
参考图是“高优先级视觉输入”,且明确警告只传 --ref 不够:必须同时在 prompt 文本里描述要复现什么。
**Passing `--ref` alone is NOT enough.**
后端解析沿用仓库统一规则:请求点名 > EXTEND.md 偏好 > 自动选择(Codex imagegen > codex-imagegen > Cursor GenerateImage > 其它原生 > 唯一已装 > 问用户)。
**Codex (`imagegen`)** — first, inspect your available-skills / tool inventory.
构图与文字纪律写死:留白 40-60%、人物只做简化剪影、标题必须用用户/原文的准确标题不得自创;文字出错只能改 prompt 重生成,不许在图上涂改。
**Title**: Use exact title from user/source; never invent
输出目录与产物结构固定:默认 independent 落到 cover-image/{topic-slug}/,内含 source、refs/、prompts/cover.md、cover.png,重生成前先备份旧图。
- `independent` (default): `cover-image/{topic-slug}/`
2核心能力
3外部依赖
| 类型 | 依赖 |
|---|---|
| api | Codex 原生 imagegen skill(Skill 工具调用) |
| cli | codex CLI / baoyu-image-gen(codex-imagegen 分支) |
| api | Cursor 原生 GenerateImage / Hermes image_generate |
| network | codex-imagegen wrapper(自述认证走用户 Codex 订阅) |
4风险提醒 风险提醒:橙色 · 评估后使用
- 标题与摘要出网到第三方图像模型(orange 档主因) — Step 4 明确把 prompt 文件交给 codex imagegen / baoyu-image-gen 等后端;未发布文章的标题与要点会离开本机,且消耗账号额度。
- 确认流程与后端依赖带来使用门槛 — 没有 AskUserQuestion 等价物的宿主会退化为编号文本问答;若一个图像后端都不可用,流程停在“问用户怎么办”。
- 参考图被提升为强指令的注入面 — 模板要求把参考图特征以 MUST/REQUIRED 写进 prompt;若参考图来自不可信来源,其描述会主导生成内容,属内容层风险。
- multiSelect/问题数受宿主限制 — 按注释一次最多 4 问,六维 + 宽高比需分两批;宿主若只支持单问会显著拉长交互。
- 产物为单文件,无版本管理 — 重生成会备份 cover.png 但目录内不保留多版本索引,需要用户自行命名管理(对比 comic 的 -backup 规则更细)。
5第二遍独立确认
- [ok] 自身无脚本/无端点/无凭证 — 目录内全是 markdown;URL 扫描只命中 github.com/JimLiu/baoyu-skills。
- [ok] SKILL.md 点名生成后端(orange 依据) — Codex imagegen / codex CLI via baoyu-image-gen / Cursor GenerateImage / Hermes image_generate 均在 SKILL.md 正文,且写成“一次选定、生成前必须完成”。
- [ok] 维度数量说法核对(描述写 5 dimensions) — SKILL.md 正文 Actually 列 Type/Palette/Rendering/Text/Mood 五维于 Five Dimensions 表,Font 单列在枚举与 Options 中——描述与正文不冲突,侦查按正文六项记录。
- [ok] 文字/色值纪律 — prompt-template.md 的 Color constraint 与 SKILL.md 的 Title/Characters/Composition Principles 三处对得上;位图涂改禁令与 article-illustrator 同款。
- [ok] 参考图不支持 --ref 时的降级路径 — SKILL.md Step 1 与 reference-images.md 一致:写 refs/ref-NN-{slug}.md 逐人物描述,并以 MUST/REQUIRED 嵌入 prompt。
- [ok] meta 元数据 — GitHub API:MIT、25926 stars、pushed_at 2026-09-10T15:13:43Z;本地 HEAD 与 pin 1567581c26ec… 一致。
6结论
e68671656994141a…1567581c26