全部技能 / 内容创作 / image-to-video
内容创作 · prime-skills/runcomfy-agent-skills

image-to-video

Animate any still image on RunComfy — this skill is a smart router that matches the user's intent to the right i2v model in the RunComfy catalog. Picks HappyHorse 1.0 I2V (Arena #1, native audio, identity preservation) for general animations, Wan 2.7 with `audio_url` for custom-voiceover lip-sync, or Seedance 2.0 Pro for multi-modal animation from image + reference video + reference audio. Bundles each model's documented prompting patterns so the caller gets sharper output without burning iterations on the wrong model. Calls `runcomfy run <vendor>/<model>/image-to-video` (or endpoint variant) through the local RunComfy CLI. Triggers on "image to video", "image-to-video", "i2v", "animate image", "make this move", or any explicit ask to turn a still into video.

风险提醒:橙色 · 评估后使用AI 侦查报告
作者 prime-skillsGitHub prime-skills/runcomfy-agent-skills ↗Stars 43许可 MIT(仓库根 LICENSE:Copyright (c) 2026 RunComfy / agentspace-so;GitHub API spdx=MIT)commit fca19ae084
agent 宿主通常会约束 skill 执行权限;风险提醒为 AI 侦查观点,不构成质量或安全保证。第三方 skill 仅作拆解与展示,安装使用风险自负,版权归原作者。

1实现原理 · 为什么它能做到

i2v 意图路由:常规动画(肖像/产品)默认 HappyHorse 1.0 I2V,自定义配音口型同步走 Wan 2.7 t2v+audio_url,多模态合成走 Seedance 2.0 Pro;agent 按意图表分类后落到对应小节。

image-to-video/SKILL.md
| Animate a portrait — keep identity stable | **HappyHorse 1.0 I2V** | #1 on Artificial Analysis Arena (Elo 1392); strong facial fidelity |
注:路由表含 8 个意图行 + 默认行(Default if unspecified → HappyHorse),正文承接句 `The agent reads this table, classifies the user's intent, and picks the matching subsection below.`(与 video-edit 同一写作模板)——分类执行者是宿主 LLM,skill 无代码。

诚实标注端点易错点:Wan 2.7 在此目录下没有独立 i2v 端点,口型同步实际复用 t2v 端点 + audio_url,文档显式声明以免 agent 想当然调 /image-to-video。

image-to-video/SKILL.md
**Model**: `wan-ai/wan-2-7/text-to-video` (NOT `/image-to-video` — Wan 2.7's t2v endpoint accepts an `audio_url` that drives lip-sync)
注:同一节再补一句说明:`For pure i2v (image animated by motion prompt only), prefer HappyHorse i2v.`——这体现 schema 是照着 RunComfy 目录实测整理而非想当然;description 里也预留了 '(or endpoint variant)' 的说法与这里呼应。

多模态合成的引用协议:Seedance 2.0 Pro 接受 0–9 张图、0–3 段参考视频、0–3 段参考音频的数组,提示词以『image 1 / video 1 / audio 1』编号把各模态 cue 路由给模型。

image-to-video/SKILL.md
- **Number the refs** in the prompt: `"subject from image 1, lighting from video 1, voice from audio 1"`. Seedance routes cues correctly.
注:schema 行给出数组上限(`image_url` array 0–9、`video_url` 0–3、`audio_url` 0–3),提示词纪律页强调首图是 primary subject(`**First is the primary subject.**`)。

动效提示词语法:动作动词前置、不复述图像内容、单 clip 单一主运动,把『让静态图动起来』的写法约束成模板。

image-to-video/SKILL.md
- **Lead with motion verbs**: "drift", "dolly in", "orbit", "tilt up", "reveal", "blink", "breathe". Front-load what's MOVING.
注:配套纪律 `Don't restate the image — the model sees it. Focus tokens on what changes.` 与 `One beat per clip — single primary motion`——针对 i2v 模型『提示词描述冗余稀释运动』的通病。

执行委托 runcomfy CLI + 云端推理:三选一后以匹配 JSON body 调 `runcomfy run <model_id>`,CLI 负责提交、轮询与下载产物。

image-to-video/SKILL.md
The skill picks one of HappyHorse 1.0 I2V / Wan 2.7 t2v+audio / Seedance 2.0 Pro based on user intent and invokes `runcomfy run <model_id>` with the matching JSON body.
注:视频生成重活全在云端;skill 自身是『路由决策 + 参数模板 + 提示词纪律』的文档载体。

2核心能力

01i2v 三路意图路由(肖像/产品常规动画、自定义配音口型、多模态合成)
02以 audio_url 驱动的自定义配音口型同步(复用 Wan 2.7 t2v 端点)
03同图多语言配音变体:锁 seed、换 audio_url 逐语言出片
04多模态参考合成(图+参考视频+参考音频数组,首图为主角)
05动效/镜头/光照提示词语法 + negative_prompt 规避项
06参数化出片:分辨率/时长/宽高比/seed/水印开关逐字段可控

3外部依赖

类型依赖
cliruncomfy(@runcomfy/cli 官方 CLI)
package@runcomfy/cli(npm 全局安装)
networkRunComfy Model API(请求提交)
network生成结果下载白名单
network云端模型路由(经 CLI/Model API 访问):happyhorse/happyhorse-1-0/image-to-video、wan-ai/wan-2-7/text-to-video、bytedance/seedance-v2/pro
networkRunComfy 模型页 / 文档站(引用链接)
network用户提供的源图/参考视频/参考音频 URL——由 RunComfy 模型服务器抓取

4风险提醒 风险提醒:橙色 · 评估后使用

风险提醒:橙色 · 评估后使用
  • 源图/参考音频/配音轨与提示词上送第三方云,肖像与语音数据外发是功能必然 — HappyHorse 原生合成音频、Wan 上传 voiceover MP3——配音素材属敏感语音数据,使用者须自评合规。
  • 执行面与供应链仓外(官方 CLI、Model API、npm 包、npx 安装器) — 文档对 CLI 的转述(不 shell 展开、token 0600、2 GiB 上限)无法在本仓库证实。
  • 参考媒体 URL 由服务器抓取,音视频内容可作为注入载体 — 文档自认图像注入风险,音频/视频参考的注入面同理会存在但未被文档点名。
  • Arena 排名与 Elo 分数为站外营销宣称,无仓内证据且易过期 — 『#1』『Elo 1392』随时间与榜单方法变化会失真,不应作为长期选型依据。
风险提醒:橙色,评估后使用。按本次统一分档准则:运行时驱动第三方 npm 包/CLI @runcomfy/cli,该 CLI 每次调用读取用户 RunComfy 凭证(~/.config/runcomfy/token.json 或 RUNCOMFY_TOKEN 环境变量)——命中『调第三方 npm/CLI 且可能读配额/密钥 → orange』;执行面(CLI、Model API、token 读取)全部仓外,文档转述(0600、2 GiB 上限、无 shell 展开)无法在本 pin 证实,按『拿不准取高一档』定橙。另存在网络外发:源图/参考音视频(含配音轨,涉语音数据)与提示词经 model-api.runcomfy.net 上送第三方云,外发对象可预期但素材出域;参考媒体 URL 由服务器抓取。skill 本体纯 markdown、无脚本、无混淆、无隐藏端点,未触红档。

5第二遍独立确认

  • [ok] 三个 i2v 模型 ID 与路由表、调用示例一致 — happyhorse/happyhorse-1-0/image-to-video、wan-ai/wan-2-7/text-to-video(非 image-to-video)、bytedance/seedance-v2/pro 三处出现位置均成对自洽。
  • [unlocatable] HappyHorse『Arena #1 (Elo 1392)』宣称 — 路由表 Why 列与 Route 1 标题('Arena rank: #1 (Elo 1392)')均引用站外 Artificial Analysis 排名,pin 内无任何数据支撑;无法复核其时效与真伪,标记待补。
  • [ok] Wan 2.7 走 t2v 端点做口型同步的端点异例 — Route 2 明确 'NOT /image-to-video',与 description 的 '(or endpoint variant)' 措辞呼应;无自相矛盾。
  • [ok] 限制声明一致性(Seedance 720p ceiling、时长上限、音频 2–15s/<15MB) — Limitations 节与三处 schema 表(duration/resolution/audio 规格)数字一致。
  • [unlocatable] SKILL.md 对 CLI 行为的断言(无 shell 展开、token 0600、2 GiB 上限) — CLI 源码不在本仓库,仅文档自述,无法独立证实。
  • [discrepancy] 身份/安装链接一致性 — SKILL.md 安装与 GitHub 链接指向 agentspace-so/runcomfy-skills,镜像 README 指向 agentspace-so/runcomfy-agent-skills,被 pin 仓库为 prime-skills/runcomfy-agent-skills——三处来源标识不一致(发布身份漂移,非代码缺陷)。

6结论

  • 按用途(普通动画/配音口型/多模态)拆分三路并给出默认选择,避免用户拿错模型烧迭代
  • 端点易错点显式标注(Wan 用 t2v+audio_url),比『技能名叫 i2v 就硬调 i2v 端点』的文档更可靠
  • 多模态引用协议清楚:数组上限 + 编号 cue 语法,可组合图/视频/音频三路参考
  • 动效提示词纪律具体可执行(动作动词前置、不复述图、单主运动),针对 i2v 漂移通病
  • 安全面自述透明,含第三方媒体抓取与图像注入风险提示
  • 适合:适合有 RunComfy 账号、需要把静态图/产品图做成动效视频、或做自定义配音口型/多语言配音素材的 agent 用户;电商产品动效、营销短片、多语言发言人视频等批量场景;也适合想抄『诚实标注端点异例』写作手法的 skill 作者。
    不适合:不适合无 RunComfy 账号或拒绝素材上云的用户;需要纯文本生成视频(无源图)的场景(本技能是 i2v 路由器);需要单 clip 混用多模型能力(如 HappyHorse 动画 + Wan 口型同步)的场景——文档明示需两次调用自行拼接;也不适合追求本地离线生成或端到端可审计的用户。
    安装 agent 直装可复制
    ① 本站镜像 更新 2026-09-09
    方式 A · 人下载镜像包下载 image-to-video.tar.gz
    sha256: 72d420bb6e15ce52…
    方式 B · JSON 格式安装指南,复制给 agent
    安装指南
    agent 读 JSON 指南后会自动从本站下载安装,无需更多说明。
    ② 上游 GitHub · 原始来源
    能访问 GitHub?直接去上游安装(实时版,可能已更新)GitHub 原始 ↗
    本页镜像锁定 commit fca19ae084;上游为实时仓库。
    来源信息 GitHub 原始
    作者 / 仓库prime-skills / prime-skills/runcomfy-agent-skills
    Stars43
    最近推送2026-05-15
    本 skill commitfca19ae084
    许可MIT(仓库根 LICENSE:Copyright (c) 2026 RunComfy / agentspace-so;GitHub API spdx=MIT)
    本站信息
    收录日期2026-09-06
    分类内容创作
    侦查报告AI 侦查 · 2 遍 · 2026-09-06
    本站镜像与 GitHub 原始是不同来源:本站锁定 commit 快照经 /r2 分发;GitHub 为实时上游,内容可能已更新。
    同分类邻近