首页 / 全部技能 / 内容创作 / video-intake-and-storyboard
内容创作 · saranambiar/hyperframes-video-agent-skills

video-intake-and-storyboard

Convert rough video prompts, scripts, reference images, and edit notes into decision-complete scene specs and storyboards for agent-led video production. Use when a user describes a scene, gives timestamped narration, asks to preserve previous scenes, references a concept image, or requests a multi-scene video plan.

风险提醒:蓝色 · 知晓即可AI 侦查报告
作者 saranambiarGitHub saranambiar/hyperframes-video-agent-skills ↗Stars 48许可 Apache-2.0(仓库根 LICENSE 为 Apache License Version 2.0;GitHub API license.spdx_id = Apache-2.0)commit f6b043d9fd
agent 宿主通常会约束 skill 执行权限;风险提醒为 AI 侦查观点,不构成质量或安全保证。第三方 skill 仅作拆解与展示,安装使用风险自负,版权归原作者。

1实现原理 · 为什么它能做到

目标被写死为「产出另一个 agent 无需猜测即可执行的 spec」——衡量标准是可执行性,而不是文档完整度。

skills/video-intake-and-storyboard/SKILL.md
Use this skill before building scenes. The goal is to transform conversational direction into a spec that another agent can execute without guessing.
注:这里在做什么:把 intake 的验收标准定为「下游不用猜」;同族 end-to-end-video-playbook 也以「先把意图转成生产工件」为第 2 步。

intake 分四趟抽取:硬事实(场景号、时长与目标帧率分辨率、旁白与短语时间戳、参考图或末帧目标、资产位置、明确的不许碰边界、与前后场景的必要转场)、样式约束、批准状态、缺失决策。

skills/video-intake-and-storyboard/SKILL.md
1. Extract hard facts.
注:这里在做什么:把用户随口说的分成硬约束与偏好两类;Explicit "do not touch" boundaries 被列为硬事实,后续一律当约束处理。

提问门槛:只问会改变实现的问题,并优先给具体选项(裁或不裁、字幕样式、转场方向、末帧优先级、音乐音量行为),而不是开放式提问。

skills/video-intake-and-storyboard/SKILL.md
- Ask only if the answer changes the implementation.
注:这里在做什么:把澄清成本压到最低——开放式提问会让用户替 agent 做设计工作,具体选项才是可决策的。

scene spec 质量门槛是十问:首帧发生什么、末帧发生什么、随时间变化什么、由哪条旁白或音频驱动时序、哪个确切时间戳最重要、哪个先前场景必须保持不动、需要哪些资产、必须复用哪些样式、哪些视觉参考控制布局、哪些证明帧能证明成功。

skills/video-intake-and-storyboard/SKILL.md
A scene spec is ready to implement when it answers:
注:这里在做什么:给了「spec 何时算写完」的可判定标准,等于把「准备充分」变成 checklist,而不是感觉。

时间戳被当作生产约束处理,并给语义映射(At 5s 即该时刻必须可见;Start around 3s 即可为在该刻可见而略早开始;Land by 10s 即不晚于;Hold for 3s 即期间无大布局变化;Do not appear before 即先置初态到点才揭示)。

skills/video-intake-and-storyboard/SKILL.md
"Start around 3s" means animation may begin slightly earlier if it must be visible by 3s.
注:这里在做什么:把自然语言时间词转成可实施约束;族内 scene-continuity 也把时间默认值的最终裁决权交给旁白时序。

时间戳必须标明是「场景内局部」还是「全片全局」——这是族内多处故障(字幕、场景时长、证明帧)的共同根因。

skills/video-intake-and-storyboard/SKILL.md
Always record whether timestamps are local to a scene or global to the full video.
注:这里在做什么:一句话消掉一整类歧义;下游 audio-sync-assembly 的场景起点图与 render-qa 的点名时间戳都依赖这个约定。

批准边界台词被明确定义为约束而非建议(别改 Scene 01、当作已批准、不要从零重生、保持样式与字体与颜色与组件、只更新这个转场、附图仅作参考)。

skills/video-intake-and-storyboard/SKILL.md
These are constraints, not suggestions.
注:这里在做什么:把用户的口头授权变成可执行约束,与仓库 AGENTS.md 的 Never mutate approved scenes unless the user explicitly asks 同源。

内容与模式分离:把笔记拆成「项目专有内容」(名称、logo、旁白、产品 UI、品牌文案、私有文件名)与「可复用模式」(相机擦、图表绘制、字幕预览、裁切安全、音乐 ducking、末帧证明),只有后者才进未来 skill 或示例。

skills/video-intake-and-storyboard/SKILL.md
Only reusable patterns belong in future skills or examples.
注:这里在做什么:这是给「从真实项目提炼 skill」定规则——防止私有素材与品牌泄进公开仓库(对应 README 贡献原则与 AGENTS.md 的仓库边界)。

2核心能力

01intake 四趟扫描(硬事实 / 样式约束 / 批准状态 / 缺失决策)与「只问会改变实现的问题」的门槛
02scene spec 规则:每场景一份 templates/scene-spec.md;节拍写成带时间戳的视觉动作而非模糊动效情绪;写清确切时刻必须出现与不得提前出现的内容;含首帧与末帧要求与供后续 QA 用的证明时间戳
03storyboard 规则:多场景用 templates/storyboard.md;把已批准场景标为 locked;标注 carryover 依赖;记录哪条音频控制该场景时长、哪个字幕或脚本文件具有权威性
04参考图处理:界定必须匹配的项(构图、颜色、尺寸、文本、位置)与可差异的项(精确复制、真实数据、logo 图形、相机裁切、动画路径);从末帧倒推;计划末帧证明与下一场景 carryover 证明
05批准边界捕获(6 类台词)与「减少迭代的提示模式」(末帧目标、重要元素出现的确切时间、该时刻前后可见内容、哪些既有场景不得改动、样式可否变、音频是仅参考还是必须叠加)
06storyboard 失败模式清单(场景时长与音频时长不符、场景依赖尚未创建的上一场景末帧、参考图与书面时序冲突、用户事后说忽略该参考、末场景改动连带需要改前面字幕或音频)
07澄清问题清单(音频是定稿还是仅参考、末帧要精确还是方向性匹配、录屏可否露出画布、静默段是否要字幕、停顿处音乐是否抬升)与交接格式(填好的 spec 与 storyboard、资产清单、已锁场景清单、未决问题、建议实现顺序)

3外部依赖

类型依赖
package仓库根模板 templates/scene-spec.md(每场景一份)与 templates/storyboard.md(多场景结构)——本件点名使用;位于仓库根,不在 skill 目录内
package输入素材:用户提示、带时间戳的旁白或脚本、参考图、编辑注记与项目内既有场景/渲染(本地读取,无外部服务)

4风险提醒 风险提醒:蓝色 · 知晓即可

风险提醒:蓝色 · 知晓即可
  • 「内容与模式分离」无执行机制 — 只有规则没有检查(无私有路径扫描、无提交前审查清单);私有文件名、客户 logo、品牌文案是否真被剥离,仍取决于操作者的自觉。
  • spec 的完整度依赖用户信息质量 — 若用户只给一句模糊描述,十问门槛会导致大量待补项;SKILL.md 允许全部可推导就不问直接开工,但没有定义「推导不出时的最小可开工集」,实际可能带着缺口进入构建。
  • 参考图处理需要读图能力 — Identify what must match: composition, color, size, text, position, or only concept. 要求对参考图做细粒度判读;弱视觉模型环境下只能退化为粗略描述,末帧匹配的证明也无从比对。
  • 「不要问可查明的问题」加读盘即信盘构成注入面 — 鼓励 agent 直接读项目文件并把内容当约束;若项目内文件(既有场景、脚本、注释)由第三方提供,其中的指令式文本可能被写进 spec 并传递到构建阶段,本件没有可信度校验步骤。
  • 无脚本、无命令,落地依赖模板与下游 skill — 本件不产出任何可执行检查;填空式的 spec 与 storyboard 若不被下游(scene-builder、audio-sync-assembly、render-qa)真正引用,就只是文档而不是约束——文档未要求交接后验证下游是否按 spec 执行。
风险提醒:蓝色,知晓即可。skill 目录只有 SKILL.md(纯指令,无脚本、无端点、无凭证);行为面是本地读取(项目素材、参考图、既有场景)与本地写盘(填 spec 与 storyboard 与清单),符合蓝档「仅本地读写」。**没有把素材送外部服务**:全量扫描本 skill 目录内无 http(s):// 端点、无 fetch/requests、无 token/env 读取、无 CLI 命令。它把「私有内容与可复用模式」分离写成规则,对仓库卫生是正向约束(防止私有素材与品牌进入公开示例)。九件同族 skill 判级口径一致:目录内只有 SKILL.md,行为面是本地读写与本地 CLI,无端点、无凭证、无素材外发。

5第二遍独立确认

  • [ok] 「无外部依赖、无端点无凭证」是否成立 — 目录内正则扫描零命中(无 http(s)://、无 fetch、无 token/env、无 CLI 名);本件与 motion-design-systems、scene-continuity-and-transitions 同属族内「纯判据、零 CLI」的一组。
  • [ok] 两个模板能否承载 SKILL.md 的质量门槛 — templates/scene-spec.md 含 Beat Timeline(Time、Narration or cue、Visual action、Required proof)与 Continuity(First frame must match、Last frame must be reusable by、Carryover frame files to update)与 QA Checklist(末帧与边界与字幕与音频证明时间戳、已知风险、验收标准),逐项对应十问;templates/storyboard.md 的 Scene Table 含 Status、Starts from、Ends on、Do not touch,并有 Global Rules 的 Approved scenes,对应 locked 与 carryover 依赖要求。
  • [ok] 时间戳语义是否与族内时序真源冲突 — 本件把时间戳当约束并允许为在 3s 可见而略早开始,最终裁决交给音频(- Track which audio clip controls each scene duration.);audio-sync-assembly 以最新批准的旁白音频为时序真源,scene-continuity 声明 narration timing wins when explicit.——三处一致。
  • [ok] 「不要问可查明的」是否与「只问会改变实现的」自相矛盾 — 两条是同一门槛的两面:先声明只问会改变实现的,再列 5 类可从文件查明的问题(时长、场景名、帧率、含标签的源文件、是否有音轨),实际规则是「能读盘就不问,读了还不确定才问」。无矛盾。
  • [ok] 本件是否覆盖「用户说忽略之前参考图」这类撤回场景 — Storyboard Failure Modes 列出 A user saying "ignore this reference" after it was already used.,属对撤回的提示;但未给具体回滚程序(只提示风险),实际回滚需依赖 render-qa 的外科流程——属分工而非缺口。
  • [discrepancy] 「内容与模式分离」是否真能防止私有素材出仓 — 规则只要求把项目专有内容与可复用模式分开,并说私有文件名等属专有内容;但 SKILL.md 未给可执行的检查(例如私有资产路径清单或提交前审查),实际执行依赖 agent 自觉与仓库 AGENTS.md 的 Keep private project assets out of this repository.。属规则层约束,非机制。

6结论

  • 把 intake 的验收标准定为「下游 agent 无需猜测」并给出十问门槛,使「准备充分」可判定
  • 时间戳的语义映射加局部与全局标注,一句话消掉多场景多轨里最主要的歧义源
  • 批准边界台词被定义为约束,直接支撑下游「不得改动已锁场景」的所有停止条件
  • 提问纪律具体到「优先给具体选项」(裁或不裁、字幕样式、转场方向、末帧优先级、音乐音量行为),降低澄清成本
  • 内容与模式分离同时服务于 spec 质量与仓库卫生(私有素材与品牌不进公开示例)
  • 适合:适合:项目的起始阶段——用户只给粗略想法、带时间戳的旁白、参考图或编辑注记,需要把它变成可执行的多场景计划时;也适合在加新场景、要保留既有场景、或需要一份「让另一个 agent 直接照做」的 spec 与 storyboard 的场合。
    不适合:不适合:① 已有一份完整批准 spec、直接进入构建(应加载 hyperframes-scene-builder);② 收尾小改(走 render-qa-and-surgical-changes);③ 需要产出实际画面、声音或验收证据的场合(本件无命令、无脚本,只产出文档);④ 需要合规审查或私有素材脱敏机制的项目(分离规则是约束而非机制)。
    安装 agent 直装可复制
    ① 本站镜像 更新 2026-09-28
    方式 A · 人下载镜像包下载 video-intake-and-storyboard.tar.gz
    sha256: f997b1af0e9338b6…
    方式 B · JSON 格式安装指南,复制给 agent
    安装指南
    agent 读 JSON 指南后会自动从本站下载安装,无需更多说明。
    ② 上游 GitHub · 原始来源
    能访问 GitHub?直接去上游安装(实时版,可能已更新)GitHub 原始 ↗
    本页镜像锁定 commit f6b043d9fd;上游为实时仓库。
    来源信息 GitHub 原始
    作者 / 仓库saranambiar / saranambiar/hyperframes-video-agent-skills
    Stars48
    最近推送2026-06-14
    本 skill commitf6b043d9fd
    许可Apache-2.0(仓库根 LICENSE 为 Apache License Version 2.0;GitHub API license.spdx_id = Apache-2.0)
    本站信息
    收录日期2026-09-06
    分类内容创作
    侦查报告AI 侦查 · 2 遍 · 2026-09-06
    本站镜像与 GitHub 原始是不同来源:本站锁定 commit 快照经 /r2 分发;GitHub 为实时上游,内容可能已更新。
    同分类邻近