首页 / 全部技能 / 内容创作 / video-storytelling
内容创作 · nateherkai/hyperframes-student-kit

video-storytelling

Design and build the visual layer of a long-form talking-head video as one persistent world the camera moves through, instead of a sequence of separate graphics. Use when asked to edit a video, add motion graphics, design the visuals for a script, plan an edit, or fix an edit judged confusing, text-heavy, hard to follow, or "clearly made by an AI". Covers the persistent world, camera grammar, the spotlight rule, spatial open loops, ornament and token discipline, transcript timing, and the verification gates.

风险提醒:蓝色 · 知晓即可AI 侦查报告
作者 nateherkaiGitHub nateherkai/hyperframes-student-kit ↗Stars 1070许可 MIT(仓库根 LICENSE = MIT License, Copyright (c) 2026 Nate Herk);另有 licenses/PIPELINE-USE-PERMISSION.txt(教学包再分发授权)与 licenses/HYPERFRAMES-LICENSE(Apache-2.0,随包 HyperFrames skill 的上游许可);GitHub API 因附加许可把仓库标为 NOASSERTIONcommit 0d30152a82
agent 宿主通常会约束 skill 执行权限;风险提醒为 AI 侦查观点,不构成质量或安全保证。第三方 skill 仅作拆解与展示,安装使用风险自负,版权归原作者。

1实现原理 · 为什么它能做到

要治的病是「场景思维」:每几秒换一张新图会让观众每几秒重启一次理解,而失败反馈会以模糊的「看不懂/太满」出现,而不是具体缺陷。

.claude/skills/video-storytelling/SKILL.md
The failure this replaces is scene-thinking. … rather than as a specific defect.
注:这里在做什么:把「AI 味/看不懂」归因到结构决策而非单张图的审美,从而引出后面全部几何与纪律规则。

一个持久世界:全片同一空间且永不重置,已出现的元素不被重绘、移动或改标;空间语法在建任何东西前定好并贯穿全片。

.claude/skills/video-storytelling/SKILL.md
### One persistent world … An element, once drawn, is never redrawn, moved, or relabelled.
注:这里在做什么:世界不重置是后续机制的前提(相机有地方可去、聚光灯才有意义、开环才能一直开着);参考实现里左右=走向结果、上=人且唯一暖色、下=系统记录,并只允许为意义破例一次(reopen rate 的倒放)。

相机即剪辑:切到新图形会夺走观众方位感,而在不动的空间里移动不付费;并给出 World/Region/Detail 三高度与相邻移动规则。

.claude/skills/video-storytelling/SKILL.md
### The camera is the edit … Moving through a space that stays put costs them nothing.
注:这里在做什么:把运镜升级为信息结构;并配一组用返工换来的规则(取景写成世界窗口而非缩放系数、同用途复用同一窗口、覆盖层先不透明再动相机、标签距边 ≥60px、两个连续运动要合并成一个手势)。

注意力是聚光灯:任意时刻只有一个元素全亮,其余已画元素保持安静但可读;层级来自亮/静的比值,而不是把整体压暗。

.claude/skills/video-storytelling/SKILL.md
**Exactly one element at full brightness at any moment. Everything else already drawn stays quiet but legible.**
注:这里在做什么:给出状态与目标亮度(active 200-235 / context 120-150 / spent 85-105,标签永不低于 90),并用一个 lit() 函数在每次口播节拍统一驱动;参考实现首版最亮像素仅 101/255 不可读,修复方式是提亮墨水而不是继续变暗。

开环是空间性的:不说「我们稍后再回来」,而是在世界里留下可见的未完成物,并按脚本形状选几何(并列项/深流程/分层/对比/新闻/教程)。

.claude/skills/video-storytelling/SKILL.md
Never say "we'll come back to this." Leave something visibly incomplete in the world and return to it.
注:这里在做什么:把悬念几何化,并规定四步机制——植入在 hook、每个边界复现、可见推进、用开场那张图闭合;计数器必须配 1–2 词的名字而不只是数字。

元素纪律:没被念到就不画——每个形状要么是带标签元素、标签之间的连接线、行进主体或环境底,且每节屏上词数约 20 个。

.claude/skills/video-storytelling/SKILL.md
### If it doesn't get a word, it doesn't get drawn … Nothing else.
注:这里在做什么:把「太满」定位成「未标注形状与有意义的形状用同一笔重与同一配色」,观众被迫花注意力解码本不需要解码的东西;对应预算条款与「反例视觉绝不叠在推荐方案上」。

全局 token 集是硬约束:笔画 1.5/2.5/4/7、字号 22/30/42/60/84、圆角 10/22/40(恒为超椭圆 2)、五色五义零装饰,并用 token linter 让构建失败。

.claude/skills/video-storytelling/SKILL.md
Full detail in `reference/design-system.md`. … Gate it with a token linter that fails the build.
注:这里在做什么:对治首版「每个决定都局部正确、没有决定是全局的」(18 种笔重、9 种字号,多数相差 0.2);design-system.md 声明 token 规则是 the single most important rule,且 qa-tokens.mjs 违规即失败。

构建契约把工程事故写成规则:一节一生成器、共享模块禁并行改、装配前给 SVG defs 命名空间、渲染必须 --workers 1。

.claude/skills/video-storytelling/SKILL.md
**Namespace the SVG defs before assembly.** … Cost in the reference build: 35 seconds of empty screen with every gate green. … `--workers 1` on render. Parallel workers make the video layer paint black.
注:这里在做什么:把真金白银的返工写成检查项——defs 未命名空间导致装配后大片空白而所有门都是绿的;并行 worker 让画面变黑;插入气口若硬接会截断语音衰减被听成结巴。

门禁齐备但明确「门禁不能代替亲眼看」:运动平滑必须在连续帧上验证,且每个门都要拿已知会触发的对照验证其有效性。

.claude/skills/video-storytelling/SKILL.md
**Gates do not replace looking**, and gates that have never failed are not gates. … Motion smoothness is verified on contiguous frames, never on beat frames. … Validate every gate against a control … A seam gate that reports zero on a broken build is worse than no gate.
注:这里在做什么:给出具体缺陷指纹(相邻 tile 大跳后多帧近似=前重缓动/死停;运动停住后另一种运动开始=该合并为一个手势;单帧异样=pop),并说明参考实现的 intro 曾带着这种 glitch 通过所有门、被客户一次观看抓出。

音频审计到声学层而非转写层:全轨死段扫描、1ms 分辨率包络取证、对成片重跑 ASR 与期望文本比对。

.claude/skills/video-storytelling/SKILL.md
**Audit audio at the acoustic level, not the transcript level.** … truncation cliffs and dead holes, not doubled words.
注:这里在做什么:指出转写层扫描对剪辑引入的伪影是结构性盲的(报告 clean 而客户听到 stutters);并给出气口插入的正确做法(房间音 + 40ms 等功率交叉淡入,绝不硬接)。

2核心能力

01长片视觉层设计方法:持久世界 + 空间语法 + 三高度相机 + 聚光灯 + 空间开环
02按脚本形状选开环几何(并列项/深流程/分层/对比/新闻/教程),并附一个可复用工作实例(wall of slots)
03可带走的几何模块:槽位材料/光照定义与超椭圆圆角路径,供每个 section builder 共享同一接口坐标
04token 化视觉系统(笔画/字号/圆角/五色五义)与违规即失败的 linter 要求
05生成器工程纪律:每节一个 build_<id>.py 只写自己的 HTML、共享模块禁并行改、装配前 defs 命名空间、渲染 --workers 1
06时序纪律:一切对词起点(提前 0.15–0.25s 入场)、审计 >1.5s 死屏、气口插入用房间音且 40ms 等功率交叉淡入
07验收门族与读带方法:qa-tokens / no-crossfade / legibility / seamjump / deadframe / presence / integrate + 每转场抽连续帧条带
08与相邻 skill 划界:明说不是 hyperframes-video-beats(后者把叠加卡放在说话人身上,本 skill 设计视频「关于」的东西)

3外部依赖

类型依赖
cliFFmpeg(转场窗口连续帧条带抽取,用于读运动缺陷)
cliNode 门禁脚本族(使用者项目内生成的 qa-*.mjs / integrate.mjs,非随包分发)与 HyperFrames CLI
packagePython 几何/槽位模块(随包分发,供项目 section builder 导入)
package兄弟资源:仓库根 docs/STORYTELLING-WORKBOOK.md(中性练习表)与本 skill 的 reference/design-system.md

4风险提醒 风险提醒:蓝色 · 知晓即可

风险提醒:蓝色 · 知晓即可
  • 规则密度极高,实际执行需要真人投入(逐项门禁 + 连续帧阅读 + 声学审计) — 方法自认慢是有意的,但若团队没有相应工时,最容易被跳过的恰是回报最高的两项:装配体目视与条带读帧。
  • 依赖项目内自建脚本(qa-*、build_<id>.py、integrate.mjs)而不随包分发 — SKILL.md 的命令假定使用者已有这些生成器;从零开始需自行搭建,否则门禁名存在但无实现(本 skill 只提供方法与几何模块)。见 second_pass 的 discrepancy 条。
  • 几何/坐标纪律是硬约定,违反会静默劣化 — wall.py 头注释声明 SLOT 1 坐标被 build_s01.py 硬编码为 dock 目标;若改坐标而不同步生成器,dock 会错位且不易察觉。
  • 素材文本进入生成器源码字符串,缺少转义/消毒条款 — 口播/文章内容会被烘焙进 build_<id>.py 的字面量与标签;含引号或指令式文本的素材可能破坏生成或影响后续节次,需使用者自行处理。
  • 文档中的参考数字不可复现(私有构建) — 见 second_pass 的 unlocatable 条:亮度/时长/事故数字来自未随包的参考构建,不能当作可核事实引用。
  • 对「门禁未覆盖的主观质量」仍有依赖 — 方法自己承认可读性/图例感不可自动化(绝对像素占比衡量的是文本量),因此最终质量取决于执行者是否真的做静音目视评审。
风险提醒:蓝色,知晓即可。本 skill 自身目录 = SKILL.md + reference/(一份设计系统 md、一个模式目录含 README.md 与两个 .py)。两个 Python 文件是纯几何数学:wall.py 定义槽位/材料与 defs 常量字符串,geom.py 只有 math 与路径构造;全目录 grep(*.md/*.py)无 http、无 requests/urllib、无 os.environ、无 subprocess——即无网络外发、无凭证读取、无子进程执行。SKILL.md 指示的动作都属于本地构建与本地验证:生成 build_<id>.py 与 compositions/*.html、渲染、跑项目内 qa-*.mjs 门禁、用 ffmpeg 抽帧、用 npx hyperframes lint。唯一值得知情的是操作风险而非安全风险:写盘量大(生成器烘焙上百个时间字面量,任何时间线变更必须走 AST 级位移而非手改),以及文档明确的渲染约束 --workers 1(并行 worker 会让画面变黑)。

5第二遍独立确认

  • [ok] 两个随包 .py 是否真的无网络/无 env/无子进程(蓝档关键) — wall.py 仅 import os, sys 用于路径常量与 DEFS 字符串(os 未用于 environ/exec);geom.py 仅 import math。全目录 grep 无 requests/urllib/socket/http/os.environ/subprocess/eval。结论:几何模块,无执行面。
  • [discrepancy] SKILL.md 的门禁脚本是否真属本 skill(避免把项目内产物算作 skill 资产) — [判定:口径澄清,非缺陷]SKILL.md 的命令写作 node scripts/qa-tokens.mjs、node scripts/build_<id>.py、node scripts/integrate.mjs——这些是使用者项目里生成的脚本,pin 仓库的 skill 目录内不存在(该目录仅 5 个文件)。本报告因此在 internal_assets 只列随包文件,并在 external_deps 标注门禁脚本属项目内生成物。
  • [unlocatable] 参考实现的具体数字与事故能否在源码内定位 — SKILL.md 引用的大量参考构建细节(最亮像素 101/255、35 秒空屏、输入口 glitch、被听成 stutters 的 20-40ms 接缝、speaker 在屏约 40%)来自作者对一段私有参考构建的返工记录;pin 仓库内没有该构建的渲染/日志/qa 输出,故这些数字只作「文档声明」记录,不在结论中当已核事实。方法本身(规则名与门禁名)可在 SKILL.md 内逐条定位。
  • [ok] 「门禁不能替代人眼」是否只是修辞(会不会把 qa 脚本当通过依据) — SKILL.md 明写 'Gates do not replace looking, and gates that have never failed are not gates.',并要求每条门用已知会触发的 control 验证、在装配体而非 section 原型上验证、可读性必须看 960x540 降采样、运动必须读连续帧条带。规则自洽且可执行。
  • [ok] 音频纪律是否与「剪辑不碰词」原则冲突 — SKILL.md 要求在句界插入 4–8 帧房间音(words never touched)、用 40ms 等功率交叉淡入接进尾音衰减、且插入式改动对转写是确定性位移(无需重转写)——与语速/词不被裁切的原则一致,属对反例(硬接造成 cliff)的显式修正。

6结论

  • 把「看不懂/太满/AI 味」转成可诊断的结构问题(场景思维、无全局 token、未标注形状),并给出诊断顺序
  • 空间开环是可复用几何模板,且随包给了工作实例与共享模块(wall of slots + wall.py/geom.py)
  • 门禁哲学成熟:门要能被证明会失败、要在装配体上验、不能替代人眼,并附具体缺陷指纹的读带方法
  • 工程事故被写成规则(defs 命名空间、--workers 1、AST 位移而非手改、共享模块禁并行改),直接省掉同类返工
  • 音频审计深入到声学层(死段扫描、1ms 包络取证、成片重跑 ASR),并指出转写层扫描的结构性盲区
  • 与相邻 skill 边界清楚:不抢 hyperframes-video-beats 的叠加卡职责,本 skill 设计视频「关于」的东西
  • 适合:适合做有脚本的长片口播视频(新闻解读、单主题深挖、对比、教程、清单)并自己写生成器的人:需要在 10 分钟尺度上维持观众方位感、要一套可带走的空间开环与 token 系统、且愿意接受「门禁 + 亲眼看」双轨验收。也适合把它当「为什么我的画面像 AI 做的」的诊断手册来读。
    不适合:不适合:① 只要叠加卡式的 talking-head 包装(走 hyperframes-video-beats);② 短视频/竖屏快剪(本 skill 面向长片与持久世界);③ 不想搭生成器与门禁脚本、只想拿模板的人;④ 无法做目视与听感复核的纯自动化流水线(本方法明确拒绝把门禁当通过依据)。
    安装 agent 直装可复制
    ① 本站镜像 更新 2026-09-28
    方式 A · 人下载镜像包下载 video-storytelling.tar.gz
    sha256: af02bf58b5fef932…
    方式 B · JSON 格式安装指南,复制给 agent
    安装指南
    agent 读 JSON 指南后会自动从本站下载安装,无需更多说明。
    ② 上游 GitHub · 原始来源
    能访问 GitHub?直接去上游安装(实时版,可能已更新)GitHub 原始 ↗
    本页镜像锁定 commit 0d30152a82;上游为实时仓库。
    来源信息 GitHub 原始
    作者 / 仓库nateherkai / nateherkai/hyperframes-student-kit
    Stars1070
    最近推送2026-09-28
    本 skill commit0d30152a82
    许可MIT(仓库根 LICENSE = MIT License, Copyright (c) 2026 Nate Herk);另有 licenses/PIPELINE-USE-PERMISSION.txt(教学包再分发授权)与 licenses/HYPERFRAMES-LICENSE(Apache-2.0,随包 HyperFrames skill 的上游许可);GitHub API 因附加许可把仓库标为 NOASSERTION
    本站信息
    收录日期2026-09-06
    分类内容创作
    侦查报告AI 侦查 · 2 遍 · 2026-09-06
    本站镜像与 GitHub 原始是不同来源:本站锁定 commit 快照经 /r2 分发;GitHub 为实时上游,内容可能已更新。
    同分类邻近