首页 / 全部技能 / 内容创作 / short-form-edit
内容创作 · nateherkai/hyperframes-student-kit

short-form-edit

Turn talking-head footage into a finished reel, YouTube Short, or short advertisement with curiosity-led openings, earned payoffs, story-driven cuts, transcript-synced motion graphics, moving B-roll, captions, subtle music, and synchronized sound effects. Use for short-form editing; use edit-video for long-form videos and cut-silences for pause removal alone.

风险提醒:橙色 · 评估后使用AI 侦查报告
作者 nateherkaiGitHub nateherkai/hyperframes-student-kit ↗Stars 1070许可 MIT(仓库根 LICENSE = MIT License, Copyright (c) 2026 Nate Herk);另有 licenses/PIPELINE-USE-PERMISSION.txt(教学包再分发授权)与 licenses/HYPERFRAMES-LICENSE(Apache-2.0,随包 HyperFrames skill 的上游许可);GitHub API 因附加许可把仓库标为 NOASSERTIONcommit 0d30152a82
agent 宿主通常会约束 skill 执行权限;风险提醒为 AI 侦查观点,不构成质量或安全保证。第三方 skill 仅作拆解与展示,安装使用风险自负,版权归原作者。

1实现原理 · 为什么它能做到

唯一的第一优先门禁是「前 3 秒有没有让人相信必须看到最后」;效果、素材量、制作精度都排在它之后,且在拿到观众数据前只算编辑判断。

.claude/skills/short-form-edit/SKILL.md
The first creative gate is: **"In the first 3 seconds is someone convinced they need to watch until the end?"** … Treat the answer as editorial judgment until audience data exists.
注:这里在做什么:把短视频成败点前移到开头,并明确「病毒式传播是愿望而非剪辑能保证的结果」(同段下半句),防止用特效量替代说服力。

授权是一份持续有效的状态:一次「做成片并迭代」的指示即授权本地剪辑与渲染,只补问缺失的批准,而不是每个草稿都重问;但发布或联系他人永远需要明确授权。

.claude/skills/short-form-edit/SKILL.md
User authorization persists. … ask only for missing approval, not again at every draft. Never post the reel or contact anyone without explicit authorization.
注:这里在做什么:把评审门禁与授权模型解耦;并给出本 skill 唯一的对外动作红线(发布/联系人)。

用同一份真实素材做三个显著不同的开头草稿,比较主题清晰度、好奇心、静音可懂度与跟进意愿,再记录选择理由。

.claude/skills/short-form-edit/SKILL.md
Build three materially different rough openings using the same truthful source speech. … do not select only the loudest effect.
注:这里在做什么:用「同素材多稿对照」替代凭感觉选开头,并要求先出带语音与粗音效的低分辨率 animatic,在便宜阶段修掉可预测/缺上下文/弱回报。

开环被结构化:每个诚实的观众疑问都要有植入物、植入时间、提醒或部分答复、闭合时间,以及促成本次闭合的口播证据。

.claude/skills/short-form-edit/SKILL.md
Create `OPEN-LOOPS.json` with each honest viewer question … then visibly change that state.
注:这里在做什么:把「悬念」变成可校验的 JSON;默认只开一个主循环 + 至多一个次循环,且承诺的教训必须在 CTA 前闭合(评论请求不能是唯一答复)。

图形与字幕绑定到词级时间:字幕与冲击事件落在词起点 ±2 帧内,允许至多 0.15s 的有意视觉前置。

.claude/skills/short-form-edit/SKILL.md
Target within 2 frames of word onset for captions and … at most 0.15 seconds of deliberate visual anticipation.
注:这里在做什么:把「贴合口播」变成数值约束;子元素揭示要绑到各自的专有名词,而不是 index*0.4 的均匀 stagger,并落盘每镜的锚点词组与时间。

品牌资产必须真实:禁止凭记忆重画/近似/生成他人 logo,取不到可核资产就用纯文字品牌名代替。

.claude/skills/short-form-edit/SKILL.md
Never invent, approximate, trace from memory, or generate an existing brand's logo. … use plain brand-name text rather than fabricate a mark.
注:这里在做什么:把 logo 保真做成可审计项——保存来源 URL/原始文件/校验和,并逐次比对成片里每一处 logo 出现(含小标记与重复元素)。

交付前跑两个本地校验器(plan 结构 + footage 台账),并明确校验器不能认证品味/动效/听感。

.claude/skills/short-form-edit/SKILL.md
It reads `assets/plan.json`, `assets/transcript.json`, and `assets/edit-decisions.json`. … never silently skip checks because the schema differs.
注:这里在做什么:把可机械验证的部分(字幕词数/时间映射/场景对齐/锚点/B-roll 台账与哈希)交给脚本,把不可自动化的部分交给人眼人耳并如实披露复核模态。

音频侧有硬性混音规范:先归一化人声,床底先压到低于人声约 14–20 dB 再按实际轨道调整,最终约 -16 LUFS 且 ≤ -1 dBTP。

.claude/skills/short-form-edit/SKILL.md
start the bed roughly 14-20 dB below voice … adapting to source dynamics rather than crushing them.
注:这里在做什么:把「音乐太吵」这类反馈转成可测量的比例变化要求——必须验证 bed/voice 比例确实下降,而不是只降总电平。

B-roll 分账与复用纪律:每条片同一素材场景只用一次(换裁切/变速/调色不算新场景),并记台账跑校验。

.claude/skills/short-form-edit/SKILL.md
Record source scene identity, file hash, and selected interval in `assets/footage-ledger.json`; run the footage validator below.
注:这里在做什么:防止靠同一段素材换皮充时长;两个画幅共用同段素材是被允许的(预期行为),其余复用都要在台账里被校验器挡下。

2核心能力

01口播素材 → 成片短形重剪全流程(选段、去废稿、EDL、字幕、图形、B-roll、音乐、SFX、交付)
02三稿开头对照 + 低分辨率 animatic 评审(含逐帧检查开场首帧、冲击、揭示与回主剪)
03开环结构化的叙事层(OPEN-LOOPS.json:疑问/植入/提醒/闭合 + 口播证据)
04plan 结构校验器:字幕逐词与转写一致、时间一致、词不跨切点、源映射正确、场景连续且帧对齐、锚点靠近切点、>2.2s 事件空档需理由
05footage 台账校验器:每行需源场景身份 + sha256 + 合法区间,禁止同一素材场景重复与区间重叠,并逐文件重算哈希
06竖屏/横屏双画幅独立验证与手机安全区排版(1080x1920 建议 x=90..930, y=200..1600,右侧与底部留给社交 UI)
07质量门清单化(references/quality-gates.md):从前 3 秒理由到 logo 保真多项,每项要求证据与失败样例
08音频制作:转写对时、床底与人声比例、SFX 事件图(对齐可闻冲击而非文件起点)、-16 LUFS / ≤ -1 dBTP 目标

3外部依赖

类型依赖
cliNode(两个本地校验器)
cliFFmpeg(抽转场条带、抽帧检查编码后的开场与 hero 帧)
api转写服务(默认 ElevenLabs Scribe,备选 Whisper;凭证与服务成本见 docs/TOOLS-AND-API-KEYS.md)
api生成式 B-roll / 图像(可选,Kie.ai 或用户自选提供方,需检查账号与额度)
cliHyperFrames CLI(lint / 实时预览 / draft → final 渲染;capture 卡住时允许确定性图形导出 + FFmpeg 合成)
package兄弟 skill:hyperframes、video-storytelling(构建前必读),以及 edit-video / cut-silences(分工边界)

4风险提醒 风险提醒:橙色 · 评估后使用

风险提醒:橙色 · 评估后使用
  • 源片必须离开本机交给外部转写(默认 ElevenLabs Scribe) — 未发布内容/客户素材可能受保密约束;使用前应确认转写提供方与数据处理条款,或改用可行的本地/文本输入路径。
  • 付费生成路径可消耗额度(Kie.ai B-roll/图像) — SKILL.md 要求先检查账号、额度与集成,但把「是否生成」的判断留给用户环境;自动化场景应设额度与确认环节。
  • 素材内文本可影响生成上下文 — 参考片/产品页面/官方文档抽出的文本会进入故事板与图形上下文;若含指令式文本理论上可干扰产出(本 skill 有真实性条款但没有指令隔离机制)。
  • 门禁依赖人工目视/听感,容易被跳过 — quality-gates.md 多项(Motion/Layout/Entertainment review)要求编码后目视与真实播放复核;纯脚本绿灯不能替代,跳过时风险落在成品质量而非安全面。
  • 一个 skill 裁量面很宽(hook、B-roll、图形、音频全管) — 它明确把长片交给 edit-video、只去停顿交给 cut-silences;越界使用(例如拿它做长片)会失去内置的短形约束。
风险提醒:橙色,评估后使用。skill 自身目录内的代码是纯本地的——scripts/validate-plan.mjs 与 scripts/validate-footage.mjs 只读项目内 JSON、算 sha256、打印结论,既不联网也不读凭证(全目录 token 扫描:无 process.env、无 fetch、无 http/https URL)。触发橙档的是 SKILL.md 自身声明的生产流程:① **用户素材外传**——它指示把源片交给外部转写服务(默认点名 ElevenLabs Scribe、备选 Whisper,并要求读 docs/TOOLS-AND-API-KEYS.md 的凭证与服务成本),音视频内容因此离开本机;② **可选付费生成**——B-roll/图像走 Kie.ai 或用户自选提供方,SKILL.md 要求先检查账号、额度与集成。二者都属「为自身声明用途把用户素材送外部服务/生成后端(含消耗账号额度)」,且都可降级(可用自带素材替代生成、可换提供方)。未发现安全降级(无 TLS 关闭、无 --no-verify)、反自动化绕过或任意代码执行面;其中一处与自动化相关的做法是明确的安全收紧——预览用 headless 浏览器里禁用 Pointer Lock 与 pointer capture。

5第二遍独立确认

  • [ok] 两个自带脚本是否真的不联网、不读凭证(决定档位下限) — validate-plan.mjs 只有 fs/path import 与纯函数导出;validate-footage.mjs 为 fs/path/crypto。全目录 grep 无 process.env、无 fetch/axios、无 http(s):// 调用点(文档中的 URL 仅示例命令与文档引用)。
  • [ok] 转写/生成服务是否真由本 skill 声明(橙档依据) — SKILL.md 原文 'Transcribe with the student's chosen provider; ElevenLabs Scribe is Nate's default.' 与 'Kie.ai is Nate's optional provider for generated moving inserts and images.',两处都要求先看 docs/TOOLS-AND-API-KEYS.md 的凭证与成本。即:外发是**流程指示**,不是随包脚本行为——报告中两者分开陈述。
  • [discrepancy] 「禁用 Pointer Lock/pointer capture」是安全收紧还是绕过防护 — [判定:判定为收紧,不影响档位]SKILL.md 'Browser automation is headless with Pointer Lock and pointer capture disabled in every context.' 出现在「跑 lint 与看实时预览」段,目的是避免无头环境下指针锁抢占;它是关掉被测页面夺权,而非绕过平台自动化侦测(无 AutomationControlled、无真实键击替身、无 remote-allow-origins)。不构成红档特征。
  • [ok] 校验器能否替代「品味/动效/听感」复核 — SKILL.md 明写 'The plan validator catches structural defects but cannot certify taste, motion, or the audio listening pass',并要求另做不看屏的娱乐性复核(ENTERTAINMENT-REVIEW.md)且如实披露缺失的复核模态。脚本与人类判断的分界自洽。
  • [unlocatable] 「前 3 秒」这类判断是否有可核的客观阈值 — 门禁条款要求记录观众收益、未解疑问、第 3 秒可见证据与确切回报场景,但「具体到第几帧算成立」没有客观阈值;quality-gates.md 只给失败样例(如 attention grabbed with no reason to continue)。本次只读侦查无法代作者给出可复现判定,故如实标为无法定位为客观标准。
  • [ok] SKILL.md 指名的仓库级文档是否真的存在(避免文档断链) — docs/TOOLS-AND-API-KEYS.md、MOTION_PHILOSOPHY.md 与 references/{quality-gates,plan-schema,curiosity-and-entertainment,reference-analysis,premium-motion-and-footage}.md 在仓库内均可定位(非虚构引用)。

6结论

  • 把短视频成败点钉在「前 3 秒」并给出可执行检查(三稿对照 + 逐帧检查开场 + 静音可懂)
  • 反夸大纪律罕见地严格:不承诺病毒式结果、不制造留存分数、不把内部对比当 A/B 测试
  • 把可机械验证的部分(字幕-转写逐词一致、源映射、帧对齐、B-roll 台账哈希)真的写成了脚本,不可自动化的部分显式留给人工
  • 授权与发布边界清楚:一次授权覆盖本轮迭代,发布/联系人永远需要明确授权
  • 素材真实性有硬约束:禁止重画/生成他人 logo、禁止把合成人当真实人物、产品证据优先真实来源
  • 音频交付可测:床底低于人声约 14–20 dB、约 -16 LUFS / ≤ -1 dBTP,且要求验证比例下降而非只降总电平
  • 适合:适合有口播素材(talking-head)要出短形成品的人:YouTube Shorts / Reels / 竖屏短广告,需要「选段—去废稿—字幕—图形—B-roll—音乐—SFX—验证」一条龙,并接受脚本校验 + 人工目视/听感双轨验收。也适合想学短视频编辑方法论的读者——SKILL.md 本身是一份带失败样例的编辑规范。
    不适合:不适合:① 长片剪辑(走 edit-video);② 只想去停顿(走 cut-silences);③ 完全离线且不能把素材交给外部转写服务的环境;④ 没有真实素材、只想靠生成拼片的场景(本 skill 反复禁止用生成内容替代实证);⑤ 期望「保证爆款」的用户——文档明确拒绝这类承诺。
    安装 agent 直装可复制
    ① 本站镜像 更新 2026-09-28
    方式 A · 人下载镜像包下载 short-form-edit.tar.gz
    sha256: aeca951228fc9c2b…
    方式 B · JSON 格式安装指南,复制给 agent
    安装指南
    agent 读 JSON 指南后会自动从本站下载安装,无需更多说明。
    ② 上游 GitHub · 原始来源
    能访问 GitHub?直接去上游安装(实时版,可能已更新)GitHub 原始 ↗
    本页镜像锁定 commit 0d30152a82;上游为实时仓库。
    来源信息 GitHub 原始
    作者 / 仓库nateherkai / nateherkai/hyperframes-student-kit
    Stars1070
    最近推送2026-09-28
    本 skill commit0d30152a82
    许可MIT(仓库根 LICENSE = MIT License, Copyright (c) 2026 Nate Herk);另有 licenses/PIPELINE-USE-PERMISSION.txt(教学包再分发授权)与 licenses/HYPERFRAMES-LICENSE(Apache-2.0,随包 HyperFrames skill 的上游许可);GitHub API 因附加许可把仓库标为 NOASSERTION
    本站信息
    收录日期2026-09-06
    分类内容创作
    侦查报告AI 侦查 · 2 遍 · 2026-09-06
    本站镜像与 GitHub 原始是不同来源:本站锁定 commit 快照经 /r2 分发;GitHub 为实时上游,内容可能已更新。
    同分类邻近