1实现原理 · 为什么它能做到
纯 prompt 发布前风险检查 skill:默认输出普通创作者能直接用的自然语言报告,不替用户决定能不能发、也不默认重写全文。
默认输出普通创作者可以直接使用的自然语言报告,不替用户作出发布决定,也不默认重写全文。
核心方法双轨并行:一条查平台机器可能识别什么,一条查内容本身有没有实质问题,两层结论各自独立成立。
1. **平台机器可能识别什么**:广告结构、联系方式、外链、二维码、连续数字、敏感词面、OCR 噪声和重复模式可能触发自动审核;
两层不许互相顶替:机器风险只能写成「可能触发机器审核」,不得补造违规理由;实质问题必须说明独立机制。
机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。
检查面固定五项(文字/完整语义/视觉与声音/发布关系/平台条件),材料不全时先做能做的并标注未覆盖范围。
### 第二步:检查五个表面
机器风险按三级证据强度判:明显触发信号 / 名单型信号 / 弱词面线索,弱线索时保持沉默。
只有弱词面线索时保持沉默。
实质风险分三层输出(高风险/需确认/低置信度线索),且要求「明确对象+明确动作、结果或传播目的」,第二个风险类别需独立证据。
除明确硬红线外,每项风险至少需要「明确对象+明确动作、结果或传播目的」。
最小必要干预原则防止过度修改:强观点、情绪、口语、夸张修辞本身不是风险,无法说明降低什么风险就不给建议。
强观点、情绪化表达、冲突结构、偏激判断、口语、夸张修辞、隐喻和个人偏好本身不构成风险;
严禁编造与绕审:不得编造证据/资质/数据,不得生成谐音、拆字、藏联系方式、评论暗号等规避写法。
也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。
按风险机制分类逐条给判据(内容安全/网络访问/玄学/性暗示/受限推广/广告招聘/导流/宣传价格/医疗/图音账号/协同营销/垃圾内容)。
### 网络访问与海外账号
链接与二维码默认不打开:文案里的链接当审核对象,去向不明的短链/二维码写「去向未检查」。
去向不明的短链或二维码写「去向未检查」,不能自动打开或扫描;
视频三行贴片是条件性输出(不是默认免责声明),只补真实边界且只出文字、不生成图片。
只提供文字,不生成图片,也不调用生图或封面工具。
平台规则层要求时效与来源纪律:只在结论依赖平台政策时查官方规则,记录标题/更新时间/对象/直接链接,不编阈值。
只有结论依赖平台当前政策,或者用户询问准入、报备、处罚、导流、商业入口、直播、AI 标识等时效性问题时,才查询目标平台当前官方规则。
边界声明明确:不提供法律意见、不替代平台预审与专业律师判断;申诉不承诺结果。
不提供法律意见,不替代平台预审、商品资质审核和专业律师判断;
2核心能力
4风险提醒 风险提醒:绿色 · 放心使用
- 结论有时效性,依赖平台规则现状 — 准入、报备、导流、直播、AI 标识等结论依赖目标平台当前政策;skill 要求查官方规则并记录更新时间,但规则变更后旧报告会失真,使用者需自行确认时效。
- 不是法律或合规认证 — 「不提供法律意见,不替代平台预审、商品资质审核和专业律师判断;」漏判风险存在,尤其图片/音轨/账号后台信号等 skill 明确列为检查边界的内容。
- 「需确认」项依赖用户补充信息 — 产品类别、资质、利益关系缺失时只给条件化判断;用户不补,报告就停在待核实状态。
- 宿主检索到的平台规则可能是二手来源 — 正文优先官方来源并把搜索摘要/第三方词库降级为线索,但执行层由宿主的搜索工具决定,无法代码化保证。
- 可被模型隐式触发 — 无 disable-model-invocation / policy 块;用户随口问「这条小红书能不能发」时会被自动切入检查流程。
5第二遍独立确认
- [ok] 纯 prompt、无脚本、零端点 — 目录仅 SKILL.md(20766B) + agents/openai.yaml(416B);危险 token 扫描(含 https?://)ZERO HITS —— 全文不出现任何平台域名/API,仅出现平台名称(闲鱼、淘宝、拼多多等)作为名单型信号示例。
- [ok] 双轨判定与「不得互相顶替」 — 核心原则两条 +「机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。」逐字命中。
- [ok] 五表面与三级证据强度 — 「### 第二步:检查五个表面」表格 5 行、「### 第三步」三级信号、「只有弱词面线索时保持沉默。」均在原文。
- [ok] 反绕审与禁止编造 — 「严禁编造证据、资质、数据、评价、使用经历和活动期限。」与「也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。」逐字命中。
- [ok] 不打开链接/二维码 — 「链接属于待发布文案时,把链接本身作为审核对象,默认不打开网页;」与「去向不明的短链或二维码写「去向未检查」,不能自动打开或扫描;」均在原文。
- [ok] 平台规则查询的触发条件与来源纪律 — 条件句与来源句逐字命中;据此判定「外部网络访问由宿主检索工具在条件触发时执行」,不是 skill 自身端点,故不升档(判级只看 skill 自身目录)。
- [ok] description 与内容相符(无夸大) — description 声称覆盖标题/正文/图片文字/字幕/口播/评论/账号资料/视频画面,对应五表面 + 12 类机制;「需要明确视频语境边界时额外生成三行贴片」对应「## 视频三行贴片」条件节,未出现「保证通过」类越界承诺。
- [ok] 输出层无绝对结论 — 「不写「能发」「不能发」「保证通过」或「100% 合规」。」与「不使用百分比预测违规概率」均在原文。
6结论
fc45138e77038aaa…8b8e33f1ec