全部技能 / 内容创作 / dbs-content-risk-check
内容创作 · dontbesilent2025/dbskill

dbs-content-risk-check

面向创作者的内容发布风险检查。逐句检查自媒体、社交媒体和内容平台的标题、正文、图片文字、字幕、口播、评论、账号资料及视频画面,分别判断平台机器可能识别什么、内容本身存在什么实质问题,并给出具体位置和最小修改动作;需要明确视频语境边界时,额外生成真实准确的三行贴片小字。用户询问「检查敏感词」「发布前排雷」「这篇内容哪里可能违规」「这条小红书能不能发」「视频上放什么声明」时使用。保留强观点、情绪张力、个人风格和传播钩子。

风险提醒:绿色 · 放心使用AI 侦查报告
作者 dontbesilent2025GitHub dontbesilent2025/dbskill ↗Stars 10121许可 CC BY-NC 4.0(Attribution-NonCommercial 4.0 International;仓库根 LICENSE 明文 NonCommercial — 非商业授权,不得商用;GitHub API license=NOASSERTION/Other,因 CC BY-NC 不在 SPDX 常见许可标识内;Copyright (c) 2026 dontbesilent)commit 8b8e33f1ec
agent 宿主通常会约束 skill 执行权限;风险提醒为 AI 侦查观点,不构成质量或安全保证。第三方 skill 仅作拆解与展示,安装使用风险自负,版权归原作者。

1实现原理 · 为什么它能做到

纯 prompt 发布前风险检查 skill:默认输出普通创作者能直接用的自然语言报告,不替用户决定能不能发、也不默认重写全文。

skills/dbs-content-risk-check/SKILL.md
默认输出普通创作者可以直接使用的自然语言报告,不替用户作出发布决定,也不默认重写全文。
注:定位是「发布前体检 + 最小修改」,而不是代写或代发。

核心方法双轨并行:一条查平台机器可能识别什么,一条查内容本身有没有实质问题,两层结论各自独立成立。

skills/dbs-content-risk-check/SKILL.md
1. **平台机器可能识别什么**:广告结构、联系方式、外链、二维码、连续数字、敏感词面、OCR 噪声和重复模式可能触发自动审核;
注:第二条轨道是「根据完整语义判断欺诈、虚假宣传、违规导流、受限推广、医疗功效、侵权、隐私、攻击和危险行为等实质问题」。

两层不许互相顶替:机器风险只能写成「可能触发机器审核」,不得补造违规理由;实质问题必须说明独立机制。

skills/dbs-content-risk-check/SKILL.md
机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。
注:这是防模型「用敏感词编造违规」的关键约束,也是它区别于词库式检测工具的地方。

检查面固定五项(文字/完整语义/视觉与声音/发布关系/平台条件),材料不全时先做能做的并标注未覆盖范围。

skills/dbs-content-risk-check/SKILL.md
### 第二步:检查五个表面
注:材料不完整时正文规定:只有文本则结尾提醒图片/主页/评论区未检查;只有 OCR 不能证明画面安全;「本次只检查了文字,图片、主页和评论区还没有纳入判断。」

机器风险按三级证据强度判:明显触发信号 / 名单型信号 / 弱词面线索,弱线索时保持沉默。

skills/dbs-content-risk-check/SKILL.md
只有弱词面线索时保持沉默。
注:名单型信号(品牌、竞品平台、圈层缩写、药品名等)只写成「可能命中名单」,不扩展成内容违规。

实质风险分三层输出(高风险/需确认/低置信度线索),且要求「明确对象+明确动作、结果或传播目的」,第二个风险类别需独立证据。

skills/dbs-content-risk-check/SKILL.md
除明确硬红线外,每项风险至少需要「明确对象+明确动作、结果或传播目的」。
注:高风险行的处理方式是「建议优先删除、修改、补证、报备或更换发布路径」。

最小必要干预原则防止过度修改:强观点、情绪、口语、夸张修辞本身不是风险,无法说明降低什么风险就不给建议。

skills/dbs-content-risk-check/SKILL.md
强观点、情绪化表达、冲突结构、偏激判断、口语、夸张修辞、隐喻和个人偏好本身不构成风险;
注:配套「无法说明修改后降低了什么具体风险时,不给修改建议」与「只删除局部词句能够解决时,不改写整段」。

严禁编造与绕审:不得编造证据/资质/数据,不得生成谐音、拆字、藏联系方式、评论暗号等规避写法。

skills/dbs-content-risk-check/SKILL.md
也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。
注:这条同时定义了能力边界(不做规避审核的助手),是本 skill 最明确的安全自约束。

按风险机制分类逐条给判据(内容安全/网络访问/玄学/性暗示/受限推广/广告招聘/导流/宣传价格/医疗/图音账号/协同营销/垃圾内容)。

skills/dbs-content-risk-check/SKILL.md
### 网络访问与海外账号
注:例:只提到 ChatGPT/海外账号=名单型机器信号;「提供具体翻墙工具、下载地址、配置步骤、节点、购买渠道或规避网络限制的方法时,进入高风险」。

链接与二维码默认不打开:文案里的链接当审核对象,去向不明的短链/二维码写「去向未检查」。

skills/dbs-content-risk-check/SKILL.md
去向不明的短链或二维码写「去向未检查」,不能自动打开或扫描;
注:仅在用户明确要求检查网页/落地页/视频时才访问链接并扩大审核范围。

视频三行贴片是条件性输出(不是默认免责声明),只补真实边界且只出文字、不生成图片。

skills/dbs-content-risk-check/SKILL.md
只提供文字,不生成图片,也不调用生图或封面工具。
注:输出示例包括「个人经验分享 / 不构成效果保证 / 请结合自身情况」,且规定「「不收求职费用」只有在业务确实不收费时才能使用。」

平台规则层要求时效与来源纪律:只在结论依赖平台政策时查官方规则,记录标题/更新时间/对象/直接链接,不编阈值。

skills/dbs-content-risk-check/SKILL.md
只有结论依赖平台当前政策,或者用户询问准入、报备、处罚、导流、商业入口、直播、AI 标识等时效性问题时,才查询目标平台当前官方规则。
注:配套「不使用百分比预测违规概率,不承诺机器一定怎样处理」与「不写「能发」「不能发」「保证通过」或「100% 合规」」。

边界声明明确:不提供法律意见、不替代平台预审与专业律师判断;申诉不承诺结果。

skills/dbs-content-risk-check/SKILL.md
不提供法律意见,不替代平台预审、商品资质审核和专业律师判断;
注:这是内容合规类 skill 的必要免责,也决定了它适合什么场景(自查而非合规认证)。

2核心能力

01双轨判定:机器审核风险 vs 内容实质风险(分别出结论)
02五表面检查(文字/语义/视音/发布关系/平台条件)
03机器风险三级证据强度判断(明显触发/名单型/弱线索)
04实质风险分层(高风险/需确认/低置信度线索)与硬红线清单
05最小修改动作库(补条件/删无证结论/改获准表述/换官方入口/补披露/局部删改)
06风险机制分类检查(12 类,含各行业受限推广判据)
07视频三行贴片(条件触发,仅文字)
08固定紧凑报告模板 + 无问题时的结论文案

4风险提醒 风险提醒:绿色 · 放心使用

风险提醒:绿色 · 放心使用
  • 结论有时效性,依赖平台规则现状 — 准入、报备、导流、直播、AI 标识等结论依赖目标平台当前政策;skill 要求查官方规则并记录更新时间,但规则变更后旧报告会失真,使用者需自行确认时效。
  • 不是法律或合规认证 — 「不提供法律意见,不替代平台预审、商品资质审核和专业律师判断;」漏判风险存在,尤其图片/音轨/账号后台信号等 skill 明确列为检查边界的内容。
  • 「需确认」项依赖用户补充信息 — 产品类别、资质、利益关系缺失时只给条件化判断;用户不补,报告就停在待核实状态。
  • 宿主检索到的平台规则可能是二手来源 — 正文优先官方来源并把搜索摘要/第三方词库降级为线索,但执行层由宿主的搜索工具决定,无法代码化保证。
  • 可被模型隐式触发 — 无 disable-model-invocation / policy 块;用户随口问「这条小红书能不能发」时会被自动切入检查流程。
风险提醒:绿色,放心使用。判级对象为 skill 自身目录(dbs-content-risk-check/SKILL.md + agents/openai.yaml):零脚本、零网络端点、零凭证读取、零写盘(危险 token 扫描 ZERO HITS),行为全部发生在模型输出侧。注意点为结论时效性(依赖平台规则)与漏判风险;平台规则查询由宿主检索工具在条件触发时执行,skill 自身零端点,故按「判级只看 skill 自身目录」口径维持绿色。 宿主工具与外部平台行为不作为档位依据。

5第二遍独立确认

  • [ok] 纯 prompt、无脚本、零端点 — 目录仅 SKILL.md(20766B) + agents/openai.yaml(416B);危险 token 扫描(含 https?://)ZERO HITS —— 全文不出现任何平台域名/API,仅出现平台名称(闲鱼、淘宝、拼多多等)作为名单型信号示例。
  • [ok] 双轨判定与「不得互相顶替」 — 核心原则两条 +「机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。」逐字命中。
  • [ok] 五表面与三级证据强度 — 「### 第二步:检查五个表面」表格 5 行、「### 第三步」三级信号、「只有弱词面线索时保持沉默。」均在原文。
  • [ok] 反绕审与禁止编造 — 「严禁编造证据、资质、数据、评价、使用经历和活动期限。」与「也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。」逐字命中。
  • [ok] 不打开链接/二维码 — 「链接属于待发布文案时,把链接本身作为审核对象,默认不打开网页;」与「去向不明的短链或二维码写「去向未检查」,不能自动打开或扫描;」均在原文。
  • [ok] 平台规则查询的触发条件与来源纪律 — 条件句与来源句逐字命中;据此判定「外部网络访问由宿主检索工具在条件触发时执行」,不是 skill 自身端点,故不升档(判级只看 skill 自身目录)。
  • [ok] description 与内容相符(无夸大) — description 声称覆盖标题/正文/图片文字/字幕/口播/评论/账号资料/视频画面,对应五表面 + 12 类机制;「需要明确视频语境边界时额外生成三行贴片」对应「## 视频三行贴片」条件节,未出现「保证通过」类越界承诺。
  • [ok] 输出层无绝对结论 — 「不写「能发」「不能发」「保证通过」或「100% 合规」。」与「不使用百分比预测违规概率」均在原文。

6结论

  • 双轨判定避免「用词库判违规」:机器信号与实质问题分开,且禁止互相充当理由。
  • 最小必要干预:必须说明修改降低了什么具体风险,保护强观点与传播钩子。
  • 明确拒绝做绕审助手:禁止谐音、拆字、暗号等规避写法。
  • 不确定就说不确定:分层输出 + 不承诺、不百分比、不写「保证通过」。
  • 接触面克制:默认不打开链接/不扫二维码,去向不明则标注「去向未检查」。
  • 适合:适合发布前自查:短视频/小红书/公众号内容、评论与主页资料、带货接单文案;尤其适合「怕被限流又不想把锋利观点磨平」的创作者——它会给具体位置、可能后果、最小改动,并明确哪些内容可以保留;需要视频语境边界时给出真实可用的三行贴片小字。
    不适合:不适合当作合规认证或法律意见(正文自我限定不替代平台预审/律师);不适合期望「代改全文」「给敏感词清单」的需求——默认只做风险定位与局部建议,且不给敏感词库;不适合需要平台后台风控数据、限流比例、申诉成功率等内部信息的场景(明确不给这类阈值);也不适合要求生成规避审核写法(谐音/暗号等)的场景——本 skill 明确拒绝。
    安装 agent 直装可复制
    ① 本站镜像 更新 2026-09-15
    方式 A · 人下载镜像包下载 dbs-content-risk-check.tar.gz
    sha256: fc45138e77038aaa…
    方式 B · JSON 格式安装指南,复制给 agent
    安装指南
    agent 读 JSON 指南后会自动从本站下载安装,无需更多说明。
    ② 上游 GitHub · 原始来源
    能访问 GitHub?直接去上游安装(实时版,可能已更新)GitHub 原始 ↗
    本页镜像锁定 commit 8b8e33f1ec;上游为实时仓库。
    来源信息 GitHub 原始
    作者 / 仓库dontbesilent2025 / dontbesilent2025/dbskill
    Stars10121
    最近推送2026-09-07
    本 skill commit8b8e33f1ec
    许可CC BY-NC 4.0(Attribution-NonCommercial 4.0 International;仓库根 LICENSE 明文 NonCommercial — 非商业授权,不得商用;GitHub API license=NOASSERTION/Other,因 CC BY-NC 不在 SPDX 常见许可标识内;Copyright (c) 2026 dontbesilent)
    本站信息
    收录日期2026-09-06
    分类内容创作
    侦查报告AI 侦查 · 2 遍 · 2026-09-06
    本站镜像与 GitHub 原始是不同来源:本站锁定 commit 快照经 /r2 分发;GitHub 为实时上游,内容可能已更新。
    同分类邻近