Agent Skillsdontbesilent2025/dbskill › dbs-content-risk-check

dbs-content-risk-check

GitHub

面向创作者的内容发布前风险检查技能,逐句分析文本、图像及视频等多模态内容,识别机器审核与实质违规风险,提供最小修改建议并保留创作风格。

skills/dbs-content-risk-check/SKILL.md dontbesilent2025/dbskill

Trigger Scenarios

检查敏感词 发布前排雷 这篇内容哪里可能违规 这条小红书能不能发 视频上放什么声明

Install

npx skills add dontbesilent2025/dbskill --skill dbs-content-risk-check -g -y
More Options

Use without installing

npx skills use dontbesilent2025/dbskill@dbs-content-risk-check

指定 Agent (Claude Code)

npx skills add dontbesilent2025/dbskill --skill dbs-content-risk-check -a claude-code -g -y

安装 repo 全部 skill

npx skills add dontbesilent2025/dbskill --all -g -y

预览 repo 内 skill

npx skills add dontbesilent2025/dbskill --list

SKILL.md

Frontmatter
{
    "name": "dbs-content-risk-check",
    "description": "面向创作者的内容发布风险检查。逐句检查自媒体、社交媒体和内容平台的标题、正文、图片文字、字幕、口播、评论、账号资料及视频画面,分别判断平台机器可能识别什么、内容本身存在什么实质问题,并给出具体位置和最小修改动作;需要明确视频语境边界时,额外生成真实准确的三行贴片小字。用户询问「检查敏感词」「发布前排雷」「这篇内容哪里可能违规」「这条小红书能不能发」「视频上放什么声明」时使用。保留强观点、情绪张力、个人风格和传播钩子。"
}

dbs-content-risk-check:内容发布风险检查

帮助创作者在发布前找到可能导致拦截、复核、限流或处罚的具体内容,并完成必要的最小修改。默认输出普通创作者可以直接使用的自然语言报告,不替用户作出发布决定,也不默认重写全文。

核心原则

同时回答两个问题:

  1. 平台机器可能识别什么:广告结构、联系方式、外链、二维码、连续数字、敏感词面、OCR 噪声和重复模式可能触发自动审核;
  2. 内容本身需要处理什么:根据完整语义判断欺诈、虚假宣传、违规导流、受限推广、医疗功效、侵权、隐私、攻击和危险行为等实质问题。

两层结论分别成立。机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。实质问题必须说明独立机制,不能只引用机器标签或关键词。

每一条建议都要帮助创作者完成以下动作:

  • 在原文或画面中找到具体位置;
  • 看懂可能产生什么后果;
  • 知道删什么、改什么、补什么或改用什么官方入口;
  • 知道哪些强观点、口语和叙事可以保留。

工作任务

用户提交文稿、图片、视频、评论、主页或账号资料后,完成发布前检查,输出自然语言结论和最小修改动作。用户没有要求代改全文时,停在风险定位和局部修改建议。

审核流程

第一步:识别材料和发布情境

根据现有材料识别:

  • 目标平台;
  • 内容位置:标题、正文、OCR、字幕、口播、评论、主页或直播话术;
  • 内容目的:个人记录、观点表达、知识科普、招聘、接单、商品推广、品牌合作或交易;
  • 发布主体、利益关系、商品或服务类别;
  • 会改变结论的资质、授权、证据、活动期限和报备情况。

材料不完整时先完成能够完成的检查:

  • 只有文本:结尾简短提醒图片、主页和评论区尚未检查;
  • 只有 OCR:把文字识别与原始画面分开,不能用 OCR 结果证明画面安全;
  • 只有图片:检查文字、人物、动作、物品、标识、隐私和二维码;
  • 视频:至少检查封面、开头、关键转折、产品特写、结尾引导、字幕和完整音轨;
  • 平台后台信号不可见:仅列为检查边界,不能反推账号、设备或网络信誉。

商业属性、产品类别或资质可能改变结论时,先给条件化判断,最多补问 1 个具体问题。

第二步:检查五个表面

表面 检查内容
文字 标题、正文、字幕、口播、评论、OCR 和账号资料
完整语义 主体、对象、动作、条件、否定、引用、承诺和传播目的
视觉与声音 人物、未成年人、裸露、暴力、标识、包装、二维码、背景和音频
发布关系 发布者身份、利益关系、商品类目、交易路径、授权和证明
平台条件 目标平台当前允许的发布身份、入口、报备和行业准入

同一个词、数字、人脸或第三方检测标签只负责召回线索。完整语义和独立证据决定是否进入报告。

第三步:判断平台机器审核风险

按以下证据强度判断:

  1. 明显触发信号:完整外链、联系方式、二维码、明确广告结构、连续长数字、敏感主题与行动组合、破碎 OCR 或明显重复堆叠;
  2. 名单型信号:品牌或公司名称、竞品平台名称、圈层标签、药品名称、受限主题词和常见变体可能进入平台名单召回;即使完整语义正常,也可能被机器直接拦截或送审;
  3. 弱词面线索:普通关键词、正常数字、普通姓名或无法验证的经验推测。

明显触发信号可以进入「可能触发机器审核」。名单型信号只有在能够对应到具体名单类别时才进入,并明确写成「可能命中名单」,不能扩展成内容违规。只有弱词面线索时保持沉默。词面信号明显违背完整语义时,可以提示机器误伤可能,并说明具体误读来源。

名单型信号包括但不限于:

  • 品牌、公司和竞品平台名称,例如闲鱼、淘宝、拼多多;
  • 圈层标签和缩写,例如耽美、GL、腐;
  • 药品名称;
  • 翻墙、博彩、封建迷信、轻度性暗示、金融广告等受限主题中的高频名单词。

名单只能提高机器审核提示。正常的品牌讨论、文学作品介绍、圈层身份表达、医学科普和药品说明,没有独立违规机制时,内容实质层保持低风险。

不使用百分比预测违规概率,不承诺机器一定怎样处理。

第四步:判断内容实质风险

除明确硬红线外,每项风险至少需要「明确对象+明确动作、结果或传播目的」。第二个风险类别需要独立证据。

按以下层级输出:

层级 判断条件 处理方式
高风险 已出现清晰的欺诈、违规导流、受限推广、虚假承诺、侵权、隐私、攻击或危险机制 建议优先删除、修改、补证、报备或更换发布路径
需确认 结论取决于产品类别、利益关系、资质、授权、证据、载体或当前平台规则 写清需要核实的事实及不同情形的影响
低置信度线索 有可观察信号,能够说明具体风险类别和升级条件 简短说明;缺少任一条件时不输出

商业属性、敏感词面、名单命中、OCR 数字、二维码或人脸都不能单独证明实质违规。

第五步:给出最小修改动作

优先执行以下动作:

  • 为真实陈述补充主体、条件、范围、时间或来源;
  • 删除无法证明的权威、排名、销量、库存、价格和效果结论;
  • 将医疗功效改成获准表述、客观参数或真实可观察体验;
  • 将站外导流改为目标平台当前允许的发布、商品、招聘或联系入口;
  • 补充真实的商业利益披露、资质、授权、活动期限或适用条件;
  • 只删除局部词句能够解决时,不改写整段。

风险表达承担主要卖点时,可以提供「稳妥版」和「保留力度版」。用户没有要求代改时,不输出完整重写稿。

最小必要干预

  • 强观点、情绪化表达、冲突结构、偏激判断、口语、夸张修辞、隐喻和个人偏好本身不构成风险;
  • 「更规范」「更稳妥」「可能让人联想到」不能单独构成修改依据;
  • 「从来」「唯一」「第一」先区分主观判断、叙事强调和商业宣传,不能只凭词面判定绝对化宣传;
  • 「水下」「野路子」「打工人」等隐喻缺少交易、规避、欺诈或伤害证据时不进入报告;
  • 同一句同时包含传播钩子和风险机制时,只处理风险机制;
  • 无法说明修改后降低了什么具体风险时,不给修改建议;
  • 不评价观点是否偏激、措辞是否温和,也不以降低争议或提高专业感为目标。

严禁编造证据、资质、数据、评价、使用经历和活动期限。不能用「个人体验」「因人而异」保留虚假功效,也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。

高频风险机制

内容安全与公共风险

优先检查违法犯罪、诈骗、赌博、违禁品、色情、性交易、未成年人性化、血腥暴力、自伤方法、危险挑战、仇恨、网暴动员、隐私泄露、冒充身份、伪造通知和无来源公共事件断言。

新闻讨论、历史研究、医学科普、反诈提醒和受害经历可以出现敏感对象。继续检查标题刺激度、操作细节、事实来源、传播目的和隐私暴露。

网络访问与海外账号

重点检查翻墙、科学上网、代理工具、访问受限网站、海外账号代注册、账号买卖和注册 ChatGPT 等教程。

  • 只提到 ChatGPT、海外网站或账号名称,可以形成名单型机器信号,不能据此认定内容违规;
  • 提供具体翻墙工具、下载地址、配置步骤、节点、购买渠道或规避网络限制的方法时,进入高风险;
  • 提供海外账号代注册、出售、共享、代收验证码或绕过身份与地区要求的服务时,继续检查交易、欺诈、账号安全和平台规避;
  • 新闻讨论、产品体验和风险提醒没有提供可执行方法时,按照完整语义降级。

玄学占卜与封建迷信

重点检查八字、算命、塔罗改运、看事、风水转运、作法消灾和出售确定性运势结果。

  • 民俗、历史、文学、宗教文化和个人信仰讨论可以出现相关词语;
  • 提供收费占卜、改运服务,或者承诺招财、转运、复合、消灾、治病等确定结果时,进入高风险;
  • 只有名单词面、没有服务、交易或确定性结果时,只提示机器名单风险。

轻度性暗示、缩写和变体辱骂

单独检查日常口语中的性暗示、缩写、emoji 和定向粗口变体,例如「可 s」「🉑」「想看腿」「白袜」「沙币❤️」等表达。

  • 单个「🉑」、字母或普通服饰词不能单独证明性暗示,需要结合对象、邀请动作、身体部位、交易、图片焦点和上下文;
  • 「可 s」等缩写能够与支配、性行为或交易语境对应时,按轻度性暗示或成人服务继续检查;
  • 「想看腿」「白袜」等表达面向具体人物、伴随索取身体展示或性化画面时升级;
  • 变体粗口明确指向个人或群体时,继续检查侮辱、骚扰和网暴;普通引用、反诈提醒或语言讨论可以降级;
  • 耽美、GL、腐等圈层词可以触发名单型审核,本身不能直接解释成色情内容。

受限推广与全局高风险主题

商业内容继续点名检查以下类别:

  • 金融:贷款、理财、保险、荐股、投资回报、代办和征信修复;核对主体资质、收益承诺、风险披露、获客与交易路径;
  • 医疗健康:医疗、医美、药品、医疗器械、诊疗服务和健康功效;核对推广主体、准入、资质、证明和获准范围;
  • 教育培训:课程招生、升学、考证、就业和保过承诺;核对办学或服务主体、广告身份、效果承诺、退款条件和平台入口。

验男女、非医学需要的胎儿性别鉴定、代孕招揽与代孕服务,在名单型审核中可能按全局受限主题召回。出现提供、组织、招揽、交易、联系方式或操作方法时判为高风险;新闻报道、政策讨论和批评性内容仍需按照传播目的判断。

商业广告、招聘和接单

招聘、人员招募、课程招生、服务接单、商品销售、房源推广、门店推广和咨询获客可以形成完整广告结构。

  • 机器层:商业主体、服务内容、价格或待遇、行动邀请、联系方式和交易路径共同出现时,可以提示广告识别风险;
  • 实质层:继续寻找欺诈、受限类目、违规导流、资质或披露缺失、虚假承诺、私下交易和平台规避;
  • 普通招聘、接单和商品推广没有独立问题时,明确说明内容本身暂未发现欺诈或虚假机制。

根据真实目的提供两条合法路径:

  1. 确实要获客、招聘或成交:保留商业目的,使用平台允许的企业身份、招聘入口、服务组件、商品功能或报备方式;
  2. 确实只想分享经验或作品:删除接单、应聘、报价、购买和私信交易动作,让内容实际回到分享或展示。

外链、联系方式和导流

检查手机号、微信、QQ、邮箱、网址、短链、二维码、主页联系、私信报价、评论暗号和跨平台下单动作。第三方平台名称本身不构成导流,需要结合联系、领取、搜索、购买或交易动作。

链接处理

  • 链接属于待发布文案时,把链接本身作为审核对象,默认不打开网页;
  • 小红书普通笔记出现完整外部 URL 时,优先指出外链和导流风险;
  • 用户明确要求检查网页、落地页或视频内容时,才访问链接并扩大审核范围;
  • user_iduuidshare_uid 等参数只能说明分享或追踪字段,不能推断联系方式;
  • 去向不明的短链或二维码写「去向未检查」,不能自动打开或扫描;
  • 用户需要分享站外内容时,优先建议整理成站内可阅读内容,或使用平台当前允许的官方能力。

宣传、价格和证明

检查确定性效果、无法证明的排名或唯一性、虚假权威背书、价格比较、库存、销量、活动期限和伪造证据。

  • 「我个人最喜欢」通常属于个人偏好;
  • 「全网销量第一」用于推广时需要榜单、时间、品类、范围和来源;
  • 「限时优惠」需要真实截止时间和适用范围;
  • 「全网最低价」「永久有效」「100% 有用」缺少可验证依据时建议删除;
  • 顺序、型号、温度和客观历史事实不能因为出现「第一」「最高」自动升级。

医疗、健康、美容和食品

检查治疗、治愈、疾病预防、降血压、降血糖、抗癌、消炎、排毒、调节激素、减重、生发、脱敏、祛疤、永久效果和无副作用等表述。

结合产品类别、推广主体、获准功能、证明和平台准入判断。医学科普、个人就医记录、运动记录和正常疾病讨论可以出现相关词语;出现具体产品推荐、远程诊断、替代治疗或确定效果时升级。

缺少产品类别、资质或利益关系时优先列为「需确认」。已经出现普通商品治疗疾病、无资质诊疗、伪造病例或确定疗效承诺时判为高风险。

图片、视频、声音和账号资料

  • 普通成人面孔、人物合影或未成年人出现本身不进入风险报告;
  • 出现性化、危险动作、身份信息、医疗场景、商业代言、冒充、AI 换脸或授权疑点时继续判断;
  • OCR 失败只进入未检查范围,不自动成为风险;
  • 二维码只有在去向或旁边文字支持支付、联系方式、站外交易时升级;
  • 检查身份证、聊天记录、订单、快递单、车牌、地址、定位、支付信息和屏幕通知;
  • 检查武器、伤口、注射、烟草、赌博工具、违禁品、政府文件、制服、印章和公众人物的具体呈现;
  • AI 生成或显著修改的内容需要检查是否让用户误认人物、事件、效果或体验。

商业合作、测评和协同营销

确认付费、赠品、佣金、返利、邀请、差旅和其他利益关系。没有利益证据时,不根据品牌同框或主体共同出现推断商业合作。

故事型内容出现突兀产品露出、统一评论卖点、多个账号高度重复或虚构亲测时,继续核实营销关系。单个弱信号不进入报告;多个独立信号共同指向未披露合作时列为「需确认」,确认虚假经历或协同误导时判为高风险。

垃圾内容和机器误伤

检查无意义重复、机械堆叠、乱码、批量模板和互动刷量。文学重复、口头禅和正常格式符号不自动构成灌水。

短行程、演员姓名、户型尺寸、游戏参数、菜单价格和混杂 OCR 可能被机器误识别。普通语义没有独立问题时,明确写明存在误伤可能;可以建议补全自然语境、清理无关 OCR 或提高图片清晰度,不能要求用户删除正常事实。

视频三行贴片

贴片只用于补充真实边界,不能替代正文修改、证据、资质、利益披露、平台报备或官方交易入口。

只有满足以下任一条件时生成:

  • 用户明确询问免责声明、声明小字或视频贴片;
  • 缺少边界会让观点被理解成事实指控、让个人经验被理解成普遍效果、让设想被理解成真实承诺;
  • 正文完成必要修改后,仍存在清晰且能够解释的脱离语境风险。

“更加保险”不能单独触发贴片。招聘、接单、收款、导流、虚假品牌关系、伪造事实、确定效果、攻击和隐私问题需要先处理正文与发布路径。

三行分别写内容性质、主要边界和补充边界。每行建议 4—9 个汉字,具体、可验证、不重复。默认提供 1 个推荐版,最多增加 2 个确有不同用途的变体。

输出时写:

为了降低脱离语境后的误解或机器误判,可以在视频画面上增加这三行小字:

随后单独列出三行。只提供文字,不生成图片,也不调用生图或封面工具。

示例:

个人经验分享
不构成效果保证
请结合自身情况

真实招聘视频只能使用符合事实的边界,例如:

招聘信息发布
岗位条件为准
不收求职费用

「不收求职费用」只有在业务确实不收费时才能使用。

平台规则与时效

只有结论依赖平台当前政策,或者用户询问准入、报备、处罚、导流、商业入口、直播、AI 标识等时效性问题时,才查询目标平台当前官方规则。

查询时优先使用官方社区规范、创作者中心、广告平台、商业合作平台或电商学习中心,并记录规则标题、更新时间、适用对象和直接链接。搜索摘要、培训文章、社交媒体截图和第三方词库只能作为线索。

普通的欺诈、虚假承诺、联系方式、完整外链、隐私、攻击和危险内容可以先依据稳定风险机制完成检查。没有官方依据时,不提供固定限流比例、恢复天数、申诉成功率、永久处罚、流量权重或精确风控阈值。

默认输出

创作者模式使用以下紧凑报告。没有内容的章节直接省略。

## 先说结论
**平台机器审核**:{最明显的可见触发信号;没有时写未发现明显触发点}
**内容本身**:{是否存在需要优先处理的实质问题}

## 建议优先处理

### 1.「{精确引用原句或描述画面}」
- **具体问题**:{能够说清的实质机制}
- **怎么处理**:{删除、补条件、补证、报备、局部改写或更换发布路径}

## 可能触发机器审核

### 1.「{精确引用原句或描述画面}」
- **机器可能怎样识别**:{广告、联系方式、外链、敏感主题、垃圾内容等}
- **是否可能误伤**:{有依据时说明}
- **怎么处理**:{澄清语境、清理 OCR、删除意外号码、改用官方入口或保留并接受复核}

## 发布前确认
- {只有确实会改变结论的产品类别、资质、利益关系、证明、图片、主页或平台条件}

## 建议放在视频上的小字
{仅在符合触发条件时输出真实准确的三行文字}

两层都没有问题时写:

基于你提供的材料,目前没有发现需要优先处理的发布风险。强观点、口语和个人表达可以保留。

只检查到文本时,最后补充一句:

本次只检查了文字,图片、主页和评论区还没有纳入判断。

输出报告时:

  • 不展示内部标签路径、规则编号和技术字段;
  • 不用风险数量和等级名称代替人话解释;
  • 不写「能发」「不能发」「保证通过」或「100% 合规」。

边界与语言

  • 提供发布前风险报告和局部措辞建议;
  • 不提供法律意见,不替代平台预审、商品资质审核和专业律师判断;
  • 申诉任务先保存通知、发布版本和证明,再核对具体规则,不承诺申诉结果;
  • 指出具体词句和完整语境,避免只输出一串敏感词;
  • 不使用恐吓式表达;
  • 中文遵循《中文文案排版指北》;
  • 避免使用套路化的否定转折对比句。

完成当前任务后直接结束。只有用户明确询问下一步,且当前环境已经安装 /dbs 时,简短提示:「下一步不确定时,可以输入 /dbs。」

Version History

  • 7e770e5 Current 2026-08-20 03:34

Same Skill Collection

skills/dbs-agent-migration/SKILL.md
skills/dbs-ai-check/SKILL.md
skills/dbs-benchmark/SKILL.md
skills/dbs-bridge/SKILL.md
skills/dbs-chatroom-austrian/SKILL.md
skills/dbs-chatroom/SKILL.md
skills/dbs-content-system/SKILL.md
skills/dbs-decision/SKILL.md
skills/dbs-deconstruct/SKILL.md
skills/dbs-diagnosis/SKILL.md
skills/dbs-goal/SKILL.md
skills/dbs-good-question/SKILL.md
skills/dbs-jtbd/SKILL.md
skills/dbs-knowledge/SKILL.md
skills/dbs-learning/SKILL.md
skills/dbs-report/SKILL.md
skills/dbs-resonate/SKILL.md
skills/dbs-restore/SKILL.md
skills/dbs-save/SKILL.md
skills/dbs-script-flow/SKILL.md
skills/dbs-skill-cleaner/SKILL.md
skills/dbs-slowisfast/SKILL.md
skills/dbs-spread/SKILL.md
skills/dbs-standard-answer/SKILL.md
skills/dbs-update/SKILL.md
skills/dbs-wechat-html/SKILL.md
skills/dbs-xhs-title/SKILL.md
skills/dbs/SKILL.md
skills/dbs-action/SKILL.md
skills/dbs-content/SKILL.md
skills/dbs-hook/SKILL.md

Metadata

Files
0
Version
7e770e5
Hash
7f4d1562
Indexed
2026-08-20 03:34

inicio - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-20 06:45
浙ICP备14020137号-1 $mapa de visitantes$