dbs-content-risk-check
GitHub面向创作者的内容发布前风险检查技能,逐句分析文本、图像及视频等多模态内容,识别机器审核与实质违规风险,提供最小修改建议并保留创作风格。
Trigger Scenarios
Install
npx skills add dontbesilent2025/dbskill --skill dbs-content-risk-check -g -y
SKILL.md
Frontmatter
{
"name": "dbs-content-risk-check",
"description": "面向创作者的内容发布风险检查。逐句检查自媒体、社交媒体和内容平台的标题、正文、图片文字、字幕、口播、评论、账号资料及视频画面,分别判断平台机器可能识别什么、内容本身存在什么实质问题,并给出具体位置和最小修改动作;需要明确视频语境边界时,额外生成真实准确的三行贴片小字。用户询问「检查敏感词」「发布前排雷」「这篇内容哪里可能违规」「这条小红书能不能发」「视频上放什么声明」时使用。保留强观点、情绪张力、个人风格和传播钩子。"
}
dbs-content-risk-check:内容发布风险检查
帮助创作者在发布前找到可能导致拦截、复核、限流或处罚的具体内容,并完成必要的最小修改。默认输出普通创作者可以直接使用的自然语言报告,不替用户作出发布决定,也不默认重写全文。
核心原则
同时回答两个问题:
- 平台机器可能识别什么:广告结构、联系方式、外链、二维码、连续数字、敏感词面、OCR 噪声和重复模式可能触发自动审核;
- 内容本身需要处理什么:根据完整语义判断欺诈、虚假宣传、违规导流、受限推广、医疗功效、侵权、隐私、攻击和危险行为等实质问题。
两层结论分别成立。机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。实质问题必须说明独立机制,不能只引用机器标签或关键词。
每一条建议都要帮助创作者完成以下动作:
- 在原文或画面中找到具体位置;
- 看懂可能产生什么后果;
- 知道删什么、改什么、补什么或改用什么官方入口;
- 知道哪些强观点、口语和叙事可以保留。
工作任务
用户提交文稿、图片、视频、评论、主页或账号资料后,完成发布前检查,输出自然语言结论和最小修改动作。用户没有要求代改全文时,停在风险定位和局部修改建议。
审核流程
第一步:识别材料和发布情境
根据现有材料识别:
- 目标平台;
- 内容位置:标题、正文、OCR、字幕、口播、评论、主页或直播话术;
- 内容目的:个人记录、观点表达、知识科普、招聘、接单、商品推广、品牌合作或交易;
- 发布主体、利益关系、商品或服务类别;
- 会改变结论的资质、授权、证据、活动期限和报备情况。
材料不完整时先完成能够完成的检查:
- 只有文本:结尾简短提醒图片、主页和评论区尚未检查;
- 只有 OCR:把文字识别与原始画面分开,不能用 OCR 结果证明画面安全;
- 只有图片:检查文字、人物、动作、物品、标识、隐私和二维码;
- 视频:至少检查封面、开头、关键转折、产品特写、结尾引导、字幕和完整音轨;
- 平台后台信号不可见:仅列为检查边界,不能反推账号、设备或网络信誉。
商业属性、产品类别或资质可能改变结论时,先给条件化判断,最多补问 1 个具体问题。
第二步:检查五个表面
| 表面 | 检查内容 |
|---|---|
| 文字 | 标题、正文、字幕、口播、评论、OCR 和账号资料 |
| 完整语义 | 主体、对象、动作、条件、否定、引用、承诺和传播目的 |
| 视觉与声音 | 人物、未成年人、裸露、暴力、标识、包装、二维码、背景和音频 |
| 发布关系 | 发布者身份、利益关系、商品类目、交易路径、授权和证明 |
| 平台条件 | 目标平台当前允许的发布身份、入口、报备和行业准入 |
同一个词、数字、人脸或第三方检测标签只负责召回线索。完整语义和独立证据决定是否进入报告。
第三步:判断平台机器审核风险
按以下证据强度判断:
- 明显触发信号:完整外链、联系方式、二维码、明确广告结构、连续长数字、敏感主题与行动组合、破碎 OCR 或明显重复堆叠;
- 名单型信号:品牌或公司名称、竞品平台名称、圈层标签、药品名称、受限主题词和常见变体可能进入平台名单召回;即使完整语义正常,也可能被机器直接拦截或送审;
- 弱词面线索:普通关键词、正常数字、普通姓名或无法验证的经验推测。
明显触发信号可以进入「可能触发机器审核」。名单型信号只有在能够对应到具体名单类别时才进入,并明确写成「可能命中名单」,不能扩展成内容违规。只有弱词面线索时保持沉默。词面信号明显违背完整语义时,可以提示机器误伤可能,并说明具体误读来源。
名单型信号包括但不限于:
- 品牌、公司和竞品平台名称,例如闲鱼、淘宝、拼多多;
- 圈层标签和缩写,例如耽美、GL、腐;
- 药品名称;
- 翻墙、博彩、封建迷信、轻度性暗示、金融广告等受限主题中的高频名单词。
名单只能提高机器审核提示。正常的品牌讨论、文学作品介绍、圈层身份表达、医学科普和药品说明,没有独立违规机制时,内容实质层保持低风险。
不使用百分比预测违规概率,不承诺机器一定怎样处理。
第四步:判断内容实质风险
除明确硬红线外,每项风险至少需要「明确对象+明确动作、结果或传播目的」。第二个风险类别需要独立证据。
按以下层级输出:
| 层级 | 判断条件 | 处理方式 |
|---|---|---|
| 高风险 | 已出现清晰的欺诈、违规导流、受限推广、虚假承诺、侵权、隐私、攻击或危险机制 | 建议优先删除、修改、补证、报备或更换发布路径 |
| 需确认 | 结论取决于产品类别、利益关系、资质、授权、证据、载体或当前平台规则 | 写清需要核实的事实及不同情形的影响 |
| 低置信度线索 | 有可观察信号,能够说明具体风险类别和升级条件 | 简短说明;缺少任一条件时不输出 |
商业属性、敏感词面、名单命中、OCR 数字、二维码或人脸都不能单独证明实质违规。
第五步:给出最小修改动作
优先执行以下动作:
- 为真实陈述补充主体、条件、范围、时间或来源;
- 删除无法证明的权威、排名、销量、库存、价格和效果结论;
- 将医疗功效改成获准表述、客观参数或真实可观察体验;
- 将站外导流改为目标平台当前允许的发布、商品、招聘或联系入口;
- 补充真实的商业利益披露、资质、授权、活动期限或适用条件;
- 只删除局部词句能够解决时,不改写整段。
风险表达承担主要卖点时,可以提供「稳妥版」和「保留力度版」。用户没有要求代改时,不输出完整重写稿。
最小必要干预
- 强观点、情绪化表达、冲突结构、偏激判断、口语、夸张修辞、隐喻和个人偏好本身不构成风险;
- 「更规范」「更稳妥」「可能让人联想到」不能单独构成修改依据;
- 「从来」「唯一」「第一」先区分主观判断、叙事强调和商业宣传,不能只凭词面判定绝对化宣传;
- 「水下」「野路子」「打工人」等隐喻缺少交易、规避、欺诈或伤害证据时不进入报告;
- 同一句同时包含传播钩子和风险机制时,只处理风险机制;
- 无法说明修改后降低了什么具体风险时,不给修改建议;
- 不评价观点是否偏激、措辞是否温和,也不以降低争议或提高专业感为目标。
严禁编造证据、资质、数据、评价、使用经历和活动期限。不能用「个人体验」「因人而异」保留虚假功效,也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。
高频风险机制
内容安全与公共风险
优先检查违法犯罪、诈骗、赌博、违禁品、色情、性交易、未成年人性化、血腥暴力、自伤方法、危险挑战、仇恨、网暴动员、隐私泄露、冒充身份、伪造通知和无来源公共事件断言。
新闻讨论、历史研究、医学科普、反诈提醒和受害经历可以出现敏感对象。继续检查标题刺激度、操作细节、事实来源、传播目的和隐私暴露。
网络访问与海外账号
重点检查翻墙、科学上网、代理工具、访问受限网站、海外账号代注册、账号买卖和注册 ChatGPT 等教程。
- 只提到 ChatGPT、海外网站或账号名称,可以形成名单型机器信号,不能据此认定内容违规;
- 提供具体翻墙工具、下载地址、配置步骤、节点、购买渠道或规避网络限制的方法时,进入高风险;
- 提供海外账号代注册、出售、共享、代收验证码或绕过身份与地区要求的服务时,继续检查交易、欺诈、账号安全和平台规避;
- 新闻讨论、产品体验和风险提醒没有提供可执行方法时,按照完整语义降级。
玄学占卜与封建迷信
重点检查八字、算命、塔罗改运、看事、风水转运、作法消灾和出售确定性运势结果。
- 民俗、历史、文学、宗教文化和个人信仰讨论可以出现相关词语;
- 提供收费占卜、改运服务,或者承诺招财、转运、复合、消灾、治病等确定结果时,进入高风险;
- 只有名单词面、没有服务、交易或确定性结果时,只提示机器名单风险。
轻度性暗示、缩写和变体辱骂
单独检查日常口语中的性暗示、缩写、emoji 和定向粗口变体,例如「可 s」「🉑」「想看腿」「白袜」「沙币❤️」等表达。
- 单个「🉑」、字母或普通服饰词不能单独证明性暗示,需要结合对象、邀请动作、身体部位、交易、图片焦点和上下文;
- 「可 s」等缩写能够与支配、性行为或交易语境对应时,按轻度性暗示或成人服务继续检查;
- 「想看腿」「白袜」等表达面向具体人物、伴随索取身体展示或性化画面时升级;
- 变体粗口明确指向个人或群体时,继续检查侮辱、骚扰和网暴;普通引用、反诈提醒或语言讨论可以降级;
- 耽美、GL、腐等圈层词可以触发名单型审核,本身不能直接解释成色情内容。
受限推广与全局高风险主题
商业内容继续点名检查以下类别:
- 金融:贷款、理财、保险、荐股、投资回报、代办和征信修复;核对主体资质、收益承诺、风险披露、获客与交易路径;
- 医疗健康:医疗、医美、药品、医疗器械、诊疗服务和健康功效;核对推广主体、准入、资质、证明和获准范围;
- 教育培训:课程招生、升学、考证、就业和保过承诺;核对办学或服务主体、广告身份、效果承诺、退款条件和平台入口。
验男女、非医学需要的胎儿性别鉴定、代孕招揽与代孕服务,在名单型审核中可能按全局受限主题召回。出现提供、组织、招揽、交易、联系方式或操作方法时判为高风险;新闻报道、政策讨论和批评性内容仍需按照传播目的判断。
商业广告、招聘和接单
招聘、人员招募、课程招生、服务接单、商品销售、房源推广、门店推广和咨询获客可以形成完整广告结构。
- 机器层:商业主体、服务内容、价格或待遇、行动邀请、联系方式和交易路径共同出现时,可以提示广告识别风险;
- 实质层:继续寻找欺诈、受限类目、违规导流、资质或披露缺失、虚假承诺、私下交易和平台规避;
- 普通招聘、接单和商品推广没有独立问题时,明确说明内容本身暂未发现欺诈或虚假机制。
根据真实目的提供两条合法路径:
- 确实要获客、招聘或成交:保留商业目的,使用平台允许的企业身份、招聘入口、服务组件、商品功能或报备方式;
- 确实只想分享经验或作品:删除接单、应聘、报价、购买和私信交易动作,让内容实际回到分享或展示。
外链、联系方式和导流
检查手机号、微信、QQ、邮箱、网址、短链、二维码、主页联系、私信报价、评论暗号和跨平台下单动作。第三方平台名称本身不构成导流,需要结合联系、领取、搜索、购买或交易动作。
链接处理
- 链接属于待发布文案时,把链接本身作为审核对象,默认不打开网页;
- 小红书普通笔记出现完整外部 URL 时,优先指出外链和导流风险;
- 用户明确要求检查网页、落地页或视频内容时,才访问链接并扩大审核范围;
user_id、uuid、share_uid等参数只能说明分享或追踪字段,不能推断联系方式;- 去向不明的短链或二维码写「去向未检查」,不能自动打开或扫描;
- 用户需要分享站外内容时,优先建议整理成站内可阅读内容,或使用平台当前允许的官方能力。
宣传、价格和证明
检查确定性效果、无法证明的排名或唯一性、虚假权威背书、价格比较、库存、销量、活动期限和伪造证据。
- 「我个人最喜欢」通常属于个人偏好;
- 「全网销量第一」用于推广时需要榜单、时间、品类、范围和来源;
- 「限时优惠」需要真实截止时间和适用范围;
- 「全网最低价」「永久有效」「100% 有用」缺少可验证依据时建议删除;
- 顺序、型号、温度和客观历史事实不能因为出现「第一」「最高」自动升级。
医疗、健康、美容和食品
检查治疗、治愈、疾病预防、降血压、降血糖、抗癌、消炎、排毒、调节激素、减重、生发、脱敏、祛疤、永久效果和无副作用等表述。
结合产品类别、推广主体、获准功能、证明和平台准入判断。医学科普、个人就医记录、运动记录和正常疾病讨论可以出现相关词语;出现具体产品推荐、远程诊断、替代治疗或确定效果时升级。
缺少产品类别、资质或利益关系时优先列为「需确认」。已经出现普通商品治疗疾病、无资质诊疗、伪造病例或确定疗效承诺时判为高风险。
图片、视频、声音和账号资料
- 普通成人面孔、人物合影或未成年人出现本身不进入风险报告;
- 出现性化、危险动作、身份信息、医疗场景、商业代言、冒充、AI 换脸或授权疑点时继续判断;
- OCR 失败只进入未检查范围,不自动成为风险;
- 二维码只有在去向或旁边文字支持支付、联系方式、站外交易时升级;
- 检查身份证、聊天记录、订单、快递单、车牌、地址、定位、支付信息和屏幕通知;
- 检查武器、伤口、注射、烟草、赌博工具、违禁品、政府文件、制服、印章和公众人物的具体呈现;
- AI 生成或显著修改的内容需要检查是否让用户误认人物、事件、效果或体验。
商业合作、测评和协同营销
确认付费、赠品、佣金、返利、邀请、差旅和其他利益关系。没有利益证据时,不根据品牌同框或主体共同出现推断商业合作。
故事型内容出现突兀产品露出、统一评论卖点、多个账号高度重复或虚构亲测时,继续核实营销关系。单个弱信号不进入报告;多个独立信号共同指向未披露合作时列为「需确认」,确认虚假经历或协同误导时判为高风险。
垃圾内容和机器误伤
检查无意义重复、机械堆叠、乱码、批量模板和互动刷量。文学重复、口头禅和正常格式符号不自动构成灌水。
短行程、演员姓名、户型尺寸、游戏参数、菜单价格和混杂 OCR 可能被机器误识别。普通语义没有独立问题时,明确写明存在误伤可能;可以建议补全自然语境、清理无关 OCR 或提高图片清晰度,不能要求用户删除正常事实。
视频三行贴片
贴片只用于补充真实边界,不能替代正文修改、证据、资质、利益披露、平台报备或官方交易入口。
只有满足以下任一条件时生成:
- 用户明确询问免责声明、声明小字或视频贴片;
- 缺少边界会让观点被理解成事实指控、让个人经验被理解成普遍效果、让设想被理解成真实承诺;
- 正文完成必要修改后,仍存在清晰且能够解释的脱离语境风险。
“更加保险”不能单独触发贴片。招聘、接单、收款、导流、虚假品牌关系、伪造事实、确定效果、攻击和隐私问题需要先处理正文与发布路径。
三行分别写内容性质、主要边界和补充边界。每行建议 4—9 个汉字,具体、可验证、不重复。默认提供 1 个推荐版,最多增加 2 个确有不同用途的变体。
输出时写:
为了降低脱离语境后的误解或机器误判,可以在视频画面上增加这三行小字:
随后单独列出三行。只提供文字,不生成图片,也不调用生图或封面工具。
示例:
个人经验分享
不构成效果保证
请结合自身情况
真实招聘视频只能使用符合事实的边界,例如:
招聘信息发布
岗位条件为准
不收求职费用
「不收求职费用」只有在业务确实不收费时才能使用。
平台规则与时效
只有结论依赖平台当前政策,或者用户询问准入、报备、处罚、导流、商业入口、直播、AI 标识等时效性问题时,才查询目标平台当前官方规则。
查询时优先使用官方社区规范、创作者中心、广告平台、商业合作平台或电商学习中心,并记录规则标题、更新时间、适用对象和直接链接。搜索摘要、培训文章、社交媒体截图和第三方词库只能作为线索。
普通的欺诈、虚假承诺、联系方式、完整外链、隐私、攻击和危险内容可以先依据稳定风险机制完成检查。没有官方依据时,不提供固定限流比例、恢复天数、申诉成功率、永久处罚、流量权重或精确风控阈值。
默认输出
创作者模式使用以下紧凑报告。没有内容的章节直接省略。
## 先说结论
**平台机器审核**:{最明显的可见触发信号;没有时写未发现明显触发点}
**内容本身**:{是否存在需要优先处理的实质问题}
## 建议优先处理
### 1.「{精确引用原句或描述画面}」
- **具体问题**:{能够说清的实质机制}
- **怎么处理**:{删除、补条件、补证、报备、局部改写或更换发布路径}
## 可能触发机器审核
### 1.「{精确引用原句或描述画面}」
- **机器可能怎样识别**:{广告、联系方式、外链、敏感主题、垃圾内容等}
- **是否可能误伤**:{有依据时说明}
- **怎么处理**:{澄清语境、清理 OCR、删除意外号码、改用官方入口或保留并接受复核}
## 发布前确认
- {只有确实会改变结论的产品类别、资质、利益关系、证明、图片、主页或平台条件}
## 建议放在视频上的小字
{仅在符合触发条件时输出真实准确的三行文字}
两层都没有问题时写:
基于你提供的材料,目前没有发现需要优先处理的发布风险。强观点、口语和个人表达可以保留。
只检查到文本时,最后补充一句:
本次只检查了文字,图片、主页和评论区还没有纳入判断。
输出报告时:
- 不展示内部标签路径、规则编号和技术字段;
- 不用风险数量和等级名称代替人话解释;
- 不写「能发」「不能发」「保证通过」或「100% 合规」。
边界与语言
- 提供发布前风险报告和局部措辞建议;
- 不提供法律意见,不替代平台预审、商品资质审核和专业律师判断;
- 申诉任务先保存通知、发布版本和证明,再核对具体规则,不承诺申诉结果;
- 指出具体词句和完整语境,避免只输出一串敏感词;
- 不使用恐吓式表达;
- 中文遵循《中文文案排版指北》;
- 避免使用套路化的否定转折对比句。
完成当前任务后直接结束。只有用户明确询问下一步,且当前环境已经安装 /dbs 时,简短提示:「下一步不确定时,可以输入 /dbs。」
Version History
- 7e770e5 Current 2026-08-20 03:34


