skill-risk-scanner
GitHub基于LLM分析文案原创度与素材版权风险,识别洗稿、侵权及引用不规范问题。适用于查重、原创检测、版权风险评估场景,输出定性风险报告与改进建议。
Trigger Scenarios
Install
npx skills add ZJU-REAL/Easel --skill skill-risk-scanner -g -y
SKILL.md
Frontmatter
{
"name": "skill-risk-scanner",
"layer": "publish",
"description": "内容原创度与版权风险评估:分析文案是否存在洗稿\/搬运嫌疑,评估素材版权风险, 检查引用规范。基于 LLM 文本分析,不包含技术查重。 当用户说\"查重\"、\"原创度\"、\"是不是抄的\"、\"版权风险\"、\"能不能用这张图\"、 \"音乐版权\"、\"原创检测\"、\"有没有侵权\"、\"素材版权\"、\"会不会被投诉\"时触发。 和 skill-quality-gate 的区别:quality-gate 查敏感词和平台规则合规, risk-scanner 专注原创度和版权侵权风险。"
}
内容原创度与版权风险评估
基于 LLM 文本分析能力,评估内容的原创度风险和素材版权风险,输出定性风险报告与改进建议。
能力边界声明
本 SKILL 基于 LLM 文本分析,不包含以下技术能力:
- 不做技术查重 — 无法计算余弦相似度或精确重复率,需要 Copyleaks / Originality.ai 等外部 API
- 不输出相似度分数 — 所有风险判断均为定性等级(低/中/高),不伪造百分比或小数
- 不做图片内容识别 — 无法读取 EXIF、检测水印、识别图片来源;图片风险评估基于用户提供的来源描述
- 不做音频指纹匹配 — 无法识别 BGM 曲目,基于用户标注的音乐来源进行风险判断
与其他 SKILL 的区别
| SKILL | 定位 | 检查焦点 |
|---|---|---|
| risk-scanner(本 SKILL) | 原创度 + 版权风险 | 洗稿模式识别、素材版权风险、引用合规 |
| skill-quality-gate | 平台合规 + 内容质量 | 敏感词、平台规则、广告法、绝对化用语、医疗违规 |
| skill-publish-checklist | 完整性检查 | 有没有漏标题、漏封面 |
输入
| 参数 | 必填 | 说明 |
|---|---|---|
| 待检查文案 | 是 | 文案正文、脚本、长文原稿 |
| 素材来源说明 | 否 | 用户描述图片/音频/视频的来源(如"图片来自 Unsplash"、"BGM 用的抖音自带音乐") |
| 参考来源文本 | 否 | 原始参考文章的文本或 URL,用于对比改写充分度 |
| 目标平台 | 否 | 发布平台名称,用于匹配平台版权规则 |
输出
Markdown 格式的风险评估报告,结构如下:
# 风险评估报告
## 整体风险等级:🟢 低风险 / 🟡 中风险 / 🔴 高风险
## 一、文本原创度评估
### 洗稿模式扫描
- [扫描结果与具体发现]
### 内容独特性判断
- [是否包含个人经验/独家数据/原创观点]
### 引用规范检查
- [引用是否标注来源、数据是否注明出处]
## 二、素材版权风险(仅在用户提供素材来源描述时输出)
### 图片素材
- [基于用户描述的来源判断]
### 音频/BGM
- [基于用户描述的来源判断]
## 三、品牌与商标风险
- [文案中提及的品牌名/商标的使用风险]
## 四、风险清单
### 必须处理(阻塞发布)
- [高风险项]
### 建议处理(不阻塞但有隐患)
- [中风险项]
## 五、改进建议
- [针对每个风险项的具体操作建议]
风险等级定义:
- 低风险 — 内容有明显原创成分,引用规范,素材来源清晰
- 中风险 — 存在部分洗稿嫌疑或素材来源不明,建议修改后发布
- 高风险 — 有明显搬运/抄袭模式或版权侵权风险,不建议直接发布
执行步骤
Step 1 — 确认输入与检查范围
- 读取用户提供的待检查文案
- 确认是否提供了素材来源说明(图片、音频、视频的来源描述)
- 确认是否提供了参考来源文本(用于对比改写充分度)
- 确认目标平台(用于匹配平台特有版权规则)
- 未提供素材来源说明时,跳过素材版权评估模块,在报告中注明"用户未提供素材来源信息,无法评估素材版权风险"
Step 2 — 文本洗稿模式扫描
逐段扫描文案,按 references/washing-patterns.md「一、洗稿模式识别」识别机械性同义替换、句式变换但论点复刻、段落搬运重排三类特征。对发现的每个特征引用具体段落文本并说明理由;未发现时明确说明"未检测到明显洗稿模式"。
Step 3 — 内容独特性评估
按 references/washing-patterns.md「二、内容独特性评估」判断文案是否包含个人经验、独家数据、原创观点、具体细节,并据此给出原创度较高/一般/低的结论。
Step 4 — 引用规范检查
按 references/washing-patterns.md「三、引用规范检查」核对观点引用、数据引用、截图引用的来源标注;若用户提供了参考来源文本,对比本文与来源的转述充分度(是否只换词不换意、是否加入自己的分析、是否改变结构和论证逻辑)。
Step 5 — 素材版权风险评估(基于用户描述)
仅在用户提供素材来源描述时执行此步骤。
根据用户描述的素材来源,参照 references/copyright-guide.md「七、素材来源风险速查表」(图片 7.1 / 音频 BGM 7.2)判断风险等级,并对高风险素材推荐 references/copyright-guide.md 中的免费图库和音乐库替代来源。
Step 6 — 品牌与商标风险扫描
扫描文案中出现的品牌名、商标、产品名:
- 竞品品牌提及 — 在推广内容中贬低竞品构成不正当竞争风险
- 未授权使用品牌名 — 在标题/封面中突出使用他人品牌名可能构成商标侵权
- 虚假关联暗示 — "XX 品牌推荐/XX 品牌同款"等未经授权的关联表述
- 列出所有检测到的品牌名及其使用上下文,给出风险判断
Step 7 — 汇总风险报告
- 汇总 Step 2-6 的所有发现
- 确定整体风险等级(取所有维度中的最高风险等级)
- 区分"必须处理"和"建议处理"两类风险:
- 必须处理:明显洗稿段落、高风险素材来源、未授权品牌使用
- 建议处理:缺少引用标注、原创成分偏少、AI 生成标注缺失
- 对每个风险项给出具体改进建议:
- 洗稿段落 → 指出具体段落并给出改写方向(补充个人经验、换论证角度)
- 来源不明素材 → 推荐具体的免费替代来源
- 引用缺失 → 指出应补充引用的具体位置
- 输出完整 Markdown 格式风险报告
Profile 感知
有 Profile 时:
- 读取
platform字段,启用该平台的版权规则(参照references/copyright-guide.md):- 小红书:AI 生成内容标注要求、图片搬运检测机制
- 抖音:BGM 版权限制、原声使用规范
- B站:转载标注规范、素材引用要求
- 公众号:原创声明规则、白名单转载机制
- 读取
positioning字段,评估内容与账号定位的一致性(定位偏移本身不是版权风险,但在报告中提示) - 读取历史内容风格,判断本次内容是否与以往风格一致(风格突变可能暗示搬运)
无 Profile 时:
- 做通用原创度和版权检查,不做平台特化
- 在报告末尾附注:"如提供账号 Profile(含平台信息),可启用平台特有版权规则检查"
规则
- 不伪造量化指标 — 禁止输出相似度百分比、原创度分数、匹配率等数值,所有判断用定性等级表达
- 不声称技术查重能力 — 报告中不得暗示已进行数据库比对、向量检索或指纹匹配
- 素材评估必须基于用户描述 — 用户未描述素材来源时,不猜测,明确标注"来源未提供,无法评估"
- 发现必须引用原文 — 标记洗稿嫌疑时,必须引用具体文本段落,不做笼统判断
- 建议必须可操作 — 每条改进建议必须告诉用户具体做什么(改哪段、换什么素材、补什么引用)
- 诚实标注局限 — 报告末尾附注"本评估基于 LLM 文本分析,如需精确查重请使用 Copyleaks、Originality.ai 等专业工具"
- 禁止使用破折号(em dash)
Version History
- 69c5928 Current 2026-09-08 17:39


