Agent SkillsZJU-REAL/Easel › video-to-article

video-to-article

GitHub

将视频转录为结构化图文(小红书/公众号等),自动抽帧配图。核心在于由LLM进行内容改写与提炼,而非简单照搬,实现视频内容的多平台复用。

skills/openclaw/video-to-article/SKILL.md ZJU-REAL/Easel

Trigger Scenarios

视频转图文 视频扒文案 口播转文章 视频内容复用

Install

npx skills add ZJU-REAL/Easel --skill video-to-article -g -y
More Options

Non-standard path

npx skills add https://github.com/ZJU-REAL/Easel/tree/main/skills/openclaw/video-to-article -g -y

Use without installing

npx skills use ZJU-REAL/Easel@video-to-article

指定 Agent (Claude Code)

npx skills add ZJU-REAL/Easel --skill video-to-article -a claude-code -g -y

安装 repo 全部 skill

npx skills add ZJU-REAL/Easel --all -g -y

预览 repo 内 skill

npx skills add ZJU-REAL/Easel --list

SKILL.md

Frontmatter
{
    "name": "video-to-article",
    "layer": "produce",
    "description": "把口播、讲座、直播或 Vlog 转录并改写成小红书笔记、公众号文章或知乎内容,同时抽帧配图。当用户说“视频转图文\/文章\/笔记、视频扒文案、口播转文章、视频内容复用”时使用。只生成字幕文件用 auto-subtitle;翻译已有字幕用 subtitle-translate。"
}

视频转图文(视频 → 笔记/文章)

把视频复用成图文内容:转录 → 结构化成篇 → 抽帧配图。转录与抽帧走确定性脚本 (asr.py / video_ops.py),结构化成文由你(LLM)完成——这是本 SKILL 的核心价值。

只出字幕文件见 auto-subtitle;翻译字幕见 subtitle-translate; 出成套小红书卡片见 xhs-note-creator;纯文案润色见 text-polisher

输入

字段 必填 说明
视频文件 口播/讲座/直播/Vlog(没给就问)
目标形态 小红书笔记(默认)/ 公众号文章 / 知乎回答 / 通用图文
配图数量 从视频抽几张配图(默认 3-6,按内容节点)

输出(outputs/主题名/

  • article.md — 成篇图文(标题 + 正文 + 小标题/要点 + 金句 + 话题标签)
  • assets/frame-*.jpg — 抽取的配图
  • assets/transcript.txt / assets/transcript.json — 转录原文与时间轴(备查)

执行步骤

脚本路径(相对项目根):skills/shared/scripts/asr.pyskills/shared/scripts/video_ops.py

1. 语音转录(带时间轴)

python skills/shared/scripts/asr.py transcribe -i input.mp4 --format json \
  -o outputs/主题名/assets/transcript.json
python skills/shared/scripts/asr.py transcribe -i input.mp4 --format txt \
  -o outputs/主题名/assets/transcript.txt

(首次跑 ASR 需外网代理下模型,见 auto-subtitle 前置说明。)

2. 结构化成图文(你来做)

读转录,按目标形态改写成图文,不是照抄口语

  • 提炼结构:口语流水账 → 清晰的标题 + 3-6 个小标题/要点段落。
  • 去口水:删"然后、就是、那个"等口头禅,书面化但保留个人风格。
  • 抓金句:把视频里最有价值的观点提成金句/加粗句。
  • 按形态适配:小红书(emoji、短段、闺蜜语气、话题标签)/ 公众号(成文、有起承转合)/ 知乎(专业、有逻辑链)。字数与排版参考 post-formatter / social-content 规范。
  • 写入 article.md,并在文中标注"【配图1:xx画面 @ 02:15】"指明每张配图对应的视频时间点。

3. 抽取配图

按第 2 步标注的时间点,逐个抽帧:

python skills/shared/scripts/video_ops.py frame -i input.mp4 \
  -o outputs/主题名/assets/frame-01.jpg --time 00:02:15 --width 1080

挑画面清晰、有信息量的时间点(避免糊帧/转场帧)。

4.(可选)成套卡片

需要做成小红书卡片组时,把 article.md 交给 xhs-note-creatorcard-xiaohongshu

Profile 感知

  • 有 Profile:目标形态默认按 platforms.md 主平台;语气/称呼/emoji 尺度贴合 style.md; 话题标签贴合账号垂类;合规底线遵守 preferences.md
  • 无 Profile:默认小红书笔记形态 + 中性口语风,末尾提示可提供 Profile 定制语气。

规则

  1. 改写不是照搬转录——口语要书面化、结构化,去口水词。
  2. 配图从视频真实画面抽取,时间点由内容决定,避免糊帧。
  3. 不编造视频里没有的信息;转录不清处标注"[听不清]"而非臆测。
  4. 保留说话人的核心观点与个人风格,别改成千篇一律的 AI 腔(可再过 text-polisher)。
  5. 最终 article.mdoutputs/主题名/,转录和抽帧等中间件放 outputs/主题名/assets/

参考来源

视频→图文是创作者复用内容的高频需求(一鱼多吃)。转录用 faster-whisper(asr.py),配图用 ffmpeg 抽帧(video_ops.py frame),成文结构化交给 LLM——把确定性 IO 与创意改写分层。

Version History

  • 69c5928 Current 2026-09-08 17:40

Same Skill Collection

skills/openclaw/ai-image-gen/SKILL.md
skills/openclaw/ai-music/SKILL.md
skills/openclaw/ai-video-gen/SKILL.md
skills/openclaw/asset-manager/SKILL.md
skills/openclaw/audio-denoise/SKILL.md
skills/openclaw/audio-editing/SKILL.md
skills/openclaw/audio-mix/SKILL.md
skills/openclaw/audio-visualizer/SKILL.md
skills/openclaw/auto-short-video/SKILL.md
skills/openclaw/auto-subtitle/SKILL.md
skills/openclaw/batch-process/SKILL.md
skills/openclaw/beat-sync-video/SKILL.md
skills/openclaw/card-design/SKILL.md
skills/openclaw/card-quote/SKILL.md
skills/openclaw/card-xiaohongshu/SKILL.md
skills/openclaw/chart-visualization/SKILL.md
skills/openclaw/clipify/SKILL.md
skills/openclaw/comparison-card/SKILL.md
skills/openclaw/copywriting/SKILL.md
skills/openclaw/data-report/SKILL.md
skills/openclaw/doc-convert/SKILL.md
skills/openclaw/ecom-details-image/SKILL.md
skills/openclaw/green-screen/SKILL.md
skills/openclaw/gzh-design/SKILL.md
skills/openclaw/image-editing/SKILL.md
skills/openclaw/image-enhance/SKILL.md
skills/openclaw/infographic/SKILL.md
skills/openclaw/meme-generator/SKILL.md
skills/openclaw/mindmap/SKILL.md
skills/openclaw/multi-voice-dubbing/SKILL.md
skills/openclaw/novel-writer/SKILL.md
skills/openclaw/paper-explainer/SKILL.md
skills/openclaw/post-formatter/SKILL.md
skills/openclaw/poster-hero/SKILL.md
skills/openclaw/remove-bg/SKILL.md
skills/openclaw/roi-calculator/SKILL.md
skills/openclaw/short-drama/SKILL.md
skills/openclaw/skill-account-diagnosis/SKILL.md
skills/openclaw/skill-algorithm-updates/SKILL.md
skills/openclaw/skill-article-outline/SKILL.md
skills/openclaw/skill-audience-profiler/SKILL.md
skills/openclaw/skill-bilibili-upload/SKILL.md
skills/openclaw/skill-brand-onboarding/SKILL.md
skills/openclaw/skill-campaign-planner/SKILL.md
skills/openclaw/skill-carousel-planner/SKILL.md
skills/openclaw/skill-channels-upload/SKILL.md
skills/openclaw/skill-collab-proposal/SKILL.md
skills/openclaw/skill-comment-insights/SKILL.md
skills/openclaw/skill-community-ops/SKILL.md
skills/openclaw/skill-competitor-analysis/SKILL.md

Metadata

Files
0
Version
f4a62bf
Hash
3540fb23
Indexed
2026-09-08 17:40

Accueil - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-09-22 03:28
浙ICP备14020137号-1