seedance-2-video-gen
GitHub提供Seedance 2.0视频生成的方法论,涵盖文生、图生及参考模式,指导参数配置、一致性控制与Timeline分拍技巧。仅作为知识参考,不执行API调用或外部请求。
Trigger Scenarios
Install
npx skills add anymouschina/TapCanvas --skill seedance-2-video-gen -g -y
SKILL.md
Frontmatter
{
"name": "seedance-2-video-gen",
"description": "Seedance 2.0 生视频「方法论」参考:三种模式(文生视频\/图生视频\/参考生视频)、时长、分辨率、音频、比例、参考图\/视频\/音频限制等参数知识。仅提供方法论——本项目通过自有 new-api \/ 画布生视频工具(doubao-seedance)执行,不直连外部 API、不需要任何外部 API key。"
}
Seedance 2.0 生视频方法论(本地版)
定位(重要):本 skill 只给方法论,不执行、不调用外部 key。 本项目的视频生成统一走自己的链路:画布
video节点 /tapcanvas_video_generate_to_canvas工具 → new-api 的 doubao-seedance 官渠(如doubao-seedance-2-0-260128/-fast)。官渠已直接支持真人,项目不再有任何-face模型,禁止输出doubao-seedance-2.0-face等 -face 变体。 需要真正出视频时,用项目自有的生视频工具/节点,把下面的方法论填进去;不要注册 EvoLink、不设任何*_API_KEY、不 curl 外部端点。 边界:seedance-20 skill 教的是外部平台表面(EvoLink/OpenRouter/API key/外部定价),仅供咨询外部用法;本项目出片一律走自有链路,不采信其 API/key 指引。 TapCanvas 正式提示词边界:本 skill 的 Timeline、动作、运镜与模型知识只可作为领域方法输入,不能自行成为最终 prompt 标准。任何写入 TapCanvas 视频节点、提示词包或真实供应商请求的提示词,都由tapcanvas-video-workflow派video-prompt-writer,并在同一上下文按tapcanvas-video-reviewer修订;动态 generationContract 优先于本文件中的历史时长、分辨率、引用数量与示例@图N。
三种模式(方法论)
| 模式 | 用法 | 输入 |
|---|---|---|
| 文生视频 | 描述场景直接出视频 | prompt(可选 web 搜索增强时效性内容) |
| 图生视频 | 从图动起来 | 1 张图=首帧动画(首尾帧插值/续写/尾帧续接已于 2026-06-26/07-06 在本项目停用:镜间并发独立+exitState 文字承接;此段仅存档) |
| 参考生视频 | 多模态混合/编辑 | 图(0–9) + 视频(0–3) + 音频(0–3) + prompt,用自然语言按编号引用输入(续写用法已停用,同上注) |
当前口径:
storyboardImageNodeId是可选图片引用。单状态可用普通 image;确需表达连续变化时可用一张承载 2~3 个有序状态的故事板 image;无关键帧也合法。只有bridge_frames把它作为真起幅并要求lastFrameImageNodeId。仍禁运行时从已出视频抽帧续写,整章母板、通用设计板、四格以上分镜板和站位图禁止进入视频。
参数方法论
| 参数 | 说明 | 默认 |
|---|---|---|
| prompt | 运动意图描述。写运动方向与物理后果,把动作沿时间轴铺开(Timeline 分拍见下),禁止一句笼统带过。 | 必填 |
| duration | 4–15 秒。单段越短累积畸变越少(口径澄清:单拍 ≤3s(台词拍除外),单条 clip ≤15s)。 | 5s |
| resolution | 480p / 720p。 | 720p |
| audio | 可自动生成同步的人声/音效/BGM。 | 开 |
| aspect | 16:9 / 9:16 / 1:1 / 4:3 / 3:4 / 21:9 / adaptive。 | 16:9 |
| referenceImages | 图生视频 1–2 张;参考模式 0–9 张。 | 条件 |
| referenceVideos | 参考模式 0–3 个(.mp4/.mov,单段 2–15s,合计 ≤15s)。用于运镜/动作参考。(作为被编辑/续写源视频的用法已于 2026-06-26/07-06 在本项目停用:镜间并发独立+exitState 文字承接;此句仅存档) | 条件 |
| referenceAudio | 参考模式 0–3 个(.wav/.mp3,单段 2–15s,合计 ≤15s)。用于 BGM/音效/配音参考。 | 条件 |
一致性 / 喂图方法论(配合故事板)
- 按需关键帧 + 精选资产:每镜可不使用关键帧、使用普通单状态 image,或使用一张 2~3 状态故事板 image;再按剧情需要精选核心人物、群像、场景、武器/道具/VFX。整章母板、通用设计板、四格以上网格图和站位图绝不喂视频模型。
- 产品一致性:
keep the product appearance completely unchanged, camera movement only, no rotation;只动相机不动主体;单片段 ≤3s。 - 角色一致性:身份板派生单图(大头照+全身照)当锚点,每镜带固定外观描述;禁三视图整图直接喂视频(ID 漂移/双胞胎风险,与 sd2-pe 口径一致)。
动态/运动最佳实践(Timeline 分拍 —— 治「静帧伪动」)
实测:单张静态关键帧 + 一句笼统 prompt → Seedance 把动作「冻成一帧」,只剩特效闪烁的伪动态;近身打斗尤其垮。根因不是模型,是 prompt 没把运动「沿时间轴铺开」。以下为治本写法。
- Timeline 分拍(核心):用显式时间戳把运动分布到整条片,模型才不会塞成静帧。
- 叙事档:5s:
[0s] [1.5s] [3.5s]三拍;10s:[0s] [2s] [3.5s] [5s] [6.5s] [8.5s]六拍。拍长随动作内容自然分布、禁机械等分;叙事/情绪拍可 3~5s+,硬要求=描述密度与时长守恒(长拍写满演进链,过稀被写入闸退回补密)。 - 打斗档(电光火石·单拍最低1s·无拍数上限):8s:
[0s][1s][2.5s][3.5s][4s][5.5s][7s]逐秒密拍——镜内逐秒时间轴 ≠ 碎镜(碎镜指跨条 clip 的独立短镜)。同样拍长随动作自然分布、禁机械等分。 - 每拍格式:
[Xs] 景别:主体的【一个】动作。镜头:运镜词。氛围/光。
- 叙事档:5s:
- 每拍只给一个主要动作动词:多动作/复杂多角色同框 = chaos/静帧。复杂编排拆成连续 beats(升级弧:setup → 出招 → 升级 → 反转 → 收)。
- 主体运动与镜头运动分开写,镜头用电影词且每拍只用一个主运镜:push-in/dolly、pull-out、pan、tracking、orbit、aerial、handheld、fixed。
- 打斗要写「撞击物理 + 后果」,不要虚词:不是「扑击/格挡」,而是「爪砸上符墙→迸成金色碎光、虎妖被反震后挫半步、碎瓦崩飞」。给方向、距离、受力形变、destruction 结果。
- 撞击「后果余波」必须写全(治「只撞上不弹开」):不止写「撞上」,要写「被弹回」——受击方反震滞空顿挫、重心趔趄后退半步;重物落地/重击必写「地面震颤 + 一圈尘浪扩散 + 碎屑崩飞联动」。只写接触不写余波 = 假。
- 动作-情绪联动(治「全程一张脸」):发力/受击/被弹的每个关键瞬间,同步写角色表情变化(吃痛、错愕、咬牙、瞳孔收缩、眉骨皱起、头猛地后仰)。表情不随动作变 = 最大的「假」来源。
- 发力链/重量感:写重心压低、蹬地或扎马受力、肌肉绷紧、衣料随发力甩动、巨物移动带起地面浮尘;避免「摆拍顺拐」式的表层漂移动作。
- 节奏点睛(条件规则):决定性瞬间只有在当前 UserIntentContract 明确允许时间强调时,才可用表演凝滞、慢运镜或微距推进;精确变速归剪辑层,不得偷偷写进生成提示词。用户要求疯切、全程实时、无慢动作或无英雄时刻时,保持实时速度,用切点、攻击路径、接触材质、位移和反作用读清强度,不得用 slow/smooth/gradual、微升格、抽帧或定格换名恢复慢镜。
- 负向必加(同时治一致性抖动):
avoid jitter, avoid bent limbs, avoid temporal flicker, no identity drift。 - 密度守恒,不设字数下限也不设字数上限:按 Timeline 分拍把每个时间段的动作、物理后果、运镜、光与声音写足写满;描述密度与时长守恒(长拍写满演进链)。本项目结构化 shots 渲染的长提示词不受任何词数上限约束、不注水、不因“怕长”压缩叙事;单段内宁可写满也不要一句笼统带过。
- 图生视频:源图已给外观,prompt 只写运动/运镜/光,不要重述外观(减少身份/背景漂移)。
- 运动/动作参考:复杂动作优先走 参考生视频 传
referenceVideos(运动参考片),比静态帧更能逼出真实动作;style 转换时强调preserve core motion and timing。
动作镜 prompt 模板(可套)
N秒,16:9。[环境一句 + 角色锚点一句]。
[0s] 景别:主体【一个动作】。镜头:一个主运镜。氛围。
[3s] 主体【下一个动作,含撞击物理与后果】。镜头:运镜。
[6s] 景别:主体【反应/反震】。镜头:运镜(只有用户允许时才可时间强调)。
[8s] 收拍/开放动作(只有用户或父任务明确要求收束时才允许定格;独立 clip 默认以未完成动势退出)。
对白:@角色(情绪):「台词」口型同步(2026-07-10 全项目符号统一)。 SFX:动作同步音效。
拒绝:BGM/背景音乐;文字字幕/水印/随机汉字;jitter/bent limbs/temporal flicker;identity drift;现代元素;漫画平涂线稿。
进阶杠杆(破文字描述的上限)
- 参考视频「运动迁移」(最强杠杆,治真实重量/卸力/连招):复杂动作别只靠文字,传 1 段 3–8s 干净单一动作的运动参考片到
referenceVideos(参考生视频模式)。Seedance 逐帧复制其运动路径 + 机位 + 编排到我方角色;运动由参考片定、风格/外观由文字+参考图定(两套独立系统)。文字里写transfer the motion and camera from the reference video onto 沈砚/虎妖, keep their appearance from the reference images, preserve core motion and timing。 - 二级运动(secondary motion)必写:每个动作附带 头发/衣料随力甩动、尘土/碎屑/火星/水花扬起、动作收势 follow-through、巨物移动带起浮尘——Seedance 物理强,写了就有,不写就「漂浮假」。
- 角色一致性强化:① 身份锚点(姓名+不可变特征)放 prompt 最前 20–30 词,否则切镜会幻觉出新角色;② 参考图宁少勿多(2 张干净锚点 > 6 张杂图,漂移↓约 60%);③ 点名独特特征(额「王」纹、金瞳、暗银云纹、丹青笔暖金)+ 显式负向
no missing markings, no mirrored features, no identity drift。 - 具体连招 + 环境破坏链:不写「打斗」,写可执行连招(如「侧滚→反手一笔劈出符墙→借力后撤」)与连锁破坏后果(梁柱断裂→碎瓦多米诺崩落)。
- CRAFT 多模态参考法:Context(场景) · Reference(@图/@视频/@音) · Action(动作) · Framing(机位) · Timing(节拍) 逐项写清。图引用规范写法=@图N(2026-07-10 全项目符号统一)。
重要限制(与本项目一致)
- 真人写实脸:官渠
doubao-seedance-2-0-260128已直接支持真人参考图/首帧,正常出片并转存 R2。项目已不存在-face模型,禁止输出doubao-seedance-2.0-face等 -face 变体;真人镜照常用官渠模型,别因怕审核把人删成纯产品镜。 - 默认约束:16:9 避裁切、24fps 对齐电影标准。
模型能力速记
- 文生/图生/参考生视频;自动音频(人声/音效/BGM);时长 4–15s;分辨率 480p/720p;比例多档含 adaptive。
参考
references/api-params.md:完整参数方法论(三模式输入限制、时长/分辨率/音频/比例、最佳实践)。
Version History
- 2.0.0 Current 2026-09-03 06:08


