简短回答: Seedance 2.0 的提示词按 主体 + 一个动作 + 镜头 + 环境 + 光线/风格 + 声音 + 连贯性约束 来写。好提示词不在于长,而在于用最短的镜头说明,让每一句话、每一份参考素材都有明确的用处。
Seedance 2.0 可以把文本、图片、视频和音频当作参考。下面的公式和 8 个可直接复制的示例,覆盖文生视频、图生视频、参考视频驱动的运镜、对白、声音、多镜头节奏和转场。
稳定好用的 Seedance 2.0 提示词结构
按这个顺序写:
- 主体: 画面里是谁或什么,包括用来锁定身份的特征。
- 动作: 一个主要的肢体动作或情绪节拍。
- 镜头: 景别、运镜、机位角度和镜头质感。
- 环境: 地点、纵深、天气和时间。
- 光线与风格: 统一的一种视觉方向。
- 声音: 台词、环境音、音效,或者干脆静音。
- 连贯性约束: 哪些东西不能变。
模板:
[主体]做出[一个动作]。[景别与运镜]。[环境与纵深]。[光线与视觉风格]。[声音设计]。保持[身份、服装、几何结构或参考约束]不变。[时长与画幅比例]。
8 个可直接复制的 Seedance 2.0 提示词示例
1. 角色特写
一名疲惫的快递员穿着磨旧的红色夹克,在车站雨棚下停住脚步,望向进站的列车。中近景,缓慢推镜,视线方向保持稳定,浅景深。蓝调时刻的雨夜,站台灯光偏暖。安静的雨声、远处的铁轨声,一声轻轻的呼吸。面部特征和夹克细节保持稳定。6 秒,16:9。
2. 竖屏漫剧场景
一名年轻女剑客从阴影里走进挂满灯笼的小巷,举剑一次。开场是腰部以上、类似漫画分格的构图,随后平稳地横向跟拍,衣摆和发丝随动作摆动。墨线漫画质感,色彩克制。一声金属拔剑声,低沉的城市环境音。服装和面部不得变化。6 秒,9:16。
3. 产品镜头
一只哑光黑色无线音箱在石质底座上缓慢旋转,一道窄光带从机身表面扫过。微距机位固定,只做约 10 度的轻微环绕。暗调影棚,薄雾柔和,材质反光真实。极简电子音铺底。标志形状和产品比例与参考图完全一致。5 秒,1:1。
4. 图生视频:让角色动起来
图片已经决定了外观,就不必把看得见的细节再描述一遍。只需告诉模型哪些可以动,哪些必须锁住。
以参考图作为首帧,沿用其中的人物身份和构图。加入[一个主体动作]和[一个环境动作]。[镜头指令]。保持面部、服装、物体几何结构、色调和背景布局不变。不要新增人物或物体。[声音设计]。[时长]。
示例:
以参考图作为首帧。角色转身望向窗户一次,窗帘在微风里轻轻飘动。缓慢推近约 5%,不要旋转或抖动。保持面部身份、发型、制服、房间结构和色调不变。加入柔和的室内底噪和远处的雨声。5 秒。
5. 图片定身份,视频定运镜
图 A 只用于角色的脸、发型、红色大衣和身材比例;视频 B 只用于它缓慢的顺时针环绕运镜和行走节奏。夜晚,角色穿过湿漉漉的天台,远处的招牌倒映在积水里。保持图 A 的身份和服装;不要照搬视频 B 里的人物或场景。6 秒,16:9。
6. 对白与同步环境音
深夜,两名侦探隔着狭窄的餐馆卡座对坐。固定中景双人镜头,极缓慢地推近。左边的侦探压低声音说:“那趟列车始终没开到终点站。”另一人沉默不语,望向窗外。两人的脸始终在画面内且保持稳定。冰箱低沉的嗡鸣,细雨打在玻璃上,不要配乐。8 秒,16:9。
7. 按时间分节拍的多镜头动作
生成一段连续 8 秒的画面,分三个清晰的节拍。0–2 秒:远景,一名骑手骑车驶入空荡荡的隧道。2–5 秒:侧面跟拍,骑手加速掠过一盏盏重复排列的灯。5–8 秒:正面特写,隧道出口的亮光铺满背景。每次切换都保持同一个骑手、同一辆车、同一行进方向和冷色调。加入轮胎声,隧道回声逐渐变强。
8. 匹配剪辑转场
开场是俯拍特写:温暖的公寓里,一张黑胶唱片正在转动。用匹配剪辑把圆周运动接到航拍画面:一辆车在积雪的环岛上绕行。转场前后旋转方向和圆心位置对齐。不要额外剪辑。唱片的沙沙声过渡成柔和的路噪,随后淡出。6 秒,16:9。
视频和音频参考怎么用
每份参考只分配一个用途:
- 图片参考:身份、服装、道具、场景或构图;
- 视频参考:动作节奏、运镜路径、表演或转场;
- 音频参考:时间节点、台词节奏、环境音或音效设计。
如果两份参考互相冲突,就在提示词里写明优先级,例如:“角色身份以图 A 为准,视频 B 只参考运镜。”这比让模型把两份参考都完整模仿一遍清楚得多。
让结果更清楚的镜头语言
每个镜头最好只有一个明确的运镜:
- 固定镜头:适合对白和需要准确呈现几何结构的产品;
- 缓慢推镜:适合“恍然大悟”或逐渐紧张的时刻;
- 横向跟拍:适合行走和逐步展开环境;
- 受控环绕:适合产品展示或强调空间感;
- 拉远揭示:适合交代规模和场景全貌。
别在一个短镜头里同时堆上“手持、环绕、变焦、推轨、甩镜”。运镜指令互相打架,常常会让主体看起来变形,或者背景乱成一团。
常见失败与修正
身份漂移
用一张清晰的身份参考图,删掉无关的风格形容词,只重复那些必须固定的特征。长表演拆成几个短镜头,每个镜头沿用同一组参考。
动作太多
只保留一个主要动作和一个次要的环境动态,删掉同时抢戏的手势和小动作。
镜头指令没被执行
把镜头指令挪到前面,只写一种运镜,并交代一个稳定的起始构图。
对白和画面对不上
让脸保持在画面里,减少运镜,给出准确的台词或音频参考,说明情绪和语气,不要再叠加几个互相竞争的动作。
多镜头场景前后不连贯
先规划好镜头清单,别把整段戏硬塞进一条提示词。每个镜头都复用同一组角色、场景和风格参考,最后在剪辑器里把通过审核的片段拼起来。
一集故事的提示词工作流
- 把剧本拆成镜头,每个镜头只承担一个故事节拍。
- 生成视频前,先锁定角色和场景参考。
- 画出分镜,检查构图和连贯性。
- 用成本较低的设置跑短的动作测试。
- 只有审核通过的镜头才升到最终分辨率。
- 每次输出都保存对应的提示词版本和生成参数。
AniKuku 就是围绕这套流程设计的:模型负责生成镜头,工作区负责保存单次 API 调用不知道的故事上下文。
在用 Seedance 2.5? 这套镜头说明的写法同样适用,但当前支持的模式和限制,请以Seedance 2.5 发布、规格及访问状态为准,不要把这篇 2.0 指南当作 2.5 的规格说明。
常见问题
Seedance 2.0 提示词用什么格式最好?
按顺序写:主体、一个动作、一种运镜、环境、光线、声音,以及明确的连贯性约束。
Seedance 2.0 可以同时使用多份参考吗?
官方产品页介绍了多模态参考能力。给每份参考指定具体用途,并在 ModelArk 教程里确认当前的数量和格式限制。
Seedance 提示词写多长合适?
长到能消除歧义就够了,不要用同义词凑字数。紧凑的镜头说明通常能让模型更清楚地分辨轻重缓急。
相关指南
- MiniMax H3 发布状态、API、价格与演示
- Seedance 2.5 发布、规格及 API 状态
- Seedance 2.0 图生视频一致性工作流
- Seedance 2.0 API 价格与接入
- 剧本到分镜 AI 工作流