Seedance 2.5 提示词指南(上):写作框架与参考生成
从任务判断、素材绑定和连续时间轴入手,学习 Seedance 2.5 的基础提示词结构,以及白模、故事板和关键帧参考工作流。
Seedance 2.5 的强项不只是理解画面描述,而是让文本、图片、视频与音频分别承担明确职责。写提示词时,先判断输入素材会不会锁定输出,再决定哪些内容需要严格继承、哪些内容只提供参考。
本系列分为两篇:
- 本篇介绍提示词结构、素材绑定、时间轴、镜头语言、白模、故事板与关键帧。
- 下篇:视频编辑、续写与成片介绍指令编辑、参考图编辑、音频编辑、延长、一键成片和无缝转场。
模型与任务
Seedance 2.5 支持单段最长 30 秒视频直出,单次最多输入 50 个图片、视频和音频素材,并支持十余种语言的对白生成。它的典型能力可以归为六类:
| 能力 | 主要用途 |
|---|---|
| 主体与风格参考 | 固定人物、商品、场景、虚拟角色、音色或美术语言 |
| 运动与镜头参考 | 继承动作、表情、运镜、特效节奏或白模时序 |
| 故事板与关键帧 | 规定剧情顺序,或提高具体画面的对齐程度 |
| 视频编辑 | 对原视频中的主体、背景、材质、声音和局部时段做增删改 |
| 视频延长 | 向前或向后续写,并保持声画衔接 |
| 素材成片 | 将多张图片或多段视频组织为带转场与音乐的短片 |
“锁定”与“参考”是两套逻辑
有锁定任务:编辑、首尾帧和延长。 输入素材会占据输出时间轴,或决定输出画幅。模型需要适配素材,因此部分生成参数不能随意改变。
无锁定任务:普通参考、故事板和关键帧。 素材主要提供语义或视觉约束,可以独立指定输出时长与画幅。独立关键帧通常比宫格故事板对齐得更严格。
素材输入建议
| 素材或场景 | 建议范围 | 实用提醒 |
|---|---|---|
| 图片 | 最多 30 张,单张不高于 4K | 1–8 个主体较稳;主体较多时,拆分单视图通常更稳定 |
| 视频 | 最多 10 段,总时长不超过 30 秒 | 主体参考以 5–10 秒为宜;编辑输入以 20 秒内为宜 |
| 音频 | 最多 10 段,总时长不超过 30 秒 | 明确它是音色、台词、旋律还是节奏参考 |
| 宫格故事板 | 建议少于 15 格 | 优先线稿或火柴人,避免过度锐化、脏乱和大段文字 |
| 白模 | 优先简单几何体 | 去掉轨迹线、坐标轴和相机锥体,避免泄露到结果中 |
一个稳定的四段式提示词
素材绑定 + 一句话概述 + 时间轴或镜头顺序 + 全局约束- 素材绑定: 按上传顺序说明图片、视频和音频分别负责人物、动作、场景、风格还是声音。
- 一句话概述: 用“主体 + 地点 + 事件 + 题材或风格 + 特殊镜头”建立全片方向。
- 时间轴或镜头顺序: 分段写清画面、动作、运镜、台词和音效,让内容密度与时长匹配。
- 全局约束: 补充贯穿全片的机位、光线、色彩、环境声、画幅,以及“无字幕、无 BGM”等限制。
基础案例不需要堆砌大量形容词。关键是让动作、镜头和声音在 8 秒内形成完整闭环。
提示词
写实自然纪录片质感,温暖午后的森林草坡。一只圆润的熊猫幼崽笨拙地顺坡滚下。
主体与场景:幼崽毛发蓬松、体型小而圆;草坡上有苔藓、三叶草、泥土、小石块和零星黄花,背景树干柔和虚化。
0–3 秒:低机位中远景。熊猫趴在斜坡上,开始缓慢侧滚,身体压弯草叶,林间斑驳阳光随微风轻轻变化。
3–8 秒:镜头轻微向右下方跟随。熊猫逐渐停下并变为趴卧,圆脸转向镜头,前爪压住草地,轻轻抬头后放松趴下。
全程保持熊猫清晰、背景自然虚化;轻微手持呼吸感。只使用风声、草叶摩擦和柔软的滚动声,不要配乐,不要字幕。多素材映射
不要依赖参考图里写着的人名,也不要让模型猜“哪个素材属于谁”。素材变多时,先用清单完成绑定,再进入剧情。
素材绑定:
图片 1–2:人物 A 的外观;音频 1:人物 A 的音色。
图片 3:人物 B 的外观;音频 2:人物 B 的音色。
视频 1:只参考两人的动作顺序。
视频 2:只参考环绕镜头和剪辑节奏。
图片 4:只参考暖金色逆光与胶片色彩,不参考人物。每个素材都要回答两个问题:它对应谁?具体参考什么? 如果只参考素材的一部分,应同时写明不要继承的内容。
时间轴、镜头与动作
Seedance 2.5 可以响应整数秒时间戳。时间段应连续,例如 0–3 秒、3–7 秒、7–15 秒,不要留下无法解释的空档。
- 明确时间点: “第 5 秒向左快速横移,以擦除加自然叠化完成转场。”
- 相对时间: “主角按下快门后,画面定格 1 秒,再进入下一镜。”
- 内容密度: 时间段内内容太少时,模型会自由补充;内容过多时,容易出现过度剪切或剧情遗漏。
大全景、中景、特写、推拉摇移、低角度、俯视、一镜到底、航拍、FPV、希区柯克变焦等常用镜头词可以直接写。遇到较少见的术语,在后面补充观众实际会看到的结果:
第 4 秒开始移焦:前景清晰的玻璃杯逐渐虚化,背景中的女主从模糊变为清晰;焦点转换平稳,不改变机位。动作优先概括主线,只把少数记忆点写细。表情则使用可观察的面部变化,例如“眼眶发红、嘴角压低、呼吸变急”,而不是只写抽象情绪。
白模参考:把运动设计与视觉渲染拆开
白模可提供镜头顺序、景别、角色动线、动作与光影节奏。提示词需要说明哪些信息必须继承,并为没有参考图的主体补足外观与场景描述。
白模负责镜头调度,九张图片负责角色造型与不同阶段的视觉状态。
提示词
视频 1 只用于参考整支短片的镜头顺序、机位、景别变化、主体运动轨迹与节奏;不要复制白模的材质和角色外观。图片 2–10 分别约束对应阶段的角色造型、环境与色彩。
生成 30 秒、16:9 的电影级 3D 童话动画:女孩在房间里放飞玩具飞机,进入幻想天空,俯冲海面并潜入海底,穿过时空裂缝抵达宇宙,最后回到地毯上熟睡,父亲走入画面。
0–3 秒对应图片 2;3–5 秒对应图片 3;5–8 秒对应图片 4;8–10 秒对应图片 5;10–19 秒对应图片 6–7;19–23 秒对应图片 8;23–28 秒对应图片 9;28–30 秒对应图片 10。严格保持视频 1 的镜头结构,不新增镜头,角色外观随对应关键帧保持一致。








提示词
将视频 1 进行完整重渲染:严格保留原视频的动作轨迹、镜头运动、节奏和景别。
环境改为深蓝与紫色主调的赛博朋克夜城,密集摩天楼之间有全息广告与霓虹反光,远处飞行器缓慢穿梭。主体是一只穿黑色夜行服的小浣熊,在高楼屋顶谨慎潜行,轮廓被城市背光勾亮。
不要背景音乐;只保留风声、远处机械声、脚步与衣料摩擦声。不要生成轨迹线、坐标轴或相机辅助线。故事板:控制叙事,不负责逐像素对齐
宫格图适合规定镜头数量、景别和剧情顺序,但会给模型保留发挥空间。提示词需要补齐动作、运镜、台词和风格;需要严格画面对齐时,应改用独立关键帧。
提示词
素材绑定:图片 1 负责九个镜头的顺序、景别与运镜节奏;图片 2 负责黄昏草原发射场的构图与冷暖色彩;图片 3 是穿金黄色长裙的年迈女性;图片 4 是高大的做旧蓝绿色守护机器人。
生成 30 秒、16:9 的真人实拍灾难电影片段。35mm 彩色胶片颗粒,手持呼吸感,浅景深;暖金夕照、冷暮蓝与爆炸橙形成对比。不要黑白、插画、故事板线稿、玩具感或塑料 CG。
按图片 1 的九镜顺序推进:两人远望火箭;机器人搀扶老人;老人特写告别;火箭升空;半空爆炸;泪水滑落;老人崩溃;机器人俯身环抱保护;以两人相拥的远景收束。对白使用自然英语,环境声、风声与爆炸声位置准确。



关键帧:更严格地规定画面顺序
将每一张关键画面作为独立图片按顺序上传,并在提示词第一句声明“以图片 1 至图片 N 的顺序作为关键帧”。
提示词
以图片 1 至图片 6 的顺序作为关键帧,制作 15 秒竖版像素科幻短片。全片保持深蓝太空背景、统一的 16-bit 像素颗粒与复古电子音乐,以一镜到底的水平位移连接各画面。
从图片 1 的轨道站外景开始;镜头穿过舷窗后,图片 2 的太空信使转身看向镜头。图片 3 中,她从储物舱取出发光能量核心。警报灯亮起后,她按照图片 4 的姿态穿过失重走廊,接着以图片 5 的动作跃过断裂栈桥。镜头持续跟随,最终进入图片 6 的反应堆舱;她将能量核心装入插槽,舱内灯光由红转蓝。
保持角色面孔、橙白宇航服、能量核心造型和空间站结构一致;动作连贯,无文字、无字幕、无闪烁、无元素变形。





提交前检查
- 任务属于“有锁定”还是“无锁定”?
- 每个素材是否都有编号、对应主体和唯一职责?
- 时间段是否连续,内容密度是否与时长匹配?
- 小众镜头术语是否补充了可观察的画面结果?
- 动作、声音和转场是否写明触发时刻?
- 字幕、BGM、文字和水印等限制是否明确?