Seedance 2.5 零基础到出片,一篇就够了
看完这篇,你就能写出第一个可用的 AI 视频提示词。不用懂代码,不用学剪辑,只需要会描述画面。
一、Seedance 2.5 是什么?
Seedance 2.5 是字节跳动 2026 年 7 月 31 日正式发布的最新一代 AI 视频生成模型。它的核心卖点就三个:
- 一口气生成最长 30 秒视频(上一代只有 15 秒),不需要拼接
- 原生 4K 分辨率 + 同步音频,画面和声音一次搞定
- 最多 50 个参考素材(30 张图 + 10 段视频 + 10 段音频),给模型喂什么它就学什么
简单说:你写一段文字,AI 给你一段带声音的电影级短片。
在哪里用?目前可通过即梦 AI、豆包 Pro使用,API 已上线火山方舟平台,SuperMaker、Morphed 等第三方平台也已接入。
Seedance 2.0 vs 2.5,这次升级了什么?
| 能力 | 2.0 | 2.5 |
|---|---|---|
| 单次最长时长 | ~15 秒 | 30 秒(可扩展至 180 秒) |
| 参考素材上限 | ~12 个 | 50 个(图30+视频10+音频10) |
| 秒级时间戳 | 支持但不稳定 | 高度响应,一等公民 |
| 分辨率 | 原生 4K | 原生 4K + 10-bit 色深 |
| 音频 | 与视频分别生成 | 音画同步一次生成 |
| 编辑能力 | 整段重做 | 区域级编辑 + 时间戳编辑 + 绿幕 |
| 多视角主体 | 不推荐 | 正式支持 |
如果你还没用过 2.0,没关系——直接从 2.5 开始,一步到位。
二、提示词核心公式:6 个要素,写出能用的 Prompt
Seedance 2.5 的官方提示词公式非常简单,就 6 个槽位:
主体(Subject) + 动作/事件(Action) + 场景与环境(Scene,可选) + 视觉风格(Visual Style,可选) + 摄像机运动(Camera,可选) + 音频(Audio,可选)⚠️必填的只有前两个:主体 + 动作。其余按需添加,不写反而比乱写强。
用一个完整例子感受一下
一位陶艺师在清晨的工作室里,从拉坯机上取下淡蓝色的杯子, 轻轻放在木架正中央。 窗外透进柔和的晨光,湿润的陶土泛着细腻的光泽, 工作台整洁有序。 镜头从中景开始缓慢推近,聚焦杯身纹理,然后切到木架正面。 保留拉坯机的低鸣、陶土摩擦声和室内的细微环境音。逐句拆解:
| 句子 | 对应要素 | 说明 |
|---|---|---|
| 陶艺师取下杯子放在木架上 | 主体 + 动作 | 谁在做什么,这是根基 |
| 窗外晨光、湿润陶土、工作台 | 场景 + 视觉风格 | 氛围和质感 |
| 中景缓慢推近 → 切到正面 | 摄像机 | 怎么拍 |
| 拉坯机低鸣、陶土摩擦声 | 音频 | 听着什么样 |
三、第一步:从 T2V(文本生视频)开始
T2V(Text-to-Video)是最基础的模式:纯文字 → 视频。
入门模板
[主体] 在 [场景] 中 [做一件具体的事]。 [描述光线和氛围]。 [镜头怎么动]。 [声音什么样]。三个难度递增的示例
Level 1:单动作静态场景(小白首选)
一只橘猫趴在洒满阳光的窗台上,尾巴从左边缓缓摆到右边, 眼睛半眯着。 午后暖光从窗外斜射进来,猫毛边缘泛着金色轮廓光。 固定镜头,浅景深,背景虚化。 保留猫咪的呼噜声和窗外偶尔的鸟鸣。要点:一个主体,一个动作,一个光源,齐活。
Level 2:带节奏变化的产品短片
一瓶墨绿色香水瓶放在黑色亚克力台面上, 标签正对镜头。 镜头从产品全景缓慢推近到标签特写(0-5秒), 到达最近距离后停顿2秒,然后缓缓拉远回起始位置(7-12秒)。 柔和的侧光从左前方打过来,瓶身高光随着镜头移动流动。 干净的产品摄影质感,背景全黑。 保留细小的玻璃碰撞声,结束时有一声轻柔的瓶盖旋紧声。要点:时间戳让镜头运动有了节奏感,产品展示类特别适合这样写。
Level 3:带微表情的人物特写
0-5秒:一位年轻女性站在雨后的咖啡馆窗前, 侧脸入画,眼神平静地望向窗外的街道。 阳光从她身后斜射进来,在她脸上投射出柔和的伦勃朗光效。 5-8秒:她好像看到了什么—— 眉头微微上挑,眼睛里闪过一丝光。 8-12秒:嘴角几乎不可察觉地上扬, 肩膀从微绷状态缓缓放松, 眼神从窗外收回来,低头看向手中的咖啡杯。 固定中景,浅景深,背景是模糊的咖啡店内景。 保留雨滴打在玻璃上的声音、远处轻缓的爵士钢琴。要点:情绪变化不是用形容词堆出来的,而是拆成眉头、眼角、嘴角、肩膀的具体动作。2-4 个可观察的物理线索,远胜一百个"感动"“温暖”。
四、第二步:I2V(图片生视频)——让你手头的图动起来
很多时候你已经有了一张图(产品图、人像、场景照),想让画面"动起来"——这就是 I2V(Image-to-Video)。
I2V 核心原则:图片负责"是什么",提示词只负责"怎么动"
这句话值千金。新手最容易犯的错就是:上传了图片,又在提示词里重新描述了一遍图片内容。结果模型被两套信息打架,画面反而崩了。
I2V 模板
@Image 1 定义了 [主体/场景] 的 [外观/结构/材质]。 [描述图片里没有的动态信息]: - 镜头怎么运动 - 画面里什么东西在变化(水波、头发、光影、物体旋转) - 变化的速度和方向 - 光照有没有变化 [约束]:保持 @Image 1 的 [哪些内容] 不变。I2V 示例
@Image 1 定义这双白色运动鞋的外观、材质和颜色。 不要使用图片背景。 镜头从鞋头缓缓环绕到鞋跟(0-6秒), 鞋面网布的纹理始终清晰。 鞋带有微风拂过的轻微摆动感。 柔和的顶光缓慢扫过鞋面,产生流动的高光。 干净的产品摄影背景(纯白渐变灰)。 保持鞋的款式、Logo、配色和材质完全不变。五、第三步:让画面"电影感"——摄像机和光照
摄像机运动速查
别写"有电影感"——这四个字对模型没有任何用。直接说你想要什么:
| 想要的效果 | 怎么写 |
|---|---|
| 慢慢靠近 | 镜头缓慢向前推进(slow push-in) |
| 慢慢拉远 | 镜头缓慢向后拉远(slow pull-out) |
| 环绕拍摄 | 镜头围绕主体顺时针缓慢环绕(slow clockwise orbit) |
| 水平平移 | 镜头从左向右水平平移(pan right) |
| 跟随拍摄 | 镜头以相同速度跟随主体,保持主体在画面中央 |
| 一镜到底 | 一镜到底长镜头,不切画面,连续经过…… |
| 低角度仰拍 | 低角度仰拍,主体显得高大 |
| 俯拍 | 正上方俯拍(overhead shot) |
| 第一人称 | 第一人称视角(FPV) |
| 特写 | 微距特写(extreme close-up) |
| 浅景深 | 浅景深,背景虚化为圆形光斑 |
光照:决定画质的隐藏大招
在所有提示词修饰词中,光照描述对视觉质量的单一影响最大。官方的每个示例都有一个独立的光照段落,写得极其具体。
三层色彩结构配方:
| 层级 | 作用 | 示例 |
|---|---|---|
| 基调色(大面积) | 设定情绪 | “冷蓝绿的暗部覆盖大部分画面” |
| 次级色(主体绑定) | 确立角色 | “主角身穿深红色风衣,在冷调背景中跳脱出来” |
| 强调色(小面积点睛) | 引导视线 | “远处一盏暖黄色的路灯在雨雾中晕开” |
光照实战示例:
基调:清晨 6 点的冷蓝色天光从左侧大窗进入,整个厨房笼罩在柔和的蓝灰调里。 次级:女主角穿着米白色棉麻围裙站在操作台前,暖黄的吊灯从头顶打下来, 在她手部和脸部形成温暖的高光,与冷蓝环境形成对比。 强调:灶台上正在煮的咖啡壶底部映出一点橙红色火光,在冷色调中格外显眼。六、第四步:加上声音——让视频不再"默片"
Seedance 2.5 支持音画同步生成,不需要后期配音。音频通过括号语法标注:
| 内容 | 符号 | 示例 |
|---|---|---|
| 音乐 | ( ) | (轻柔的钢琴曲在背景中缓缓流淌) |
| 音效 | < > | <远处传来一声钟响> |
| 对话(台词) | { } | {你好,欢迎回来。} |
| 字幕 | 【 】 | 【第一章:出发】 |
对话和字幕是两个独立通道。如果想让观众同时听到和看到台词,两个括号都要写。
对话语言指定
当台词不是中文时,要在台词前声明语言:
女孩用日语轻声说:{もう大丈夫です} 男主角用自然的洛杉矶英语说:{No way, you actually made it.}完整带声音的示例
一位老书店老板在黄昏时分擦拭柜台上的旧台灯。 (低沉的大提琴独奏贯穿全片,节奏缓慢) <店门上的风铃轻轻响了一声> 老板抬起头看向门口,微笑着说:{好久不见。} <他放下抹布,木质柜台上发出轻微的磕碰声> 到片尾,大提琴渐弱,<窗外雨声渐强>。七、第五步(进阶):使用参考素材,让 AI 按你的素材来
当你要做品牌视频、角色一致性要求高的内容时,参考素材是 2.5 最强大的能力。
素材三池
| 类型 | 上限 | 典型用途 |
|---|---|---|
| 图片 | 30 张 | 角色外观、产品图、场景参考、风格板 |
| 视频 | 10 段(总时长≤30秒) | 动作参考、运镜参考、节奏参考 |
| 音频 | 10 段(总时长≤30秒) | 角色声音、音乐风格、环境音 |
一个规则:每张素材只分配一个角色,并且说清楚"用什么"和"不用什么"
[角色定义] <陶艺师> 对应 @Image 1。仅使用其面部特征、发型和深绿色围裙。 不使用图片中的背景。 <淡蓝杯子> 对应 @Image 2。仅使用其形状、釉色和把手弧度。 不使用图片中的桌面和其他物品。 [场景定义] <工作室> 参考 @Image 3。仅使用其空间布局、窗户位置和晨光方向。 不使用图片中的人物。 [动作参考] @Video 1 定义双手拉坯的节奏、提起杯子和放下的速度。 不使用视频中的人物身份、服装或场景。 [音频参考] @Audio 1 定义拉坯机的持续低鸣声和陶土摩擦声。 --- 陶艺师在清晨的工作室中完成一只淡蓝色杯子, 从拉坯机上取下,轻轻放在木架正中央。 镜头从中景开始,缓慢推近至杯子表面纹理特写。 保留拉坯机低鸣、陶土摩擦声和室内环境音。⚠️绝对不要写"@Image 1 到 4 分别定义了四个角色"。每张图单独说明对应谁,否则模型会乱。
八、完整实战:从 0 到 1 做一个 30 秒短片
假设你要做一个冷萃咖啡品牌的 30 秒概念短片——一镜到底,从后厨准备到顾客接手。
第 1 步:先写叙事弧线(四个节拍)
开场(0-6秒):咖啡师双手在昏暗的后厨准备, 晨光从半闭的百叶窗缝隙透入。安静。 推进(6-16秒):后厨逐渐亮起来,节奏加快, 同一双手持续工作,蒸汽升腾。 转折(16-24秒):第一位顾客接过杯子, 色调逐渐变暖,环境音降为一轨音乐。 结尾(24-30秒):广角拍咖啡店全景,品牌围裙在画面中, 最后两秒定格。第 2 步:填入 6 要素,加上约束
[制作目标] 一镜到底冷萃咖啡概念短片,全程不切画面。 [开场 0-6秒] 低角度中景,一双咖啡师的手在昏暗后厨操作台上准备冷萃器具。 晨光从半闭百叶窗缝隙中斜射进来,在操作台表面拉出细长的光线。 空气中能看到微尘缓缓飘浮。安静,只有冰块落入玻璃杯的清脆声。 [推进 6-16秒] 后厨逐渐亮起,晨光角度升高,空间从暗调过渡到明亮。 同一双手开始倒入冷萃咖啡液——深褐色液体沿着冰块缓缓下沉, 形成大理石纹般的渐变层次。蒸汽从手冲壶嘴微微升腾。 节奏明显加快,但动作始终利落、连续。 <冰块碰撞声> <液体倾倒的潺潺声> [转折 16-24秒] 镜头从手部自然上摇到咖啡师的面部—— 一位年轻的咖啡师,嘴角带着淡淡的专注。 然后镜头跟随她的视线转向柜台对面: 第一位顾客伸手接过杯子,手指碰到杯壁上的冷凝水珠。 色调从清晨冷蓝过渡到温暖的琥珀色。 背景中(轻柔的爵士钢琴渐入)。 [结尾 24-30秒] 镜头缓缓拉远到广角——完整的咖啡店空间: 原木色吧台、黑板菜单、角落里的绿植。 品牌围裙上的 Logo 清晰可见。 阳光已经洒满整个店面。 画面在咖啡杯特写上定格 2 秒,<最后一声杯底轻磕桌面的声音>。 [全片约束] 一镜到底,不切镜头,不跳时间。 咖啡师身份、围裙颜色和 Logo 保持一致。 光照从冷蓝到暖琥珀的渐变过程自然连续。 无字幕,无水印。九、常见踩坑 & 避坑指南
❌ 坑 1:描述一张静止的图
❌ "一个美丽的日落海滩,金色的阳光洒在海面上,椰子树在微风中摇曳"模型不知道这个画面要怎么变。30 秒全是同一帧。
✅ "日落海滩,海浪从画面右侧一层层推向左侧沙滩, 泡沫在湿沙上缓缓消退。椰子树的长影随着太阳下沉在地面上拉长。 固定广角镜头,时间流逝感。"❌ 坑 2:动作太猛太复杂
❌ "主角从楼顶跳到对面楼顶,在空中翻了个后空翻,落地后立刻冲刺"高爆发、大位移的动作在 AI 视频中是重灾区。
✅ "主角站在楼顶边缘深吸一口气(0-3秒), 然后猛地向前踏出一步(3-5秒), 身体腾空的瞬间镜头切换到低角度仰拍——主角从画面上方穿越而过(5-8秒)"❌ 坑 3:I2V 时重新描述图片内容
❌ "@Image 1 是一个穿红裙子的女孩站在花海中, 她缓缓转身看向镜头,裙摆飘动……"前三句在描述图片已有的信息,和参考素材冲突。
✅ "@Image 1 定义女孩的外观、红裙和花海场景。 仅添加动态:她缓缓转身看向镜头(0-5秒), 微风吹动裙摆向右飘动,发丝轻拂脸颊。 摄像机从正面中景缓慢推近至面部特写。 保持女孩身份、红裙样式和花海颜色完全不变。"❌ 坑 4:用"有电影感"代替具体描述
"电影感"三个字对模型约等于什么都没说。替换为:
| 你想表达 | 应该写 |
|---|---|
| “有电影感” | 浅景深 + 2.39:1 宽银幕比例 + 具体光照描述 |
| “高级感” | 低饱和度 + 柔和侧光 + 干净构图 |
| “温暖” | 暖色调 + 金色时刻光线 + 柔焦 |
❌ 坑 5:时间戳过密
❌ "0-1秒抬手,1-2秒转头,2-3秒微笑,3-4秒眨眼……"模型不是逐帧动画工具。时间戳是用来分配大节奏的,不是做逐帧控制的。
✅ "0-5秒:抬头看向窗外,表情从平静转为微微惊讶。 5-10秒:嘴角上扬,眼神变得柔和,缓缓站起身。"十、写提示词的 5 分钟工作流
- 定模式— T2V 还是 I2V?有图用 I2V,没图用 T2V。
- 写一句话— 谁 + 在哪 + 做了什么。先别管镜头和光线。
- 加一个镜头运动— 别写"有电影感",写"缓慢推近"或"从左到右平移"。
- 加一个光源— 光从哪里来,什么颜色,是硬光还是柔光。
- 加一个声音— 哪怕只是一句"安静,只有风声"也好。
完成这 5 步,你就有了一个能用的提示词。之后才是精修——加时间戳、加参考素材、加情绪表演细节。
十一、终极速查表
提示词公式
主体 + 动作 + 场景(可选)+ 视觉风格(可选)+ 摄像机(可选)+ 音频(可选)模式选择
| 你有什么 | 用什么模式 |
|---|---|
| 只有想法,没有素材 | T2V(文本生视频) |
| 有一张图想让画面动起来 | I2V(图片生视频) |
| 有多张图和素材想控制风格 | R2V(参考生视频) |
| 已有视频想改一个局部 | 视频编辑 |
音频括号
| 写什么 | 用什么 |
|---|---|
| 背景音乐 | (钢琴曲) |
| 音效 | <打雷声> |
| 台词 | {你好} |
| 字幕 | 【第一章】 |
摄像机速写
推近 push in | 拉远 pull out | 平移 pan | 环绕 orbit 仰拍 low angle | 俯拍 overhead | 跟拍 follow | 一镜到底 one-take 特写 close-up | 广角 wide shot | 浅景深 shallow depth of field光照速写
基调色(大氛围)+ 次级色(绑主体)+ 强调色(点睛) 光方向:侧光 / 逆光 / 顶光 / 柔光窗 质感:硬光(正午阳光)/ 柔光(阴天/窗帘后) 情绪色:暖橙(温馨)/ 冷蓝(孤独、清晨)/ 青绿(诡异)一句话检查清单
- 主体和动作写清楚了吗?
- 镜头运动写了一个具体的方向/速度吗?
- 光源的方向和颜色写了吗?
- 有声音描述吗(哪怕就一句)?
- I2V 时,是否只写了图片没有的动态信息?
- 有没有用"电影感""高级感"这种空洞词?(有的话替换掉)
恭喜,看到这里你已经具备了用 Seedance 2.5 出片的能力。接下来就是打开即梦或豆包 Pro,选 Seedance 2.5,把这篇教程里任何一个示例改一改贴进去,点生成——你的第一个 AI 视频就好了。
⭐如果你想免费体验Seedance2.5以及享受9折购买优惠,可以注册魔芋AI免费体验Seedance2.5并领取百万token大礼包哦:https://www.moyu.info/register?aff=uZut