
Seedance 2.5 Prompt 指南:官方 @ 引用语法完全拆解
本文系统拆解 Seedance 2.5 官方 @ 引用语法:@图片N / @视频N / @音频N 的使用声明写法、7 种模态组合、50 个参考素材(30 张图 + 10 段视频 + 10 段音频)的规格与配比原则,并附字节跳动实践手册的 5 个原版案例 Prompt,含 32 个参考素材的武侠群像。
你往 Seedance 2.5 里传了三张角色图和一条参考视频,写下「参考 @图片1」,点生成——结果模型把 A 的脸安到了 B 的身上。这类翻车几乎不是模型的锅,而是写法的问题,而字节跳动自己的实践手册里,早就写清楚了怎么避开。这是第一篇系统拆解官方 @ 引用语法的教程:怎么把最多 50 个参考素材(30 张图、10 段视频、10 段音频)逐一绑定到具体角色上,让成片真正贴合你脑子里的那一版。
本文所有内容基于字节跳动官方的 Seedance 2.5 企业级实践手册,并在 Vogoo 的工作台里实机对照过——每一条规格、每一段示例 prompt 都来自该手册或字节的公开发布信息。Seedance 2.5 已于 2026 年 7 月 31 日正式发布,而参考系统是相对 2.0 提升最大的一块:从 9 张图 + 3 段短素材,一跃到 50 个文件的全模态参考栈。
一条规则,能修好大多数写坏的 Seedance prompt
官方手册给出的核心公式其实很朴素:
Prompt = 生成要求(文本)+ 参考素材(@视频N @图片N @音频N)@ 符号的作用是把一个素材「投喂」进这次生成——@图片1、@视频1、@音频1——从而锁定对应的画面或声音信息。
接下来是手册明确写出、也是最多人违反的那条规则。原文的意思是:每引用一个素材,就要紧跟一句使用声明。 当画面里有多个人物或多段视频时,必须把对应关系写明确,否则模型会混淆。手册甚至直接点名了反面写法:那种无头无尾的「参考 @图片1」。
改前——无头无尾的悬空引用(手册明确要避免的写法):
参考 @图片1,参考 @图片2,生成一条广告视频模型完全无从判断:@图片1 是演员、是产品、是场景,还是调色参考?
改后——每个 @ 都带着一句职责声明(官方示例):
以 @图片1 中的女性主角为主体形象,生成其在城市街道漫步的视频一个素材,一份职责,在同一句话里交代完。把这份纪律放大到几十个素材,Seedance 2.5 就能把每张脸、每件道具、每个场景都放回它该在的位置——下文那个 32 个参考素材的武侠案例,做的就是这件事。
Seedance prompt 语法:八类参考任务
实践手册把「参考生成」拆成了若干子能力,每一类都有自己的声明范式。这些官方给出的一句话写法,值得直接当模板存下来:
| 参考任务 | 手册给出的官方 prompt 写法 |
|---|---|
| 主体参考 | 以 @图片1 中的女性主角为主体形象,生成其在城市街道漫步的视频 |
| 运动 / 运镜参考 | 参考 @视频1 的运镜方式与主角奔跑节奏,主体形象采用 @图片1,重新生成一条产品广告 |
| 白模参考 / 渲染 | 基于 @视频1 白模的运动轨迹渲染成片,主体形象参考 @图片1,场景参考 @图片2 |
| 风格参考 | 画面风格参考 @视频1 的冷蓝夜景与颗粒感调色,主角形象参考 @图片1 |
| 音频参考 | 音乐氛围参考 @音频1,画面主体参考 @图片1,生成一条节奏契合的短片 |
| 宫格分镜 / 故事板参考 | 依据 @图片1 的四宫格分镜顺序展开,主角形象参考 @图片2,逐格推进主角的一天 |
| 关键帧参考 | 以 @图片1 为首帧、@图片2 为尾帧,中间补全主角由室内走向室外的过渡 |
| 一键成片 | 将 @视频1、@视频2、@图片1 依次串联为短片,加入片头文字与转场 |
注意每一行里重复出现的同一种结构:@素材 + 职责动词 + 它控制什么。这就是全部语法了——除了 @ 之外没有任何标记,绑定关系完全靠你附在后面的那句话。
视频编辑与延长走的是变体公式——修改要求(文本)+ @视频1(原片)+ 可选 @图片N / @音频N——这时模型会依据原片自动锁定画幅比例与时长。如果你之前只用过纯 文生视频 或单图 图生视频,那 @ 引用就是把它们升级成可控 参考生视频 管线的那一层。
7 种模态组合
Seedance 2.5 接受下面这 7 种参考组合,其中「只参考音频」是 2.5 新增的:
| # | 组合 | 2.5 新增? | 典型用途 |
|---|---|---|---|
| 1 | 只参考图片 | — | 角色 / 产品 / 场景锁定、分镜、关键帧 |
| 2 | 只参考视频 | — | 运动、镜头语言、风格、白模转绘 |
| 3 | 只参考音频 | 是,本次新增 | 用 BGM 或人声驱动节奏、卡点、口型对齐 |
| 4 | 图片 + 视频 | — | 主体来自静帧,运动来自参考片 |
| 5 | 音频 + 视频 | — | 运动参考按配乐节奏来剪 |
| 6 | 图片 + 音频 | — | 用角色设定图加一段音乐做 MV |
| 7 | 图片 + 音频 + 视频 | — | 全模态大制作(下文的旗舰案例) |
如果你做的是音乐驱动型内容,「只参考音频」是最值得先试的一种组合——不给任何画面参考,单靠一段音轨就能带动节奏、剪辑点和嘴部动作。它天然适合 AI 音乐视频生成 的工作流,而人声驱动的场景则和 AI 对口型 高度重叠。
参考素材规格:到底能传多少
手册里给出的硬性上限如下:
| 模态 | 数量 | 单文件大小 | 格式 | 时长规则 |
|---|---|---|---|---|
| 图片 | 0–30 张 | 见手册的上传限制 | 常见图片格式 | — |
| 视频 | 0–10 段 | ≤ 200MB,480p–4K | mp4、mov | 单段 2–30s,全部视频总时长 ≤ 30s |
| 音频 | 0–10 段 | ≤ 15MB | mp3、wav | 单段 2–30s,全部音频总时长 ≤ 30s |
两个容易被漏掉的细节:视频时长与音频时长是分开计算的——同一次生成里,你可以传满 30 秒参考视频,同时再传满 30 秒参考音频。作为对照,Seedance 2.0 支持 9 张图、视频与音频各 3 段、总时长 15 秒;2.5 把这些数字抬到了 30 张图、各 10 段、总时长各 30 秒。
参考素材怎么配比(手册 2.3 节)
有 50 个位置,不代表你该把 50 个位置塞满。手册专门用一节讲了他们团队经大量评测验证得到的结论:
- 避开极端的素材时长。 大约 2 秒的参考片段信息量不足、特征不完整,模型难以稳定识别;而整整 30 秒的长片段又容易稀释关键特征、引入噪声。把参考片段控制在 2–30s 区间的中段最稳。
- 5 个主体是「多视图」的分水岭。 主体图 ≤ 5 张时,单视图、多视图都可以;超过 5 个主体后,单视图更稳定——而且如果你需要同一主体的多个角度,应该拆成多张不同视图分别上传,而不是把多视角塞进一张拼图里。
- 素材偏多、担心超载时,按这个优先级取舍: 核心角色 > 关键产品 / 道具 > 场景环境 > 整体风格。
- 搞清楚什么算「主体」。 手册的定义是:画面里希望模型稳定还原、贯穿全片的核心元素。在「一个人在森林里拉弓射中一只兔子」这句描述里,人、弓箭、兔子是三个各自独立的主体,每个都需要稳定的参考。
想不折腾环境就把这些规则试一遍?你可以直接 在 Vogoo 上免费试用 Seedance 2.5——30 秒一镜直出、最高 4K、原生同步音频,单次最多 50 个参考素材,浏览器里就能跑。
五个官方案例,从 1 个参考到 32 个
下面都是实践手册里字节自己的演示,手册公开了 prompt 的地方,就直接给出原文。
1. 多模态参考:创意迁移 + 资产锁定
一条参考视频负责提供创意,四张图负责锁定资产。每一项的声明都只有一个短句:
参考@视频1的创意生成视频,要求 还原@图片1 @图片2 @图片3 @图片4 房子组装全过程。Seedance 2.5 官方演示 —— 字节跳动 / 火山引擎实践手册。
注意这里的结构:被承接的不只是参考图的外观,还有参考视频里的那套搭建逻辑。
2. 全模态参考:同一主体跨多个场景
手册里的石榴案例,展示的正是多模态参考存在的理由:同一个主体穿过多个场景,形象与风格始终统一——因为图片、视频、音频构成的参考栈,在生成一开始就把它定义清楚了,管住了整条片子。
Seedance 2.5 官方演示 —— 字节跳动 / 火山引擎实践手册。
3. 32 个参考素材的武侠群像
这是压力测试:32 个参考素材——角色图、道具图、场景图、音效片段,外加一条特效参考视频——按时间戳分段逐一绑定。官方 prompt 节选:
[0-3s] 近景拍摄,镜头聚焦在 @图1 正在拨动 @图2 古琴琴弦的手上。左侧一尊青铜香炉
@图3 青烟袅袅。背景中,一名白衣男子 @图4 模糊的身影正在吹奏 @图5。音效参考 @音效1,
场景设定在水面 @图6 的小船 @图7 上,远景的山参考 @图8。
[3-5s] 白衣男子 @图4 立于船头……一个圆形异象,@图9 的女子持 @图10 袭来,
音效参考 @音效2。
[5-10s] 白衣男子与红衣女子在湖面上空激烈交火,音效参考 @音效3。红衣女子持红伞,
男子持扇 @图11。下方的水面被强大的真气激起巨大的环状浪花,音效参考 @音效4,
如同一场水之风暴,特效参考 @视频1。Seedance 2.5 官方演示 —— 字节跳动 / 火山引擎实践手册;prompt 为手册原文节选。
32 个参考素材遵守的全是本文开头那条规则:@ 之后立刻跟一句使用声明——正是它让两位对打的主角、他们各自的兵器和四段音效互不串味。
4. 群舞多角色:纪实感与一致性
手册里也给出了英文写法——prompt 用什么语言并不改变 @ 的机制(Seedance 2.5 原生支持 10 余种语言)。这条街头群舞 prompt 的开头是:
Create a 30-second video with realistic cinematic texture, 16:9 aspect ratio,
documentary street photography style, warm and everyday lifelike atmosphere.
Street scene environment references @image1: late-afternoon street corner,
red brick buildings, pedestrian zebra crossings, storefronts along the road,
roadside vehicles and passersby, soft directional afternoon sunlight,
transparent natural color tones without heavy color grading filters.Seedance 2.5 官方演示 —— 字节跳动 / 火山引擎实践手册。
还是同一个套路:@image1 后面紧跟一个冒号,然后是它控制什么的完整声明——环境细节一路写到光线方向。
5. 概念短片:30 秒直出里的关键帧参考
关键帧参考是这套语法最轻量的用法——两张图,两句声明:
电影级品牌概念短片。@图片1为首帧,画面微微晃动,镜头逐渐推近,来到窗外快速后退的树影,
树影后退速度越来愈快,突然切到@图片2,速度突然放缓,镜头顺着溪流缓缓前进,鸟语花香。Seedance 2.5 官方演示 —— 字节跳动 / 火山引擎实践手册(prompt 为手册原文)。
@ 引用到底特别在哪
大多数视频模型对参考素材的处理是隐式的:你挂一张图,模型自己猜它是干嘛的。Seedance 2.5 把这层绑定变成了显式且可扩展的:
| 做法 | 绑定方式 | 规模 | 失败模式 |
|---|---|---|---|
| 纯文本 prompt | 没有绑定,只有描述 | 0 个参考 | 每次生成主体都在漂移 |
| 隐式图片条件 | 模型自己猜这张图的职责 | 通常 1 到几张图 | 角色分配错位 |
| Seedance 2.5 @ 语法 | 你在句子里声明每个文件的职责 | 最多 50 个文件、3 种模态 | 只有漏写声明时才会崩 |
最后一格是这套语法诚实的代价:它把责任转移给了你。声明一旦省掉,50 个参考素材的表现还不如 5 个写清楚职责的。
常见 prompt 错误与对应改法
- 悬空的 @ —— 「参考 @图片1」前后什么都没有。改法:每一次都在同一句话里给它一个职责。
- 多角色没有对应关系 —— 五张演员图,却没说谁是谁。改法:像手册里的群像 prompt 那样,逐个角色写明映射。
- 参考素材硬塞 —— 「以防万一」把 50 个位置全填满。改法:按优先级取舍(角色 > 道具 > 场景 > 风格)。
- 素材时长走极端 —— 拿 2 秒碎片或整段 30 秒当参考。改法:用中等长度、关键特征清晰可见的片段。
- 给大群角色用拼图 —— 一张图里塞六个角色。改法:超过 5 个主体,就一个主体一张单视图。
- 把编辑公式和参考公式混着用。 改法:参考类 prompt 是用素材生成新画面;视频转视频 的编辑类 prompt 是修改 @视频1,并锁定其余部分不变。
常见问题
Seedance 2.5 的 prompt 里怎么引用一张图?
用 @ 符号加上素材序号——@图片1——然后立刻跟一句声明它职责的话,例如「以 @图片1 中的女性主角为主体形象」。官方手册明确写了:缺了这句声明,模型会混淆。
Seedance 2.5 最多能传多少个参考素材?
单次生成最多 50 个:30 张图、10 段视频、10 段音频。单段视频 2–30 秒,全部视频总时长上限 30 秒;音频有自己独立的 30 秒上限。
Seedance 2.5 能只靠音频生成视频吗?
可以,「只参考音频」是 2.5 新增的能力。一段音乐、一句人声或一段音效底噪,就能驱动成片的节奏、卡点与口型对齐,完全不需要挂任何画面参考。
为什么 Seedance 会把我的角色搞混?
绝大多数情况是:参考素材列上去了却没写职责声明,或者传了多角色阵容却没有明确的谁是谁映射。改法是每个 @ 都写声明,并且超过五个主体时,一个角色一张单视图。
Seedance 2.5 的 prompt 用英文写有效吗?
有效。模型原生支持 10 余种语言,包括中文、英语、西班牙语、日语、阿拉伯语等,@ 语法在所有语言里的行为完全一致。
参考类 prompt 和编辑类 prompt 有什么区别?
参考类 prompt 是在你的素材引导下生成全新画面(文本指令 + @ 参考素材)。编辑类 prompt 则是把已有片子作为 @视频1 喂进去,只描述局部改动,此时模型会依据原片自动锁定画幅比例与时长。
写在最后
@ 引用语法才是 Seedance 2.5 真正的操作界面——30 秒一镜直出和 4K 输出更容易上头条,但让结果可复现、可导演的,是那个 50 个素材的参考栈。整套体系其实收敛成一个习惯:写 @ 就一定带声明,角色一多就逐个写明映射。再按手册的优先级去配比素材、而不是把位置填满,你就能拿到武侠和群像案例里那种一致性。养成这个习惯最快的方式是多练:打开 Vogoo 上的 Seedance 2.5——免费试用、最高 4K、原生同步音频、单次最多 50 个参考素材——先从「一张主体图 + 一条写明职责的运动参考」开始,再逐步加码。
Sources
- 字节跳动 Seedance 2.5 企业级实践手册(飞书 wiki) —— 一手来源:@ 语法规则、参考素材规格、配比建议(2.3 节),以及本文引用的全部案例 prompt(需登录)。
- Seedance 2.5 —— 一镜直出、灵活参考(字节跳动 Seed 博客) —— 官方发布公告:30 图 / 10 视频 / 10 音频的参考栈、30 秒单段直出、2026 年 7 月 31 日上线。
- Seedance 2.5 官方页面(字节跳动 Seed) —— 产品定位:音视频联合生成、参考理解、延长能力。
- Seedance 2.0 官方页面(字节跳动 Seed) —— 2.0 到 2.5 参考容量对比的基线数据。
- 字节跳动发布 Seedance 2.5 视频生成模型 —— TechNode —— 独立媒体报道,交叉验证发布日期、30 秒一镜直出与参考素材数量。
- ByteDance Unveils Seedance 2.5 Video Model —— The Information —— 商业媒体对本次发布的确认。
- Seedance 2.0 —— 维基百科 —— Seedance 产品线与 2026 年 2 月前代版本的背景资料。
- 字节即梦 Seedance 2.0 接入 CapCut —— TechCrunch —— 即梦与 Seedance 品牌关系及全球分发的背景。
- 好莱坞对新版 Seedance 2.0 视频生成器并不买账 —— TechCrunch —— 该模型系列真实感与外界反响的背景。
- 豆包 Seedance SDK 教程 —— 火山方舟文档 —— Seedance API 接入所在的方舟平台文档体系。
关于来源的说明:参考素材规格、@ 声明规则、配比建议以及文中引用的全部 prompt,均来自字节跳动官方企业级实践手册(上方一手来源);发布相关事实与 Seed 博客及独立媒体报道交叉核对。截至撰稿时,Seedance 2.5 尚未公布模型 API 定价,因此本文不给出任何价格数字。
作者

分类
更多文章

Seedance 2.5 视频编辑完全指南
Seedance 2.5 视频编辑怎么做:用三步提示词写法喂入原片、圈定要改的对象、锁死其余画面,从加特效、换服装、切画风到改年龄一次搞定,附 7 组官方 prompt、可复用模板与自动锁定的画幅时长规则,全部案例均出自字节跳动官方实践手册。


音频生成视频:Seedance 2.5 的纯音频参考模式
Seedance 2.5 首次支持只参考音频:上传一段 BGM、人声或音效即可驱动画面节奏、卡点剪辑与口型对齐。本文梳理官方音频规格(mp3/wav、15MB、2~30 秒、最多 10 段)与 7 种模态组合,并附 5 个官方案例的原版中文提示词与可复用工作流。


Seedance 2.5 视频续写延长完全指南
用 Seedance 2.5 延长 AI 视频的完整方法:把已有片段作为 @视频1 喂回模型做原生时序延长,逐条拆解字节官方四段链式续写案例的中文 prompt 原文,讲清续写公式、自动锁定的画幅与时长规则、首尾帧画幅坑,以及什么时候 30 秒一镜到底比续写更划算。

邮件列表
加入我们的社区
订阅邮件列表,及时获取最新消息和更新