全能参考总纲:Seedance 2.0 四种模态分别能参考什么
"全能参考"是 Seedance 2.0 官方口径里最大的亮点:打破素材边界,让任何模态都能当"参照物"。这一页先给全景地图,具体玩法见本组各分页。
参考能力的本质
官方提示词指南的表述是:"通过投喂素材来锁定画面的理想标准态。"你不再只能用文字描述想要什么,而是给模型看样东西,说'照这个感觉来'。模型自动提取参考对象的核心特征,结合文本描述进行创作。
四类参考各管什么
| 参考类型 | 可继承的核心特征 | 典型场景 |
|---|---|---|
| 图片 | 角色形象、视觉风格、画面构图、商品细节 | 角色一致性、风格迁移、产品展示 |
| 视频 | 主体内容、运镜方式、动作表现、整体风格、特效 | 运镜复刻、动作模仿、特效嫁接 |
| 音频 | 音色、音乐旋律、对话内容 | 定制配音、BGM 卡点、声音一致性 |
| 视频(作声音源) | 视频里的音轨 | 没有独立音频文件时直接借声 |
指代是前提
素材上传后必须在提示词中点名才能生效——这是全能参考与旧版"传图即用"的根本区别:
- 即梦站内用 @素材名:@图片1 作为首帧、@视频1 参考运镜。
- API 端用编号指代:画面参考图片1的构图、动作参考视频2。
官方定义的能力公式
即梦官方把 2.0 的多模态升级概括为一个等式:
Seedance 2.0 = 多模态参考(什么都能参考)+ 强创意生成(画面质量)+ 精准指令响应(听得懂复杂脚本)
三条腿缺一不可:只给素材不给指令,模型不知道参考哪部分;只有指令没有素材,一致性全靠运气。
常见的参考组合套路
- 角色 + 场景:人物图定角色,场景图定环境,各归各的岗位。
- 动作 + 特效:参考 A 视频的打斗动作,参考 B 视频的粒子特效,人物来自图片。
- 分镜脚本 + 素材:一张文字分镜图定叙事结构,角色图、场景图、道具图填充细节。
下一步
能力框架整理自即梦官方使用指南与火山引擎官方提示词指南,以官方最新版为准。