Seedance 2.0 使用指南:解决角色漂移、参考素材与多镜头提示词问题
Vincent8 分钟阅读 ·

使用 Seedance 2.0 最难的部分,是让多镜头视频中的角色、参考素材和镜头保持一致。 当各镜头之间的身份参考发生变化时,角色往往会漂移;相互冲突的图像、视频和文字指令,则会让动作、运镜和环境更难预测。 单纯加长提示词通常无法解决这个问题。
随着项目扩大,这些问题可能导致面孔变化、服装不稳定、连续性中断以及更高的 Seedance 2.0 生成成本。 关键是明确哪一份参考负责控制身份、环境、动作、镜头和音频,而不是让多种输入争夺同一个角色。
使用 Seedance 2.0 最可靠的方法,是把它当作多模态导演工作流程:用图像控制身份、视频参考控制动作和运镜、音频控制时序,再用结构化多镜头提示词或分镜保持连续性。Virse 可在一张无限画布上组织参考、分镜和素材,而共享项目上下文能让较长项目中的审美偏好、品牌标准和创作决策始终一致。
Seedance 2.5、Seedance 2.0 和 MiniMax H3 现已上线 Virse,团队因此可以在同一个创作流程中探索和比较多款领先的视频模型。

如何逐步使用 Seedance 2.0
可靠的 Seedance 2.0 工作流程会将规划、参考、生成和后期分开,而不是用一条提示词解决所有问题。
- 定义镜头:主体、环境、动作、镜头、时长和风格。
- 分配参考职责:确定哪项输入控制身份、环境、动作、镜头和音频。
- 编写用于协调的提示词:解释相互关系,而不是重复参考中已经能看见的信息。
- 创建时间线:按时间顺序将多镜头视频拆成镜头。
- 先做简单测试:增加复杂度前,先验证身份和动作。
- 有选择地重试生成:重新生成失败镜头,而不是重做整个段落。
- 后期放在最后:动作确认通过后再放大分辨率和剪辑。
这种方法之所以有效,是因为 Seedance 2.0 官方支持文字、图像、视频和音频多模态输入,而不只是依赖文字。
如何使用 Seedance 2.0 参考素材
参考素材的职责分配比参考数量更重要。每项输入都应有一个明确的主要职责。
输入 | 最佳职责 |
图像 1 | 角色身份 |
图像 2 | 产品或物体 |
图像 3 | 环境 |
视频 1 | 身体动作 |
视频 2 | 镜头运动 |
音频 1 | 节奏或表演时序 |
提示词 | 映射、时间线和约束 |

Seedance 2.0 能使用多少参考素材?
Seedance 2.0 目前在多模态流程中支持最多九张图像参考、三段视频参考和三段音频参考。参考视频的总时长最多为 15 秒,音频参考总时长也最多为 15 秒。音频不能作为唯一的参考输入。
输入更多并不一定更好。职责冲突会造成歧义。生成之前,你应该准确知道哪一份参考负责身份、环境、动作和镜头。
一条实用原则是:参考负责提供信息,提示词负责分配职责。

如何为多镜头视频编写 Seedance 2.0 提示词
好的 Seedance 提示词会定义有哪些事物、什么会变化、何时变化,以及什么必须保持不变。
对于单个镜头,围绕以下内容组织信息:主体、环境、动作、镜头、光照或风格,以及约束。
为什么镜头清单优于大段长提示词
将空间和时间指令混在一段文字中,会让多镜头提示词更难控制。
更好的方法是只定义一次角色和环境,然后按时间顺序安排动作:
主体:同一角色、面孔、发型和服装。
环境:同一地点和光照。
镜头 1,0–5 秒:全景,角色进入,缓慢向前轨道移动。
镜头 2,5–10 秒:侧面中景,镜头在一旁跟拍。
镜头 3,10–15 秒:近景,角色停下,镜头轻微推进。
约束:不出现重复角色,不更换服装或地点,不发生意外切镜。
在一例有记录的制作案例中,一条结构化提示词生成了七个镜头。另一位创作者的工作流程发现,大约六至八个镜头更容易管理,当段落中的镜头更加密集时,不稳定性也会增加。这些是实践观察,而不是官方模型限制。
如何将分镜与 Seedance 2.0 结合使用
先做分镜,可以减少仅为测试构图而进行的高成本视频生成。
分镜可以在开始生成动作前,锁定取景、角色位置、镜头顺序、运镜方向和切镜密度。
分镜制作案例说明了什么
一个工作流程使用 GPT Image 2 创建了 3×3 分镜,随后生成一段 15 秒、16:9 的视频。创作者表示,这一次具体流程不到四分钟就完成,且认为全部输出都可用。
另一个案例使用了4×4、共 16 格的分镜,包含全景、中景、近景、特写以及镜头和动作指示。另一个独立的45 秒、八场景流程先完善故事和预览图,再把通过确认的场景送入 Seedance 2.0 Fast。
这些是个别案例,而不是基准测试,但流程启示十分明确:不要花视频积分来发现基础构图问题。

如何在 Seedance 2.0 中保持角色一致性
角色一致性会在每个片段都锚定同一份稳定身份参考时得到提升。
重复使用同一份高质量角色参考,保持描述一致,避免引入意外重新定义面孔、服装或比例的新参考。
为什么长项目中的角色漂移更严重
创作者测试表明,与中景相比,大特写和大幅取景变化可能暴露更多身份差异。应将其视为制作观察,而不是模型必然出现的行为。
一个时长 3:24、约 30 个镜头的音乐视频项目提供了有用的规模示例。某些高难度运镜需要重试生成六至八次。启示是:在一个片段中保持身份与在 30 个镜头中保持身份,是根本不同的制作问题。
对于长项目,应持续检查连续性,而不是等到最后再修复。
如何使用 Seedance 2.0 音频参考与唇形同步
音频参考可以引导节奏、表演、氛围和对白时序,但不应假设它会原样透传音频。
本指南审阅的一个工作流程提供了一条已制作完成的 ElevenLabs 音轨,并期望声音、文字和时序保持不变。结果中仍有部分被重新演绎。
对于必须精确到帧的对白,应先验证流程,再扩大制作规模。
如何为音乐视频编写提示词
如果音频已经包含歌词和节奏,应让视觉提示词着重描述表演、动作和镜头方向,而不是重新描述每一句歌词。
这遵循同样的参考原则:避免让文字、音频和视频争夺对同一信息的控制。
如何使用 Seedance 2.0 编辑和延长视频
Seedance 2.0 不仅能生成新片段,其官方能力还包括视频编辑和延长。
这让已有素材也能成为起点。参考驱动的编辑可以在改变视觉内容时保留动作或结构,Seedance 2.x 的官方能力同时包含Edit Video(编辑视频)和Extend Video(延长视频)。
这对以下工作流程很有用,例如更换角色或产品、替换视觉元素、改造现有场景,或者延长选定片段,而不是重新生成整个段落。
从制作角度看,一旦动作和构图已达到要求,编辑往往比从头开始更高效。
为什么 Seedance 2.0 会拒绝某些真人参考?
真人参考被拒绝,可能是政策问题,而不是提示词问题。
BytePlus 文档指出,Seedance 2.x 不直接支持包含真实人脸的普通参考图像或视频。对于获得授权的肖像,BytePlus 提供基于白名单的素材库流程,其中获批的参考素材需上传后,通过相应素材 ID 进行引用。
这对UGC、网红、代言人及企业广告流程非常重要。在围绕某个人物制作整套分镜前,应确认肖像授权要求,避免该人物无法通过你选择的 Seedance 流程使用。
反复改写提示词无法解决政策层面的限制。
如何在 Runway 上高效使用 Seedance 2.0
Runway 目前通过References、Start/End Frames 和 Text-to-Video提供 Seedance,支持 5–15 秒输出以及 480p、720p 和 1080p 选项。1080p 目前需要 Credits Mode。

最终输出前,先以更低成本探索
一个制作流程花了大约三小时在 720p 下迭代,然后将选中的素材放大到 4K。其背后的策略很有价值:在投入资源制作最终输出前,先验证动作和构图。
更重要的指标是每个可用片段的成本,而不是每次生成的价格。
一个高迭代案例生成了接近100 段 15 秒视频,其中八段获批,这是基于该创作者的质量门槛。另一位创作者称为商业项目制作了 300 多段片段。这些案例不应被解读为平均成功率;它们说明可用产出率会随任务大幅变化。
其他有记录的案例包括约 40 分钟完成、花费不到 20 美元的打斗段落、约耗时一小时的情绪场景,以及一天内完成、花费不到 200 美元的时间旅行段落。
截至 2026 年 8 月 24 日,现有 Runway Unlimited 订阅保留至 8 月 31 日,并于 9 月 1 日转为 Max。Max 目前包含每月 9,500 积分,面向高用量用户,取代 Unlimited 以 Explore 为核心的模式。

Seedance 2.0 平台对比:BytePlus、Runway 与 OpenArt
选择Seedance 平台时应根据工作流程,而不是假设每个平台都开放相同的模型能力。
平台 | 最适合 | 主要优势 |
BytePlus | API 与企业团队 | 官方能力与输入文档 |
Runway | 创意制作 | 参考、帧控制与创作者流程 |
OpenArt | 易于上手的探索 | 简化的第三方界面 |
我们的文档审阅发现,第三方对某些 Seedance 时长和分辨率的说法互相矛盾。更稳妥的原则是:原生模型能力以 BytePlus 为准,Runway 特有行为以 Runway 为准,第三方文档仅用于了解该平台自身的实现。
区分模型与平台,可以避免把界面限制误称为 Seedance 本身的限制。
结论
Seedance 2.0 最适合作为精心组织参考素材的制作系统,而不是只靠一条提示词的视频生成器。用图像锚定身份,用视频参考传达复杂动作和运镜,用音频提供时序与表演上下文,用镜头清单构建时间结构,用分镜在高成本生成前解决构图问题。对于较长的项目,应持续管理角色连续性,在无需重做时采用编辑或延长,并按可用素材而非生成次数衡量成本。真正的技巧不是写更多提示词,而是为 Seedance 提供更清晰的身份、动作、时序和约束结构。
常见问题
Seedance 2.0 能使用多少参考素材?
Seedance 2.0 目前在文档说明的多模态流程中支持最多九张图像参考、三段视频参考和三段音频参考。视频参考总时长最多为 15 秒,音频参考总时长也最多为 15 秒。具体控制选项可能因平台而异。
为什么我的角色在不同 Seedance 片段之间总是变化?
最常见的流程原因包括身份参考不一致、视觉输入相互竞争、反复重新设计角色,以及大幅改变取景。在整个项目中重复使用一份主要角色参考,保持描述稳定,并在每组镜头后检查身份,而不是等到最终剪辑时才检查。
我应该使用分镜还是多镜头提示词?
当段落简单、镜头顺序已明确时,可使用结构化多镜头提示词。当构图、场面调度、动作编排或连续性需要视觉验证时,应使用分镜。对于复杂作品,最有力的流程是结合两者:先做分镜,再按时间顺序给出镜头指令。
为什么 Seedance 会拒绝某些真人参考?
真人参考可能受到基础服务或运行该服务的平台限制。BytePlus 目前在文档中为获批的真人肖像素材提供授权素材库流程。如果制作依赖特定人物,应在扩大流程规模前确认授权要求,而不是把反复审核失败当作提示词问题。
更多 Virse 博客文章
工作流

GPT Image 2.5 Noise and Oversharpening: Why Some Images Still Look AI-Generated
2026年10月9日 by Yifan Zhao
工作流

GPT Image 2.5 Keeps Changing My Image: How to Use a "Keep List" for Reliable Edits
2026年10月9日 by Yifan Zhao
工作流

GPT Image 2.5 Editing Drift: Why Images Get Blurry, Cropped or Worse After Multiple Edits
2026年10月9日 by Yifan Zhao