Seedance 2.0 使用指南:解决角色漂移、参考素材与多镜头提示词问题

Vincent8 分钟阅读 ·

Seedance 2.0 使用指南:解决角色漂移、参考素材与多镜头提示词问题

使用 Seedance 2.0 最难的部分,是让多镜头视频中的角色、参考素材和镜头保持一致。 当各镜头之间的身份参考发生变化时,角色往往会漂移;相互冲突的图像、视频和文字指令,则会让动作、运镜和环境更难预测。 单纯加长提示词通常无法解决这个问题。

随着项目扩大,这些问题可能导致面孔变化、服装不稳定、连续性中断以及更高的 Seedance 2.0 生成成本。 关键是明确哪一份参考负责控制身份、环境、动作、镜头和音频,而不是让多种输入争夺同一个角色。

使用 Seedance 2.0 最可靠的方法,是把它当作多模态导演工作流程:用图像控制身份、视频参考控制动作和运镜、音频控制时序,再用结构化多镜头提示词或分镜保持连续性。Virse 可在一张无限画布上组织参考、分镜和素材,而共享项目上下文能让较长项目中的审美偏好、品牌标准和创作决策始终一致。

Seedance 2.5、Seedance 2.0 和 MiniMax H3 现已上线 Virse,团队因此可以在同一个创作流程中探索和比较多款领先的视频模型。

Virse 创作工作界面

如何逐步使用 Seedance 2.0

可靠的 Seedance 2.0 工作流程会将规划、参考、生成和后期分开,而不是用一条提示词解决所有问题。

  1. 定义镜头:主体、环境、动作、镜头、时长和风格。
  2. 分配参考职责:确定哪项输入控制身份、环境、动作、镜头和音频。
  3. 编写用于协调的提示词:解释相互关系,而不是重复参考中已经能看见的信息。
  4. 创建时间线:按时间顺序将多镜头视频拆成镜头。
  5. 先做简单测试:增加复杂度前,先验证身份和动作。
  6. 有选择地重试生成:重新生成失败镜头,而不是重做整个段落。
  7. 后期放在最后:动作确认通过后再放大分辨率和剪辑。

这种方法之所以有效,是因为 Seedance 2.0 官方支持文字、图像、视频和音频多模态输入,而不只是依赖文字。

如何使用 Seedance 2.0 参考素材

参考素材的职责分配比参考数量更重要。每项输入都应有一个明确的主要职责。

输入

最佳职责

图像 1

角色身份

图像 2

产品或物体

图像 3

环境

视频 1

身体动作

视频 2

镜头运动

音频 1

节奏或表演时序

提示词

映射、时间线和约束

Seedance 2.0 多模态参考数量上限

Seedance 2.0 能使用多少参考素材?

Seedance 2.0 目前在多模态流程中支持最多九张图像参考、三段视频参考和三段音频参考。参考视频的总时长最多为 15 秒,音频参考总时长也最多为 15 秒。音频不能作为唯一的参考输入。

输入更多并不一定更好。职责冲突会造成歧义。生成之前,你应该准确知道哪一份参考负责身份、环境、动作和镜头。

一条实用原则是:参考负责提供信息,提示词负责分配职责。

Seedance 2.0 时长限制

如何为多镜头视频编写 Seedance 2.0 提示词

好的 Seedance 提示词会定义有哪些事物、什么会变化、何时变化,以及什么必须保持不变。

对于单个镜头,围绕以下内容组织信息:主体、环境、动作、镜头、光照或风格,以及约束。

为什么镜头清单优于大段长提示词

将空间和时间指令混在一段文字中,会让多镜头提示词更难控制。

更好的方法是只定义一次角色和环境,然后按时间顺序安排动作:

主体:同一角色、面孔、发型和服装。

环境:同一地点和光照。

镜头 1,0–5 秒:全景,角色进入,缓慢向前轨道移动。

镜头 2,5–10 秒:侧面中景,镜头在一旁跟拍。

镜头 3,10–15 秒:近景,角色停下,镜头轻微推进。

约束:不出现重复角色,不更换服装或地点,不发生意外切镜。

在一例有记录的制作案例中,一条结构化提示词生成了七个镜头。另一位创作者的工作流程发现,大约六至八个镜头更容易管理,当段落中的镜头更加密集时,不稳定性也会增加。这些是实践观察,而不是官方模型限制。

如何将分镜与 Seedance 2.0 结合使用

先做分镜,可以减少仅为测试构图而进行的高成本视频生成。

分镜可以在开始生成动作前,锁定取景、角色位置、镜头顺序、运镜方向和切镜密度。

分镜制作案例说明了什么

一个工作流程使用 GPT Image 2 创建了 3×3 分镜,随后生成一段 15 秒、16:9 的视频。创作者表示,这一次具体流程不到四分钟就完成,且认为全部输出都可用。

另一个案例使用了4×4、共 16 格的分镜,包含全景、中景、近景、特写以及镜头和动作指示。另一个独立的45 秒、八场景流程先完善故事和预览图,再把通过确认的场景送入 Seedance 2.0 Fast。

这些是个别案例,而不是基准测试,但流程启示十分明确:不要花视频积分来发现基础构图问题。

已记录的 Seedance 工作流程规模

如何在 Seedance 2.0 中保持角色一致性

角色一致性会在每个片段都锚定同一份稳定身份参考时得到提升。

重复使用同一份高质量角色参考,保持描述一致,避免引入意外重新定义面孔、服装或比例的新参考。

为什么长项目中的角色漂移更严重

创作者测试表明,与中景相比,大特写和大幅取景变化可能暴露更多身份差异。应将其视为制作观察,而不是模型必然出现的行为。

一个时长 3:24、约 30 个镜头的音乐视频项目提供了有用的规模示例。某些高难度运镜需要重试生成六至八次。启示是:在一个片段中保持身份与在 30 个镜头中保持身份,是根本不同的制作问题。

对于长项目,应持续检查连续性,而不是等到最后再修复。

如何使用 Seedance 2.0 音频参考与唇形同步

音频参考可以引导节奏、表演、氛围和对白时序,但不应假设它会原样透传音频。

本指南审阅的一个工作流程提供了一条已制作完成的 ElevenLabs 音轨,并期望声音、文字和时序保持不变。结果中仍有部分被重新演绎。

对于必须精确到帧的对白,应先验证流程,再扩大制作规模。

如何为音乐视频编写提示词

如果音频已经包含歌词和节奏,应让视觉提示词着重描述表演、动作和镜头方向,而不是重新描述每一句歌词。

这遵循同样的参考原则:避免让文字、音频和视频争夺对同一信息的控制。

如何使用 Seedance 2.0 编辑和延长视频

Seedance 2.0 不仅能生成新片段,其官方能力还包括视频编辑和延长。

这让已有素材也能成为起点。参考驱动的编辑可以在改变视觉内容时保留动作或结构,Seedance 2.x 的官方能力同时包含Edit Video(编辑视频)和Extend Video(延长视频)。

这对以下工作流程很有用,例如更换角色或产品、替换视觉元素、改造现有场景,或者延长选定片段,而不是重新生成整个段落。

从制作角度看,一旦动作和构图已达到要求,编辑往往比从头开始更高效。

为什么 Seedance 2.0 会拒绝某些真人参考?

真人参考被拒绝,可能是政策问题,而不是提示词问题。

BytePlus 文档指出,Seedance 2.x 不直接支持包含真实人脸的普通参考图像或视频。对于获得授权的肖像,BytePlus 提供基于白名单的素材库流程,其中获批的参考素材需上传后,通过相应素材 ID 进行引用。

这对UGC、网红、代言人及企业广告流程非常重要。在围绕某个人物制作整套分镜前,应确认肖像授权要求,避免该人物无法通过你选择的 Seedance 流程使用。

反复改写提示词无法解决政策层面的限制。

如何在 Runway 上高效使用 Seedance 2.0

Runway 目前通过References、Start/End Frames 和 Text-to-Video提供 Seedance,支持 5–15 秒输出以及 480p、720p 和 1080p 选项。1080p 目前需要 Credits Mode。

Runway Seedance 2.0 分辨率选项

最终输出前,先以更低成本探索

一个制作流程花了大约三小时在 720p 下迭代,然后将选中的素材放大到 4K。其背后的策略很有价值:在投入资源制作最终输出前,先验证动作和构图。

更重要的指标是每个可用片段的成本,而不是每次生成的价格。

一个高迭代案例生成了接近100 段 15 秒视频,其中八段获批,这是基于该创作者的质量门槛。另一位创作者称为商业项目制作了 300 多段片段。这些案例不应被解读为平均成功率;它们说明可用产出率会随任务大幅变化。

其他有记录的案例包括约 40 分钟完成、花费不到 20 美元的打斗段落、约耗时一小时的情绪场景,以及一天内完成、花费不到 200 美元的时间旅行段落。

截至 2026 年 8 月 24 日,现有 Runway Unlimited 订阅保留至 8 月 31 日,并于 9 月 1 日转为 Max。Max 目前包含每月 9,500 积分,面向高用量用户,取代 Unlimited 以 Explore 为核心的模式。

为什么每个可用片段的成本很重要

Seedance 2.0 平台对比:BytePlus、Runway 与 OpenArt

选择Seedance 平台时应根据工作流程,而不是假设每个平台都开放相同的模型能力。

平台

最适合

主要优势

BytePlus

API 与企业团队

官方能力与输入文档

Runway

创意制作

参考、帧控制与创作者流程

OpenArt

易于上手的探索

简化的第三方界面

我们的文档审阅发现,第三方对某些 Seedance 时长和分辨率的说法互相矛盾。更稳妥的原则是:原生模型能力以 BytePlus 为准,Runway 特有行为以 Runway 为准,第三方文档仅用于了解该平台自身的实现。

区分模型与平台,可以避免把界面限制误称为 Seedance 本身的限制。

结论

Seedance 2.0 最适合作为精心组织参考素材的制作系统,而不是只靠一条提示词的视频生成器。用图像锚定身份,用视频参考传达复杂动作和运镜,用音频提供时序与表演上下文,用镜头清单构建时间结构,用分镜在高成本生成前解决构图问题。对于较长的项目,应持续管理角色连续性,在无需重做时采用编辑或延长,并按可用素材而非生成次数衡量成本。真正的技巧不是写更多提示词,而是为 Seedance 提供更清晰的身份、动作、时序和约束结构。

常见问题

Seedance 2.0 能使用多少参考素材?

Seedance 2.0 目前在文档说明的多模态流程中支持最多九张图像参考、三段视频参考和三段音频参考。视频参考总时长最多为 15 秒,音频参考总时长也最多为 15 秒。具体控制选项可能因平台而异。

为什么我的角色在不同 Seedance 片段之间总是变化?

最常见的流程原因包括身份参考不一致、视觉输入相互竞争、反复重新设计角色,以及大幅改变取景。在整个项目中重复使用一份主要角色参考,保持描述稳定,并在每组镜头后检查身份,而不是等到最终剪辑时才检查。

我应该使用分镜还是多镜头提示词?

当段落简单、镜头顺序已明确时,可使用结构化多镜头提示词。当构图、场面调度、动作编排或连续性需要视觉验证时,应使用分镜。对于复杂作品,最有力的流程是结合两者:先做分镜,再按时间顺序给出镜头指令。

为什么 Seedance 会拒绝某些真人参考?

真人参考可能受到基础服务或运行该服务的平台限制。BytePlus 目前在文档中为获批的真人肖像素材提供授权素材库流程。如果制作依赖特定人物,应在扩大流程规模前确认授权要求,而不是把反复审核失败当作提示词问题。

更多 Virse 博客文章