最长 30 秒
在单个 30 秒序列中生成完整的音视频故事。
请在桌面端浏览器打开本页开始创作。
Seedance 2.5 是一款新一代音视频联合模型,旨在将创意简报转化为更完整的视频序列。
该模型并非只是延展一个简单瞬间,而是能够将相互关联的镜头组织成具有引入、发展、转场和结尾的结构化叙事。单次生成最长可达 30 秒,而视频延展功能可帮助创作者在更长的序列中延续故事。
当你的创意不止需要一个孤立的镜头运动时,可以使用 Seedance 2.5。以更强的镜头衔接连续性,打造广告影片、产品故事、时尚序列、表演视频、短篇叙事和电影感概念。
Seedance 2.5 是由 ByteDance Seed 开发的 AI 视频生成模型。它能够在遵循关于角色、场景、动作、摄像机运动、对白、音乐和音效的详细指令的同时,生成协调一致的画面与音频。
该模型围绕三项重大改进构建:
Seedance 2.5 可一次生成最长 30 秒的片段。它还支持在单次生成中使用多达 30 个图像参考、10 个视频参考和 10 个音频参考。
在单个 30 秒序列中生成完整的音视频故事。
用图像引导角色、产品、场景、道具和视觉风格。
参考运动、镜头语言、节奏、表演和转场。
引导人声、音乐、节奏、环境声和音效。
在保持角色、场景、风格和叙事连续性的同时扩展视频。
在特定时刻控制动作、镜头运动、节奏和剪辑。
在一份创意简报中组合最多 30 张图像、10 个视频和 10 段音频片段。使用参考来指导角色、产品、环境、造型、灯光、音乐和音效——并将参考素材的运动、构图、节奏、表演和镜头语言迁移到新的主体、场景或视觉风格中。
在动作和摄像机角度变化时,保持可识别的角色、道具、环境和视觉风格。Seedance 2.5 提升了多角色场景和包含多次镜头转场的复杂序列中的稳定性。
定义视频中特定时刻发生的内容。时间线指令让你能够更好地控制镜头顺序、角色动作、摄像机运动、节奏、转场和叙事发展。
将视觉画面和同步音频生成为一个协调一致的结果。Seedance 2.5 可以将人声、音乐、环境氛围和音效与每个场景的动作、时机和氛围对齐。
当 Seedance 2.5 成为完整创意工作流的一部分,而不是一个孤立的提示词输入框时,它会变得更加实用。 Virse 将模型、参考、概念和输出汇集在同一个可视化画布上。创意团队可以制定美学方向、探索图像、整理源素材,并在无需在单独工作区重新构建创意简报的情况下进入视频生成。
将创意简报、情绪板、角色参考、产品图像、视觉探索和视频输出保留在同一个工作空间中。
先使用图像模型开发关键帧、营销活动视觉、产品场景和风格方向,再将其作为 Seedance 2.5 的参考。
在 Virse 中,将 Seedance 2.5 与 50 多个模型搭配使用,为创意流程的每个阶段选择合适的模型。
在多次生成中使用一致的视觉参考和美学方向,使最终视频与更广泛的营销活动或品牌系统保持关联。
创建结构化的营销活动视频,包含产品镜头、出镜人才、品牌视觉、镜头转场、音乐和声音。
从多个角度展示产品,演示真实使用场景,并通过参考指导外观和摄像机运动。
创建秀场影片、造型画册、美妆社论和时尚营销活动,并保持一致的造型、灯光和动态效果。
构建完整场景,包含连贯的故事节点、角色动作、对白、转场和清晰的结尾。
生成包含人声、动作、舞台灯光、摄像、音乐和观众反应的协调演出。
为产品发布、品牌故事、创作者内容和社交营销活动创建竖版或横版视频。
描述主体、场景、氛围、动作、时间线,以及视频应如何开始和结束。
上传图片、视频或音频,并清晰定义每个参考的用途。
选择 Seedance 2.5,生成第一个版本,并检查画面、动作、节奏和音频。
通过视频延展继续故事,或在保留有效部分的同时修改特定片段。
一个实用的 Seedance 2.5 提示词通常包含七个要素:
与其这样写
创作一支电影感产品视频。
不如这样写
为 Image 1 中展示的电动剃须刀创作一支 30 秒的电影感产品短片。开场使用微距特写,在狭窄的顶部灯光下呈现哑光黑色表面。围绕产品缓慢旋转,同时让水滴在金属表面移动。第 10 秒时,转场到现代浴室,展示产品的使用场景。遵循 Video 1 中受控的镜头运动。使用克制的电子声音设计,并采用 Audio 1 的节奏。最后以剃须刀直立在深色反光表面上的干净主视觉构图收尾。
为图像 1 中展示的跑鞋创作一支 30 秒的电影感广告。 0–6 秒:以夜晚鞋底接触潮湿沥青路面的超近景开始。展现逼真的水流位移和材质细节。 7–15 秒:从侧面跟拍运动员穿过霓虹灯照亮的城市街道。遵循视频 1 中的摄像机节奏和身体动作。 16–24 秒:过渡到广角镜头,展现运动员在日出前穿过一座空旷的桥。 25–30 秒:以鞋子置于混凝土平台上的画面结束,采用图像 2 中的光照和构图。加入克制的冲击声、脚步声、城市环境声,以及最后一记低频品牌重音。
生成一段 30 秒的时尚编辑序列,呈现图像 1 中的模特穿着图像 2 中的服装。 使用图像 3 中的建筑环境,以及视频 1 中缓慢、克制的摄像机运动。 以面料在风中摆动的特写开始。随着模特穿过空间,镜头向后拉开。在正面、侧面和广角建筑镜头之间切换,同时保持模特的外貌和服装细节一致。 使用基于音频 1 的极简环境音乐。以模特停在一道锐利自然光束下作为结尾。
创作一部 30 秒的叙事短片,讲述一位年轻设计师为一场重要演示做准备的故事。 0–8 秒:展示设计师深夜独自在昏暗的工作室里工作,周围环绕着草图和原型。 9–18 秒:跟随设计师穿过清晨将至的安静城市。保持 Image 1 中的角色,并使用 Image 2 作为城市的视觉风格参考。 19–26 秒:设计师走进明亮的演示室,将最终原型放在桌上。 27–30 秒:以设计师如释重负的表情特写收尾,房间逐渐安静下来。使用细腻的房间环境声、脚步声、纸张声,以及克制的情感音乐。
| 对比维度 | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| 视频长度 | 生成最长 15 秒的视频 | 生成最长 30 秒的视频 |
| 参考输入 | 支持的参考材料较少 | 支持最多 30 张图片、10 个视频和 10 段音频片段 |
| 故事连贯性 | 更适合较短片段 | 更适合带多轮延展的较长故事 |
| 编辑控制 | 基础编辑工作流 | 时间戳级控制,实现更精准的编辑 |
| 专业工作流 | 创意控制更有限 | 支持黏土渲染、动作参考、绿幕编辑、相机视角编辑和高级镜头控制 |
不要上传大量未加说明的素材。明确说明模型应从每张图片、每个视频或音频文件中提取什么。
按动作应发生的顺序进行描述。对于复杂视频,请将提示词划分为不同时间范围。
尽可能使用一个参考来指定主体,另一个参考来指定视觉风格。这有助于模型理解哪些内容必须保持一致,哪些内容应影响呈现方式。
将“cinematic camera”这类模糊指令替换为具体运动,例如缓慢推轨、手持跟拍、低角度环绕、微距推进、摇臂镜头或固定广角镜头。
将角色、产品、环境、镜头语言和声音整合到一个完整的视频工作流中。 在 Virse 中使用 Seedance 2.5,创作更长的故事,运用更丰富的参考,并以更强的控制力优化成果。