寰宇科技风向标
17小时前来自 科技看点

Seedance2.5支持哪些多模态参考素材输入?

一、参考素材类型与数量:全面覆盖多模态输入

Seedance 2.5支持用户单次输入最多30张图片、10段视频、10段音频作为参考素材,合计上限达到50份全模态素材。这意味着创作者可以一次性提供角色设计图、产品实拍、参考音效等多元素材,模型会综合理解其中的构图、场景、风格、人物、道具等元素。- 图片参考:最多30张,可提供角色多角度视图、场景风格参考、产品包装等视觉资产- 视频参考:最多10段,用于传递运动节奏、镜头语言、动作序列等动态信息- 音频参考:最多10段,可指定背景音乐风格、环境音效、角色人声等声音元素

二、参考能力的智能化提升:从“看素材”到“理解意图”

相较于前代模型,Seedance 2.5在参考能力的理解深度上实现了显著升级,不仅是“堆素材”,更是“懂素材”。- 白模参考:支持导入3D白模(三维模型素模)作为场景或物体的结构参考,模型能精准还原复杂的3D白模、产品包装等高精度资产,企业前期投入的专业设计资产无需二次返工- 运动参考:通过提供运动参考素材,模型可以模仿其中的动作轨迹、运动节奏和物理逻辑,使生成的视频动作更符合物理常识- 创意参考:模型能综合理解多张素材中的共同特征,在多人同框和群像叙事场景中,可同时还原多个人物形象与声音,并保持主体特征稳定

三、配套的编辑与控制能力:让参考素材真正“可用”

多模态参考的强大离不开配套的精准控制能力,Seedance 2.5提供了时间戳控制和局部编辑两大核心工具,让参考素材的效果可以被精准调校。- 时间戳控制:支持按时间点精确定义画面内容、运镜方式和节奏变化,创作者可以告诉模型“第5秒切特写、第15秒推全景”,叙事节奏完全按创作意图走- 局部编辑:支持绿幕编辑、视角编辑、参考编辑等多种编辑能力,可在维持整体画面不变的前提下,对背景、商品、人物等局部元素进行精准修改,无需整段重跑- Agent协同:豆包专业版的办公任务模式实现了AI自动编排,用户只需下达复杂需求,Agent会自主拆解流程,联动图像模型Seedream 5.0 Pro准备视觉参考,再调用Seedance 2.5完成完整视频任务