7 月 31 日,字节跳动 Seed 团队通过官方渠道发布新一代视频创作模型 Seedance 2.5。这一版本延续了 Seedance 2.0 统一的多模态音视频联合生成架构,重点补强三块能力:长叙事、多模态参考和编辑。

目前 Seedance 2.5 已陆续上线豆包、即梦 AI、扣子、小云雀等字节旗下产品,接口服务也将在近期上线火山方舟,通过火山引擎面向企业用户开放。
从“生成一个片段”到“完成一段创作”
Seed 团队在发布说明中给出了这次升级的出发点:
“Seedance 2.0 发布后,我们观察到,用户对视频创作模型的期待正在从‘生成一个片段’走向‘完成一段创作’。Seedance 2.5 延续了 Seedance 2.0 统一的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力。”
这句话基本概括了这一代模型的产品思路——不再只比谁生成的几秒画面更炫,而是看能否把一个完整的创意从头做到尾。
单次时长翻倍到 30 秒,支持多轮延长
最直观的变化是时长。Seedance 2.5 把单次视频生成时长从 15 秒提升至 30 秒,并支持多轮延长。
时长翻倍带来的不只是“更长”。团队称模型优化了镜头衔接和场景过渡,可以在 30 秒内组织多个具备逻辑关联的镜头,让一个故事按照铺垫、推进、转折、收尾的结构完整展开。配合多轮延长,用户可以产出数分钟具有统一视听语言的连贯内容。
画质、音质和运动质量也做了大幅优化,并明确针对 AI 视频常见的“油腻感”做了弱化处理——这是当前生成视频最容易被一眼识破的通病之一。
一次最多喂 50 份参考素材
多模态参考能力这一块,Seedance 2.5 支持用户单次输入最多 30 张图片、10 段视频和 10 段音频作为参考素材,合计 50 份。
模型可以综合理解不同素材的构图、场景、风格、人物等元素,实现多主体、多场景、多镜头变化的复杂创意。参考类型上,白模参考、运动参考、创意参考等能力均有提升。据媒体报道,新版本还增加了白模与绿幕参考能力,并原生支持十余种语言,以适配多语言、多版本的工业化生产需求。
对内容团队来说,这项能力的实际意义在于可控性:不必反复调整提示词去“碰运气”,而是直接把想要的角色形象、场景基调、音乐节奏作为素材喂进去。
支持时间戳级别的定向编辑
编辑能力是这一代的第三个重点。Seedance 2.5 支持精准的时间戳控制,可以对视频内容做定向编辑,而不必推倒重来。
同时,模型强化了绿幕编辑、视角编辑、参考编辑等多种编辑能力,可以在维持整体画面节奏的前提下,对背景、商品、人物等局部元素做精准修改,面向影视、广告等更专业、更复杂的创作场景。
对商业化内容生产而言,这一点相当关键——同一支广告片换个产品、换个背景、出一个不同市场的版本,此前往往意味着整段重新生成。
首批企业客户已确认
据火山引擎方面透露,Seedance 2.5 发布当日,徐工集团、小鹏汽车、灵初智能、微分智飞、穹彻智能等多家企业已确认合作,将率先引入该模型能力。这些企业此前已经基于 Seedance 系列模型展开了场景落地探索。
团队承认的短板
Seed 团队在发布说明中也直接点出了当前版本的不足:在复杂运动的物理合理性、以及极多主体交互场景的稳定性上,模型仍有提升空间。
团队表示,后续将继续探索更长的连贯叙事、更懂用户的生成与编辑体验,并进一步增强模型对物理世界规律的理解。
从行业角度看,视频生成模型的竞争焦点正在从单纯的画质与时长,转向可控性和工业化流程适配。谁能让创作者少改几遍、少等几轮,谁就更有机会进入真实的生产管线。
来源:36氪(https://36kr.com/newsflashes/3919079681715588 )、新京报贝壳财经、上海证券报
发表回复