潮新闻客户端 记者 楼纯
7 月 31 日,字节跳动 Seed 团队发布公告,正式宣布推出新一代视频创作模型 Seedance2.5。该模型可单次生成 30 秒高质量视频片段,并支持多轮延长,标志着 AI 视频生成从 " 片段级输出 " 向 " 完整叙事创作 " 迈出关键一步。

Seedance2.5 发布宣传视频截图 图片来源:字节跳动 Seed
据官方介绍,Seedance2.5 延续了 Seedance2.0 统一的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力。在生成时长方面,模型将单次视频生成上限从 15 秒提升至 30 秒,并可在 30 秒内组织多个具备逻辑关联的镜头,使故事能够按照铺垫、推进、转折、收尾的完整结构展开。
在多模态参考能力上,Seedance2.5 支持用户单次输入最多 30 张图片、10 段视频和 10 段音频作为参考素材,模型可综合理解不同素材中的画面构图、场景、风格、人物、道具等元素,并按指令用于视频生成。官方展示的 30 秒音乐会片段示例中,模型在 16:9 横屏、电影感写实风格下,同时还原了钢琴家、大提琴、小提琴、主唱、管弦乐队、合唱团及观众席等多主体形象与声音,并保持主体特征稳定。
编辑控制方面,该模型支持精准的时间戳控制,可定向编辑视频内容,并强化了绿幕编辑、视角编辑、参考编辑等多种能力。在绿幕编辑场景中,模型能在保持主体不变的情况下替换不同场景,并基于不同场景的物理规则渲染人物身上的物理效果,包括衣服飘动方向、头发状态、步态节奏及光影等。
产业落地层面,Seedance2.5 正在陆续上线即梦 AI 与豆包专业版,API 服务也将于近期接入火山方舟。徐工集团、小鹏汽车、灵初智能、微分智飞、穹彻智能等多家企业已确认合作,将率先引入该模型能力并展开场景落地探索。
应用场景方面,除影视、广告创作外,该模型已开始进入教育、工业制造、具身智能和自动驾驶等更广泛产业场景。在教育领域,模型可将课文背后的历史背景、人物和情节转化为视频内容,将科学原理、历史事件、实验过程等抽象内容转化为动态演示。
回溯来看,Seedance2.5 最早于 2026 年 6 月 23 日在火山引擎 FORCE 原动力大会上首次披露,当时官方演示了其 3D 白模预可视化、原生 4K 输出及 10-bit 色深等能力。Seed 团队表示,Seedance2.0 发布后观察到用户对视频创作模型的期待正从 " 生成一个片段 " 走向 " 完成一段创作 ",2.5 版本正是围绕真实产业场景对这一需求的回应。
目前,Seedance2.5 的国际版仍在逐步推进中,公开 API 定价尚未单独公布。
字节跳动方面坦言,在复杂运动的物理合理性、极多主体交互场景的稳定性上,模型仍有提升空间。


登录后才可以发布评论哦
打开小程序可以发布评论哦