字节跳动Seedance 2.5发布,单次生成延至30秒
0xBroomberg
字节跳动7月31日发布视频生成模型Seedance 2.5,单次生成时长翻倍至30秒并支持多轮延长。这意味着→ 视频AI正从「玩具级demo」向可批量交付的生产工具切换。
从15秒到30秒,多出来的时间意味着什么?
单次生成时长从15秒提升至30秒,并支持多轮延长——用大白话说= 以前只能生成一个镜头,现在能拼出一段完整片段。
新版同日上线豆包、即梦、扣子等字节旗下产品,企业端通过火山引擎API接入。
这意味着→ 字节把消费端和企业端同步打通,不是先做demo再找客户,而是产品和商业化一起推。
四项升级到底升了什么?
多模态参考:单次可输入最多30张图片、10段视频、10段音频;新增白模参考(用无纹理3D模型预设空间和机位)与绿幕参考(保持主体不变,按场景物理规则渲染衣服飘动、光影等细节)。
视频局部编辑:通过时间戳对指定片段的角色、动作、声音做定向修改,修改前后保持连贯——这意味着→ 不用因为一个镜头不对就重新生成整段视频,影视和广告场景直接可用。
语言与指令:原生支持10余种语言,加强复杂指令控制。用大白话说= 一条指令同时出多语言版本的工业化内容,不再需要逐条翻拍。
哪些行业已经开始用了?
制造业:徐工集团用Seedance生成工业操作培训和工序SOP视频,替代传统实拍与3D动画,直接砍制作成本。
汽车设计:小鹏汽车将其集成到内部AI设计平台,辅助产品设计环节的可视化创作。
具身智能:穹彻智能用视频生成扩充机器人训练数据——用大白话说= 不用真机器人一个动作一个动作地采集,直接用AI生成不同机型的操作数据。
机器人和自动驾驶为什么需要视频生成?
微分智飞将Seedance融入飞行机器人应用,模拟障碍物闪避、室内寻路、目标锁定等高难度场景,构建标准化训练数据集。
在自动驾驶领域,Seedance 2.5已可模拟极端天气、复杂路况等低频场景,为系统测试提供更多样本。
这反映出一个趋势:视频生成的产业价值正从「做好看的画面」转向「做真实世界的模拟器」。
真正的瓶颈在哪里?
香港科技大学副教授王帅指出:这些场景的共同需求是模型能理解「一个动作会带来什么后果」以及「一个场景会如何演化」——产业价值取决于物理世界建模能力,而非画面质量。
字节自己也承认,Seedance 2.5在复杂运动的物理合理性和多主体交互的稳定性上仍有提升空间。
这意味着→ 物理建模能力能否持续突破,是这类模型从「能用」走向「工业级可靠」的关键验证点。
Content is for reference only, not financial advice.