字节跳动于6月23日在北京举办的「火山引擎 FORCE」大会上发布了全新的视频生成AI「Seedance 2.5」。其最大特点是无需把多段短视频拼接起来,就能一次性生成30秒的连续画面。该模型还支持最多50项参考素材的导入,以及只重绘画面局部的编辑功能。目前面向企业开放抢先体验,正式公开预计在7月上旬。

「无缝30秒」对视频制作的意义

此前主流的视频生成AI,单次生成的时长大多被限制在8到15秒左右。Google 的「Veo 3.1」、Runway 的「Gen-4.5」,以及已经停止提供的 OpenAI「Sora 2」都处于这一区间,要制作更长的画面就必须把短视频依次拼接。然而在拼接处,人物的面容会出现细微变化,光线和色调也难以统一,很容易让人一眼看出是AI生成的。

电视广告、面向社交平台的广告、讲解视频以及短纪录片,大多落在15到60秒的区间。Seedance 2.5 称可以用一段无缝画面生成这一时长。字节跳动表示,它并非把视频与音频分开制作再事后对齐,而是在同一内部空间中统一处理,并依靠保持时间方向一致性的自研注意力机制,在30秒内保持人物、光线和动作风格不变。

最多50项参考素材,以及只改局部

Seedance 2.5 提供3种生成模式:根据文字生成画面的「文本转视频」、让静态图片动起来的「图片转视频」,以及以现有视频为范本、继承运镜与动作风格的「动作参考」。

最受关注的是参考素材的处理能力。Seedance 2.5 可同时导入图片、视频和音频,合计最多50项。相比前代 Seedance 2.0 的约12项大幅增加;考虑到在参考控制方面较为接近的 Google Veo 3.1 仅支持3项,这一差距并不算小。火山引擎总裁谭待表示,这是为品牌表达和系列化内容制作而设计的功能,可在一整段视频中保持人物面容、商品外观、画风和音乐氛围不走样。

此外,它还支持只重绘画面中特定元素的局部编辑。人物的服装、背景或画面中的商品等,都可以在不重新生成整段视频的情况下替换。以往为了一个小修改往往要从头再来,并祈祷其余部分不出问题。能减少这类返工,在实际工作中很有价值。

Seedance 2.0 支持4K,独立评测中也居首

在同一场活动上,字节跳动还宣布现行的 Seedance 2.0 已支持10比特色深的原生4K输出,对已经接入2.0的开发团队是一次提升。

作为实力的佐证,在以盲测人类偏好为基础的独立排行榜「Artificial Analysis Video Arena」上,Seedance 2.0 在带音频的文本转视频类别中以1,218的Elo分数位居首位,超过 Kling 3.0 和 Veo 3.1。这是当前在售的2.0的评分,2.5尚无成绩。字节跳动还表示,其面向企业的 Seedance 业务的年度经常性收入(ARR)已达到20亿美元(约3200亿日元),显示出在2.5推出前已积累了相当的商业成绩。分发以该公司的云服务「火山引擎」为核心,并通过月活跃用户超过4亿的视频编辑应用「CapCut」,以及「Dreamina」「Doubao」等面向消费者的入口扩展。

※1美元=162日元换算(截至2026年6月25日)

仍待解决的是第三方验证与版权

这里列出的性能,都还只是6月23日发布时字节跳动的说法。30秒一次生成、50项参考的处理、局部编辑的稳定性,都尚未经过第三方验证。预计在7月上旬正式公开之后,才会首次由外部加以检验。价格目前也未公布。

围绕版权的来龙去脉同样不容忽视。Seedance 2.0 在2026年2月开始提供后,收到了美国电影协会(MPA)发出的、针对大型生成AI企业的首封警告函。迪士尼、华纳兄弟探索、派拉蒙、奈飞、索尼影业和环球影业也相继发出警告,字节跳动已于3月暂停全球推广。此后该公司增加了拦截真实人物面容和受版权保护角色生成的过滤机制,这一措施预计也会延续到2.5。在 FORCE 上,字节跳动还预告了一个以电影导演周星驰为首位合作伙伴的版权授权与变现平台。另外,由于字节跳动总部位于中国北京,在业务中处理高机密素材时,最好结合各国家和地区有关数据处理的规定一并确认。

总结

Seedance 2.5 以无需拼接、一次生成30秒画面为卖点,并配备最多50项参考素材和局部编辑等偏向实务的功能登场。由于底座 Seedance 2.0 在独立评测中已位居首位,如果规格如约兑现,它有望在长视频生成这一难点上抢先一步。不过现阶段毕竟只是企业方的发布,第三方验证尚待进行,版权问题也只解决了一半。7月正式公开时其实力将如何被检验,会是首个值得关注的看点。