字节跳动发布两款视频生成大模型

1949idc 2年前 (2024-10-17) 阅读数 280 #人工智能

9月24日,字节跳动旗下火山引擎发布两款视频生成大模型(豆包视频生成-PixelDance、豆包视频生成-Seaweed),首次面向企业市场开启邀测。

火山引擎介绍,豆包视频生成模型基于DiT架构,通过高效的DiT融合计算单元,能更充分地压缩编码视频与文本,让视频在大动态与运镜中自由切换,拥有变焦、环绕、平摇、缩放、目标跟随等多镜头语言能力。

此外,豆包视频生成模型另外一大技术创新是全新设计的扩散模型训练方法攻克了多镜头切换的一致性难题。该模型还使用深度优化的Transformer结构,大幅提升视频生成的泛化能力。

字节跳动透露,目前,新款豆包视频生成模型正在即梦AI内测版小范围测试,未来将逐步开放给所有用户。

封面图片来源:拍信网

版权声明

本文内容由互联网用户自发贡献,该文观点仅代表作者本人
本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。

© 2010 首途云安 & 厦门硕顿信息技术有限公司 & 闽ICP备11016866号  增值电信业务经营许可证:B1-20203020 地址:福建厦门思明区嘉禾路297号1806
高新技术企业
软件产品证书
计算机软件著作权
ISO认证
国家3A企业