国产文生视频大模型Vidu将迎更新：支持生成32秒内容、音视频合成-窝牛号

IT之家 6 月 7 日消息，据“钛媒体 AGI”周四报道，生数科技、清华大学联合发布的国内首个长时长、高一致性、高动态性的视频大模型 Vidu 将于近期完成三大更新，实现“重大技术迭代”。

主要更新内容如下：

支持一键生成 32s 视频

支持音视频合成，“视频有声音了”（Text-2-Audio）

支持 4D 生成，可以从单一视频生成时空一致的 4D 内容

IT之家附部分视频预览：

据介绍，Vidu 是自 Sora 发布之后，全球率先取得重大突破的视频大模型，并且仍在加速迭代提升中。

据IT之家此前报道，Vidu 模型融合 Diffusion 与 Transformer，开创性创建了 U-ViT，在 4 月发布时支持一键生成长达 16 秒、分辨率高达 1080P 的高清视频内容。官方表示 Vidu 不仅能够模拟真实物理世界，还拥有丰富想象力，具备多镜头生成、时空一致性高等特点。

本站所发布的文字与图片素材为非商业目的改编或整理，版权归原作者所有，如侵权或涉及违法，请联系我们删除

窝牛号