99科技给大家分享各类生活学习资讯!
您现在的位置是: 首页 > 互联网 > 国产文生视频大模型Vidu即将升级:支持生成长达32秒内容音视频合成

国产文生视频大模型Vidu即将升级:支持生成长达32秒内容音视频合成

6月7日消息,据“钛媒体 AGI”周四报道,生数科技与清华大学联合发布的国内首个长时长、高一致性、高动态性的视频大模型Vidu即将迎来新一轮的重大技术迭代,预计将完成三大核心更新,为视频生成领域带来前所未有的突破。

国产文生视频大模型Vidu即将升级:支持生成长达32秒内容音视频合成

主要更新内容如下:

支持一键生成 32s 视频

支持音视频合成,“视频有声音了”(Text-2-Audio)

支持 4D 生成,可以从单一视频生成时空一致的 4D 内容

据介绍,Vidu 是自 Sora 发布之后,全球率先取得重大突破的视频大模型,并且仍在加速迭代提升中。

据此前报道,Vidu 模型融合 Diffusion 与 Transformer,开创性创建了 U-ViT,在 4 月发布时支持一键生成长达 16 秒、分辨率高达 1080P 的高清视频内容。官方表示 Vidu 不仅能够模拟真实物理世界,还拥有丰富想象力,具备多镜头生成、时空一致性高等特点。

传音与腾讯合作,手机将搭载 GVoice 游戏语音技术

2024/6/7 14:43:12

小米SU7冲出停车场酿惨剧:致一死三伤,官方正式回应

2024/6/7 14:56:27