国产文生视频大模型 Vidu 将迎革新:反对生成 32 秒实质、音视频合成

感谢据“钛媒体 AGI”周四报导,生数科技、清华大学联合宣布的国内首个长时长、高一致性、高动态性的视频大模型 Vidu 将于近期完成三大革新,实现“重大技术迭代”。主要革新实质如下:反对一键生成 32s 视频反对音视频合成,“视频有声音了”(Text-2-Audio)反对 4D 生成,可以从单一视频生成时空一致的 4D 实质IT之家附部分视频预览: 据介绍,Vidu 是自 Sora 宣布之后,全球率先取得重大突破的视频大模型,并且仍在加速迭代提升中。据IT之家此前报导,Vidu 模型融合 Diffusion

感谢据“钛媒体 AGI”周四报导,生数科技、清华大学联合宣布的国内首个长时长、高一致性、高动态性的视频大模型 Vidu 将于近期完成三大革新,实现“重大技术迭代”。

国产文生视频大模型 Vidu 将迎革新:反对生成 32 秒实质、音视频合成

主要革新实质如下:

反对一键生成 32s 视频

反对音视频合成,“视频有声音了”(Text-2-Audio)

反对 4D 生成,可以从单一视频生成时空一致的 4D 实质

IT之家附部分视频预览:

据介绍,Vidu 是自 Sora 宣布之后,全球率先取得重大突破的视频大模型,并且仍在加速迭代提升中。

据IT之家此前报导,Vidu 模型融合 Diffusion 与 Transformer,开创性创建了 U-ViT,在 4 月宣布时反对一键生成长达 16 秒、分辨率高达 1080P 的高清视频实质。官方表示 Vidu 不仅能够模拟真实物理世界,还拥有丰富想象力,具备多镜头生成、时空一致性高等特点。

相关阅读:

《中国首个 Sora 级模型 Vidu 宣布:可生成最长 16 秒、最高 1080P 视频》

给TA打赏
共{{data.count}}人
人已打赏
AI

高考语文作文首次遇上 AI:2024 新课标 I 卷谈“AI 时代问题是否会越来越少”

2024-6-7 11:44:37

AI

华为与中山大学眼科中央发布 ChatZOC 眼科大模型,服务效率提升 75%

2024-6-7 16:05:39

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
今日签到
搜索