Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了

虽然生成的视频只有10秒左右,但在清晰度、细节、角色一致性等方面看起来可以匹敌现有一切视频生成模型。刚刚,AI视频生成初创公司Runway推出了新的视频生成基础模型Gen-3 Alpha。该模型可以创建具有复杂场景变化、多种电影风格和详细艺术指导的高精细视频。Runway表示,Gen-3 Alpha是即将推出的一系列模型中的首个。系列模型是在为大规模多模态训练而构建的新基础设施上训练的。与Gen-2相比,Gen-3 Alpha在保真度、一致性和运动性方面有了重大改进,并朝着构建通用世界模型迈出了重要一步。在博客中,

虽然生成的视频只有10秒左右,但在清晰度、细节、角色一致性等方面看起来可以匹敌现有一切视频生成模型。

刚刚,AI视频生成初创公司Runway推出了新的视频生成基础模型Gen-3 Alpha。该模型可以创建具有复杂场景变化、多种电影风格和详细艺术指导的高精细视频。Runway表示,Gen-3 Alpha是即将推出的一系列模型中的首个。系列模型是在为大规模多模态训练而构建的新基础设施上训练的。与Gen-2相比,Gen-3 Alpha在保真度、一致性和运动性方面有了重大改进,并朝着构建通用世界模型迈出了重要一步。图片

在博客中,Runway重点强调,Demo的所有视频均使用 Gen-3 Alpha 生成,未经任何修改。有许多网友表示,Runway果然让我们再次感到震撼:Runway回归!图片

Pytorch负责人Soumith Chintala认为其中一些生成质量达到了Sora级别。图片

接下来,让我们欣赏下Runway视频生成的效果。提示:日本某城市高速行驶的火车窗户上,映出一位女性的微妙倒影.(Prompt: Subtle reflections of a woman on the window of a train moving at hyper-speed in a Japanese city.)Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了提示:一名宇航员正在里约热内卢的一条小巷里奔跑。(Prompt: An astronaut running through an alley in Rio de Janeiro.) Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了

从Demo中可以看到,Runway生成的10秒量级的视频在清晰度、细节、角色的一致性和保真度等方面做得非常好。让人直呼:什么时候能用上呢?图片

细粒度的时序控制

Gen-3 Alpha经过训练,具有高度的可描述性,时间密集字幕, 实现富有想象力的场景过渡。提示:一只蚂蚁从巢穴中爬出的特写镜头。镜头拉远,露出山丘后面的街区。(Prompt: An extreme close-up shot of an ant emerging from its nest. The camera pulls back revealing a neighborhood beyond the hill.)Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了提示:一架FPV无人机飞过悬崖上的一座城堡。(Prompt: A FPV drone shot through a castle on a cliff.) Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了

生成更逼真的人类角色

Gen-3 Alpha 擅长创造具有多种动作、手势和情感的富有表现力的人类角色。提示:这是一幅电影广角人像,一名男子的脸被光照亮。(Prompt: A cinematic wide portrait of a man with his face lit by the glow of a TV.)Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了提示:一个中年悲伤的秃头男人突然变得快乐,因为一顶卷发和一副太阳镜突然落在他的头上。(Prompt: A middle-aged sad bald man becomes happy as a wig of curly hair and sunglasses fall suddenly on his head.) Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了

艺术创作

Gen-3 Alpha 的训练工作是由研究科学家、工程师和艺术家组成的跨学科团队共同努力完成的,旨在让Gen-3 Alpha理解、解释各种艺术风格和电影术语。提示:夜晚,窗外一个巨大的奇怪生物在破败的城市中行走,一盏路灯昏暗地亮着。(Prompt: View out a window of a giant strange creature walking in rundown city at night, one single street lamp dimly lighting the area.)Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了提示:延时拍摄,穿过灯光闪烁的走廊,一条银色的织物飞过整个走廊。(Prompt: Hyperlapse shot through a corridor with flashing lights. A silver fabric flies through the entire corridor.) Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了

行业定制

Runway表示 Gen-3 系列模型的定制化可以实现更加风格化的控制和更加一致的角色,并针对特定的艺术和叙事要求等进行优化。提示:从肩上视角拍摄一个女人奔跑并观看远处火箭。(Prompt: Over the shoulder shot of a woman running and watching a rocket in the distance.)Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了提示:一个女人的侧脸照片,烟花在她身后的远处绽放。(Prompt: A side profile shot of a woman with fireworks exploding in the distance beyond her.) Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了在Sora发布这几个月后,越来越多的视频生成模型出现,如近期发布的快手可灵、Luma、以及今天的Gen-3。但遗憾的是,很多产品我们还不能直接体验到。相信接下来和文本大模型一样,视频生成模型会越来越多,我们也能自由尝试这些产品了。博客链接:https://runwayml.com/blog/introducing-gen-3-alpha/ 

相关资讯

Runway 发布第三代视频生成模型,90 秒生成 10 秒片段

专为电影和图像内容创作者打造生成式 AI 工具的公司 Runway 发布了 Gen-3 Alpha 视频生成模型。IT之家附 Gen-3 Alpha 官方网站: 表示,与其之前的旗舰视频模型 Gen-2 相比,该模型在生成速度和保真度方面有了“重大”改进,并且对生成视频的结构、风格和运动提供了细粒度的控制。Gen-3 将在未来几天内向 Runway 订阅用户提供,包括企业客户和 Runway 创意合作伙伴计划中的创作者。Runway 联合创始人 Anastasis Germanidis 表示,Gen-3 的视频生成

杀疯了!谷歌卷视频到语音,逼真音效让AI视频告别无声!

AI圈这遍地开花的大好局面,让吃瓜群众们甚是惊喜。这几天,大洋彼岸杀疯了!Luma 的热乎劲儿还没过去,昨晚 Runway 就甩出一个王炸 ——Gen-3 Alpha。(查看详情请移步:Runway 版 Sora 发布:高保真、超强一致性,Gen-3 Alpha 震撼到网友了)更没想到的是,一觉醒来,Google DeepMind 也有了新消息,悄咪咪地发布了视频生成语音(V2A)技术的进展。虽然这一功能还未向公众开放,不过从官方放出的视频 Demo 来看,效果那是相当丝滑。同时,Google DeepMind 强

Runway 王者归来!发布新模型 Gen-3 Alpha,直接对标 Sora

大家好,这里是和你们一起探索 AI 的花生。 自 OpenAI 发布 Sora,将文生视频拉高到一个新的高度后,各家 AI 视频工具都在努力升级模型、添加新功能,以期在这场竞赛中保住自己的一席之地,比如 Pika 已经推出了风格选择、视频配音、唇形一致等多种功能,Vidu、Kling 则是类 Sora 的新模型,在生成效果上已经十分接近 Sora。而曾经的领军产品 Runway 却始终都没有什么动静,因此很多人都在担心它未来的发展。 最近 Runway 终于放出大招,发布了第三代模型 Gen-3 Alpha,它各方