谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

输入指令“把这辆车改装成敞篷车”,它就能立马将文字指令和图片结合起来,完成一键 P 图。

Gemini 2.0 说说话就能一键 P 图的功能爆火,把玩不了的大伙儿都馋哭了!

比如一辆小车车:

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

输入指令“把这辆车改装成敞篷车”,它就能立马将文字指令和图片结合起来,完成一键 P 图。

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

让我们来找茬儿,发现除了车变成了敞篷的,其它元素木有变化,很好地保持了一致性

不仅于此,Gemini 2.0 还有点“多模态版 o1”那味儿。

继续输入指令:想象一下,这辆车内装满了海滩用品。接着,将车身颜色改为一种令人联想到夏日的颜色,并在改变过程中进行说明。

然后 Gemini 2.0 就开始图文并茂地一步步推理生成了,先把车变成了明亮的黄色,接着又再车里装满了遮阳伞等海滩用品。

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

这就是 Gemini 2.0 系列的原生图像输出能力。

评论区底下,一水儿都是求具体上线时间的:

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

被谷歌挖走的 OpenAI 大将 Logan Kilpatrick 回应,大伙儿别急,明年年初将更广泛地推出。

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

各种 P 图都是一句话的事儿

除了上面展示的简单 P 图,你甚至可以同时 P 图片中的多个元素,还能把一个物件变成另一个

比如,把蓬松的夹克变成一个小枕头,并且拿掉毯子:

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

这还没完,结合不同的图来 P 也行。

猫和抱枕结合,就得到了一个很有质感的猫猫抱枕:

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

把猫猫和滑板结合就得到了猫猫代言滑板。

遵从文字指令,Gemini 2.0 成功将猫猫变成了插画贴纸形态。

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

除此之外,Gemini 2.0 P 图时还能更有想象力

比如一个箱子,把箱子打开就变成了酱婶儿:

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

开头展示的小车车,也能变成“飞车”:

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

另外,还有一种玩法。

在图像中圈出需要 P 的区域,只需“Open this”,Gemini 2.0 可以直接结合文字指令理解图像,知道“this”的指代:

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

不得不说,那些有内测资格的玩家,可算了把大伙儿馋坏了。

谷歌 Gemini 2.0 成“P 图神器”,各种 P 图只需一句话

本文来自微信公众号:量子位(ID:QbitAI),作者:西风,原标题《Gemini 2.0 成 P 图神器,各种 P 图只需一句话的事儿,可把网友馋哭了》

相关资讯

语言游戏让 AI 自我进化,谷歌 DeepMind 推出苏格拉底式学习

近日,谷歌 DeepMind 的研究人员推出了苏格拉底式学习,在没有外部数据的情况下,让 AI 通过语言游戏不断变强。

​谷歌AI概览引用YouTube视频激增25%,医疗行业表现突出

近日,来自企业 SEO 平台 BrightEdge 的一项最新研究显示,自2023年1月1日以来,谷歌 AI 概览中引用 YouTube 的数量增长了25.21%。 这一增长在医疗行业尤为显著,引起了业内的广泛关注。 研究表明,YouTube 在谷歌 AI 概览中之所以受到青睐,主要是因为其提供了丰富的教学内容、视觉演示、验证示例以及时事新闻。