Gemini 2.0成P图神器,各种P图只需一句话的事儿,可把网友馋哭了

人工智能
Gemini 2.0说说话就能一键P图的功能爆火,把玩不了的大伙儿都馋哭了!Gemini 2.0还有点“多模态版o1”那味儿。

Gemini 2.0说说话就能一键P图的功能爆火,把玩不了的大伙儿都馋哭了!

比如一辆小车车:

图片

输入指令“把这辆车改装成敞篷车”,它就能立马将文字指令和图片结合起来,完成一键P图。

图片

让我们来找茬儿,发现除了车变成了敞篷的,其它元素木有变化,很好地保持了一致性。

不仅于此,Gemini 2.0还有点“多模态版o1”那味儿。

继续输入指令:想象一下,这辆车内装满了海滩用品。接着,将车身颜色改为一种令人联想到夏日的颜色,并在改变过程中进行说明。

然后Gemini 2.0就开始图文并茂地一步步推理生成了,先把车变成了明亮的黄色,接着又再车里装满了遮阳伞等海滩用品。

图片

这就是Gemini 2.0系列的原生图像输出能力。

评论区底下,一水儿都是求具体上线时间的:

图片

被谷歌挖走的OpenAI大将Logan Kilpatrick回应,大伙儿别急,明年年初将更广泛地推出。

图片

各种P图都是一句话的事儿

除了上面展示的简单P图,你甚至可以同时P图片中的多个元素,还能把一个物件变成另一个。

比如,把蓬松的夹克变成一个小枕头,并且拿掉毯子:

图片

这还没完,结合不同的图来P也行。

猫和抱枕结合,就得到了一个很有质感的猫猫抱枕:

图片

把猫猫和滑板结合就得到了猫猫代言滑板。

遵从文字指令,Gemini 2.0成功将猫猫变成了插画贴纸形态。

图片

除此之外,Gemini 2.0 P图时还能更有想象力。

比如一个箱子,把箱子打开就变成了酱婶儿:

图片

开头展示的小车车,也能变成“飞车”:

图片

另外,还有一种玩法。

在图像中圈出需要P的区域,只需“Open this”,Gemini 2.0可以直接结合文字指令理解图像,知道“this”的指代:

图片

不得不说,那些有内测资格的玩家,可算了把大伙儿馋坏了。

图片

参考链接:https://x.com/OfficialLoganK/status/1868364831948251419。

责任编辑:姜华 来源: 量子位
相关推荐

2023-09-05 23:34:52

Kubernetes云原生

2024-11-11 14:30:00

2022-12-12 13:45:46

模型修图

2020-11-27 09:57:11

Python代码PyPy

2015-08-03 10:21:04

设计模式表达

2023-03-17 16:47:46

图像特技

2023-08-28 00:53:03

AI3D

2023-06-09 08:35:54

2024-07-01 07:40:00

2010-03-29 11:55:12

无线上网报错

2023-05-08 15:44:23

3D数字人

2014-05-07 10:47:51

移动金融互联网金融GMIC

2018-01-15 10:45:43

社交网络互联网巨头百度

2020-12-16 10:43:44

PythonPyPy代码

2019-08-15 11:42:56

程序员电脑软件

2023-09-06 15:23:30

Docker容器K8S

2022-09-30 15:35:43

AI视频

2011-06-03 16:42:47

SEO

2014-12-16 08:58:17

甲骨文Oracle数据库选件
点赞
收藏

51CTO技术栈公众号