Gemini 2.0成P图神器，各种P图只需一句话的事儿，可把网友馋哭了

AIGC动态2年前 (2024)发布量子位

西风发自凹非寺量子位 | 公众号 QbitAIGemini 2.0说说话就能一键P图的功能爆火，把玩不了的大伙儿都馋哭了！比如一辆小车车：输入指令“把这辆车改装成敞篷车”，它就能立马将文字指令和图片结合起来，完成一键P图。让我们来找茬儿，发现除了车变成了敞篷的，其它元素木有变化，很好地保持了一致性。不仅于此，Gemini 2.0还有点“多模态版o1”那味儿。继续输入指令：想象一下，这辆车内装满了海滩用品。接着，将车身颜色改为一种令人联想到夏日的颜色，并在改变过程中进行说明。然后Gemini 2.0就开始图文并茂地一步步推理生成了，先把车变成了明亮的黄色，接着又再车里装满了遮阳伞等海滩用品这就是Gemini 2.0系列的原生图像输出能力。评论区底下，一水儿都是求具体上线时间的：被谷歌挖走的OpenAI大将Logan Kilpatrick回应，大伙儿别急，明年年初将更广泛地推出。各种P图都是一句话的事儿除了上面展示的简单P图，你甚至可以同时P图片中的多个元素，还能把一个物件变成另一个。比如，把蓬松的夹克变成一个小枕头，并且拿掉毯子：这还没完，结合不同的图来P也行。猫和抱枕结合，就得到了一个很有质感的猫猫抱枕：把猫猫和滑板结合就得到了猫猫代言滑板。遵从文字指令，Gemini 2.0成功将猫猫变成了插画贴纸形态。除此之外，Gemini 2.0 P图时还能更有想象力。比如一个箱子，把箱子打开就变成了酱婶儿：开头展示的小车车，也能变成“飞车”：另外，还有一种玩法。在图像中圈出需要P的区域，只需“Open this”，Gemini 2.0可以直接结合文字指令理解图像，知道“this”的指代：不得不说，那些有内测资格的玩家，可算了把大伙儿馋坏了。参考链接：https://x.com/OfficialLoganK/status/1868364831948251419—完—点这里?关注我，记得标星哦～一键三连「分享」、「点赞」和「在看」科技前沿进展日日相见 ~

阅读原文