亲测谷歌Gemini 2.0 Flash图像生成模型,实际使用效果如何呢?
最近谷歌发布的Gemini 2.0 Flash图像生成模型非常火,很多博主都惊呼要抢ps饭碗了。我特地试用了一下,看到底怎么样。

Gemini 2.0 Flash是谷歌发布的全模态图像生成器,支持原生图像生成功能,开发者可通过Gemini API和Google AI Studio中的实验版本使用。它具备强大的文本与图像结合能力,能实现“唠嗑式P图”,在多种图像生成任务中表现出色。
简单说说使用方法:
1. 准备工作:拥有可访问Gemini API或Google AI Studio实验版本的开发环境,确保网络连接稳定,这里推荐使用Google AI Studio实验版。
2. 添加或去掉元素:在Google AI Studio实验版本中打开Gemini 2.0 Flash交互界面——注意一定要选择这个模型。

然后上传要处理的图片,比如发送一张风景照片,在输入框中准确地输入指令,如“把船去掉” 。只需等待约几秒钟,模型就会输出处理后的图片。若想继续处理其他图片或下达新指令,直接在同一对话页面输入即可。

可以看到,效果非常不错,而且还自动把船的影子去掉了。
但要注意,连续输入的话,可能会出现主体混淆等异常情况。例如,会把两张图的主体混淆等错误。
3. 上色、改色:上传黑白漫画图片,在输入框里指令,如“给图片上色,鲜艳的中国传统风格” 。只需等待短短几秒,图片生成了。

虽然配色有点丑,但无论是手部,衣服,马填充的颜色都很精确,说明它能准确识别图片的各个部位。如果给予更精确的指令,效果肯定会更好。
不过在改色操作时出现了问题。我上传了一张苹果的照片,输入指令“将红色的苹果改成黄色” ,

Gemini 2.0 Flash没有识别出来,基本保持了原样输出。
4. AI电商模特,一键换衣:上传服装图片,在输入框中详细描述需求,如“将这套服装穿到一位男性模特身上,背景色设定为橙色” 。

可以看到,Gemini自动将裙装换成了西装裤,使其更符合男性模特,确实很智能,而且效果还勉强算不错。尤其是手部,非常写实,没有AI生图常见的畸形感。
通过这些尝试,可以看到 Gemini 2.0 Flash在处理图像任务时确实功能强大,但使用过程中可能会出现一些小问题。尤其是实现精细化操作,还远远不够。很多想实现的效果还是实现不了。
体验网址:
