Gemini强在逻辑一致性,GPT胜于创意风格化:AI生图工具如何选?
03-09 10:57
精选参考来源
精选参考来源
1. 实测文心5.0 vs GPT-5.1 用户只认好不好用
小红书 2025-11-13 00:00:00
2. 如何评价gemini-3-pro-preview-11-2025?
知乎 2025-11-19 00:00:00
3. 小小的也很厉害?这个只有6B参数的开源图像模型把我看傻了
哔哩哔哩 2025-12-18 00:00:00
4. 百度上线文心5.0,模型参数2.4万亿,采用原生全模态统一建模技术,具备全模态理解与生成能力,支持文本、图像、音频、视频等多种信息的输入与输出。这是老罗数字人的表现。文心5.0以1460分位列LMArena文本榜国内第一、全球第八,超过GPT-5.1-High、Gemini-2.5-Pro等多款国内外主流模型。 兔撕鸡大老爷的微博视频
新浪微博 2026-01-22 00:00:00
5. 一站式生成大片,声画同步的AI视频模型来了
哔哩哔哩 2025-12-16 00:00:00
6. Seedream 5.0 vs GPT Image 1.5 对比:字节搜索 vs OpenAI 排名第一,6 维度选型指南
微信公众号 2026-03-01 00:00:00
7. 强到离谱?Gemini 3深度实测【玩法合集】
哔哩哔哩 2025-11-20 00:00:00
8. Nano Banana Pro深度评测,PS这次真可丢了,超强AI绘画神器
哔哩哔哩 2025-11-27 00:00:00
9. #千问上线阿里最强AI生图模型满血版#刚把千问升级了一下,变化确实挺大的。全新上线了图像模型,现在使用的是Qwen-image 2511模型。刚生成了一张尼克在海边的图片,人物的特征都能保持高度一致性。而且还能精准编辑图片,指哪打哪,给人物换换衣服什么的都能轻松搞定。后边我再好好研究研究,看看能不能生成一些更加好玩的~
新浪微博 2025-12-02 00:00:00
10. 如何评价谷歌发布新一代图像生成模型 Nano Banana Pro,有哪些亮点?
知乎 2025-11-21 00:00:00
11. Nano Banana 2,实时联网能思考的AI生图模型,对比Nano Banana Pro
哔哩哔哩 2026-03-01 00:00:00
12. 本想免费用Gemini3,没想到挖到宝了…… Gemini自从开放以来,网络和费用问题一直很困扰,没想到这次白嫖了TRAE一波,还解锁了这么多好用的技巧! #TRAE #ai工具 #ai新星计划 #抖音知识年终大赏 #托尼三三
抖音 2026-01-22 00:00:00
13. 盘点一周AI大事(11月16日)|AI自己玩原神 OpenAI上线GPT-5.1,高情商人格回归,智商小幅提升,指令遵循独一档领先 Gemini 3.0 Pro下周发布,目前能在画布(移动端)中抢先体验 Gemini语音模型升级,能控制语速和语气,适合当口语教练 NotebookLM上线深度研究,支持上传图片和PDF,开放自定义视频解说风格 微软开源数据分析智能体Data Formulator 李飞飞的世界模型Marble正式上线 Google发布最强通用智能体SIMA2 字节推出最强游戏智能体Lumine Epidemic推出AI配音工具 StepFun开源最强音频编辑模型Step Audio EditX ElevenLabs发布最强音频转文字模型 32岁的小姐姐与ChatGPT男友结婚 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人
抖音 2025-11-16 00:00:00
14. 千问 vs ChatGPT:4大功能实测!到是更好用的AI助手!Qwen3能否战胜GPT-5.1?
哔哩哔哩 2025-11-19 00:00:00
15. 字节登顶世界最强图像AI!一手实测原生4K、10图融合,全网玩疯
知乎 2025-09-12 00:00:00
16. 腾讯混元推出并开源「混元图像 3.0」,性能效果如何?
知乎 2025-09-28 00:00:00
17. Google近日揭秘其AI图像模型“Nano Banana”名称的由来:该名原本是产品经理Nina在凌晨2:30临时取的占位符,用于匿名测试模型在LM Arena基准网站的表现。模型的正式名称为Gemini 2.5 Flash Image,因在网上意外走红,Google决定正式采纳。在“Made by Google”播客中,产品总监David Sharon透露,团队在Gemini应用中添加了香蕉图标以示该模型。该模型擅长精准再现人脸,使生成角色接近真人,还支持泰国流行的90字“娃娃”提示、宝丽来拼贴风格图像,以及修复旧家庭照片。为确保安全,所有生成图像均带有可见水印和不可见SynthID标记。Sharon建议初学者从Gemini应用的简单模板入手,如“娃娃”功能:上传照片即可转化为新角色,并实验不同风格。
新浪微博 2025-11-10 00:00:00
18. 谷歌Nano Banana Pro上线,深度结合Gemini 3,这下生成世界了
微信公众号 2025-11-20 00:00:00
19. Gemini上位苹果Siri,背后藏着谷歌三大狠招。 #大咖观察 #Siri #Gemini #iPhone #红衣聊AI
抖音 2026-01-22 00:00:00
20. 解读Nano Banana Pro,AI生图新里程碑 Google年底冲业绩,又甩出一个王炸图像模型Nano Banana Pro 内核由Gemini 2.5 Flash升级到Gemini 3,图像生成和图像编辑实现断层领先。 升级一、最强文字渲染 升级二、最强大脑加持 升级三、最强一致性 升级四、摄影级可控 #AI新星计划 #人工智能 #Google #Gemini #nanobanana
抖音 2025-11-21 00:00:00
21. Gemini 3实现智能水平断层碾压。Artificial Analysis智能指数73分(行业平均42分),在Humanity's Last Exam等基准测试中刷新纪录。核心突破在于生成式UI,可创建交互式界面和微型应用,从"回答问题"跃升至"生成体验"。原生多模态能力无缝处理文本、图像、视频、音频,并集成Nano Banana图像模型;支持100万token超长上下文。智能体能力实现自主规划与多工具协同,代码生成在SWE-bench达76.2%,搭配Antigravity平台构建自动化编码代理。响应速度达128 tokens/秒,但输出成本较高。Gemini 3无疑是当前最强大脑,适合需要顶尖推理和企业保障的场景;Grok 4.1以2M上下文和超低成本称王,适合海量文本处理;ChatGPT 5.1仍是均衡的通用选择,生态最成熟;国内Kimi K2在开源和Agentic方向独具特色,适合定制化部署#Gemini3凭什么被称为最强AI#
新浪微博 2025-11-19 00:00:00
22. 如何评价 OpenAI 刚推出的 GPT Image 1.5,有哪些亮点?
知乎 2025-12-17 00:00:00
23. GPT-5.1正式发布!智商情商双爆表,AI终于有“温度”了
微信公众号 2025-11-21 00:00:00
24. Qwen Image Edit 2511 万物一致性之王 无影灵构DiT赋能!挑战5秒生图!
哔哩哔哩 2025-12-25 00:00:00
25. 在写感谢 Pichai 的推文时,我写了一段话,大意是:> 真正的“魔法时刻”,发生在你将 Nano Banana Pro 的可视化能力、世界知识,与 Gemini 的实时联网能力融为一体之时。Nano Banana Pro 不仅能将你天马行空的创意变为现实,让我们每一个人能自由的去创造。然后有位网友问我:> 在整个工作流中,你觉得最难的部分是什么?这里面最难的部分不是提示词,甚至不是创意,而是你得知道AI的能力的边界,模型擅长什么不擅长什么,再在模型的能力范围以内和你的想法之间找到一个最佳的结合点。比如说这个城市天气预报的例子,我在 GPT-4o Image 的时候就写过类似的,那时候它就能生成很不错的效果,但是它不能自己去获取日期和天气再去生成图形,所以我得要写一个获取天气的API,把它做成GPTs,这就限制了它的可玩性。所以当Gemini 集成了 nano banana pro 之后,我马上就重新测试了这个想法,发现Gemini模型现在能获取当前日期和天气然后生成图像,那么这个想法就可以很容易实现。另外一个难点就是你的作品不应该只是单个的场景,不是只有作者自己为了展示自己的提示词多牛,而是应该让读者能参与其中,是一个提示词模板而不是提示词,每一个人都可以结合自己的场景、兴趣去尝试,去修改,这也是很有挑战的事情。比如说像这套城市天气的提示词,每个人都可以测试自己的城市,不同的日期,甚至可以衍生出很多好玩的版本,比如穿越回过去,把地方放到火星、虚拟的游戏地址。
新浪微博 2025-12-06 00:00:00
26. Gemini是强。我叫它生成了图1,然后问它能否生成机器人看到的图像,它给了我图2.而chatGPT就差多了,它生成的是图3.后来想这样可能不公平,那么我用chatGPT也自己生成原图4,看看这两家的分别表现如何。可以看到图5中,chatGPT对自己生成的图也不能准确地生成转换视角后的图片,但Gemini仍然是正确的(图6)。大家可以去试试.图7是豆包生成的。
新浪微博 2026-02-17 00:00:00
27. #Google DeepMind 最新力作:Nano Banana 2 🍌正式登场,将专业级图像生成能力与闪电速度完美结合#北京时间2026年2月26日,Google 在官方博客正式宣布推出 Nano Banana 2 —— 这款被誉为“迄今为止最佳图像生成与编辑模型”的新一代 AI 图像工具。Nano Banana 2(内部代号 Gemini 3.1 Flash Image)将 Nano Banana Pro 的高级智能与 Gemini Flash 的极致速度融为一体,为用户带来前所未有的高效创作体验。#从病毒级爆款到全面进化#还记得2025年横空出世的 Nano Banana 吗?这款以“🍌”为标志的图像生成模型迅速在全球走红,尤其在印度等市场掀起创作狂潮,用户们用它生成了数以百万计的奇思妙想图像。随后推出的 Nano Banana Pro 进一步提升了画质、细节和指令遵循能力,成为专业级用户的首选。而今天的 Nano Banana 2,则是 Google 对这两大优势的一次“终极融合”:- Pro 级的世界知识与推理能力:继承 Nano Banana Pro 的强大视觉理解与真实世界知识,能根据实时网页搜索信息生成更准确、更符合现实逻辑的图像。- Flash 级的极致速度:生成与迭代速度大幅提升,用户几乎可以实现“边想边改”的流畅体验。- 主体一致性大幅升级:可在同一工作流中保持高达5个角色的连续性,以及14个对象的细节保真,非常适合故事板、分镜、品牌资产批量生成等场景。- 精细创意控制:支持精确的镜头角度、光影变换、氛围切换、焦点调整,甚至从512px一键升至4K分辨率。#融入 Google 生态,即刻可用#Nano Banana 2 已开始逐步向全球用户推送,目前可在以下场景直接体验:- Gemini 应用:点击“🍌 Create images”入口,选择 Fast / Thinking / Pro 模式,即可调用 Nano Banana 2。新推出的模板功能让小白用户也能快速上手。- Google 搜索 AI 模式:结合搜索结果的世界知识直接生成相关图像。- Google Ads 与 Flow:帮助广告主与创作者高效产出高质量视觉素材。- Google AI Studio:开发者可以通过 Gemini API 大规模调用 Nano Banana 2,性价比极高。Google 同时强调,Nano Banana 2 生成的所有图像均嵌入 SynthID 数字水印,并支持 C2PA 内容凭证,方便后续追踪与辨识 AI 生成内容,展现了其在负责任 AI 上的持续投入。Nano Banana 系列从一个有趣的彩蛋功能,逐步成长为 Google AI 图像赛道的旗舰产品。如今 Nano Banana 2 的到来,再次证明了“又快又强”不再是鱼与熊掌的选择题。无论你是想要几秒钟出一张高质量壁纸的普通用户,还是需要批量产出一致性角色与场景的专业创作者,Nano Banana 2 都值得立即更新体验。想现在就试试?打开 Gemini App,点开图像创作工具,看看这个“香蕉”还能带来多少惊喜吧~(数据与特性来源于 Google 官方博客及相关产品页面,实际体验以最新版本为准)
新浪微博 2026-02-27 00:00:00
28. 【天风海外李泽宇】谷歌Gemini 3.0模型卡提前放出快评——多模态、知识库能力大幅超越GPT与ClaudeGoogle尚未发布新一代大模型 Gemini 3 Pro,但官网已经上线模型卡,并同步披露与 Gemini 2.5 Pro、Claude Sonnet 4.5 与 GPT‑5.1 的对比测试结果。整体看,Gemini 3 Pro 在多模态能力上大幅领先目前其它旗舰模型,并在数学、科学推理及长上下文等核心能力上有较为明显的跨代提升。在涉及图像理解能力的逻辑推理上(Humanity’s Last Exam、ARC‑AGI‑2、AIME 2025、MathArena 等)上,Gemini 3 Pro 大幅超越自家 2.5 Pro,GPT‑5.1、Claude 4.5 。AIME 2025 等高难数学榜单中,Gemini 3 Pro 在“有代码执行”场景下达到满分,显示其在 工具调用+数学推理 组合能力上已经具备行业顶级水准。多模态与视频理解:延续 Google 传统优势,视频场景领先两档档在 MMMU‑Pro、ScreenSpot‑Pro、Video‑MMMU 等多模态基准中,Gemini 3 Pro 相比 Gemini 2.5 Pro 有明显跳升,并普遍高于 GPT‑5.1 与 Claude 4.5。在截图理解上,Gemini 3 Pro达到72.7%,大幅超越其它旗舰模型的36.2%。特别是 Video‑MMMU 维度上,Gemini 3 Pro 在视频信息抽取与知识问答上表现突出,Agent & 代码:综合实力强,部分专项仍与 GPT‑5.1/Claude 形成互有胜负在 LiveCodeBench Pro、SWE‑Bench Verified、t2‑bench、Vending‑Bench 2 等“代码+智能体”基准上,Gemini 3 Pro 的 Elo/成功率普遍高于旧版本,并在多数维度与 GPT‑5.1 非常接近。但在部分单项(如 SWE‑Bench Verified 测试,Claude 4.5 仍保持小幅领先),表明行业在真实软件工程类任务上尚处于“多强并立”格局,尚未出现一骑绝尘的模型。长文本与检索:128k 上下文可用性增强,复杂检索任务能力改善。幻觉极低。在 MRCR V2、FACTS Benchmark Suite 等长上下文与检索基准上,Gemini 3 Pro 相对 2.5 Pro 提升明显,在 128k 长度下仍能保持较高准确率。并且在SimpleQA Verified上,其得分超过72%,大幅领先非Anthropic Sonnect4.5的29%与GPT5.1 的35%。长任务执行能力:整体也胜于GPT 5.1 与Sonnet 4.5我们怎么看未来生态与商业化?我们认为尽管在代码能力上Gemini 3Pro尚未完全超于竞争对手,但在多模态能力、文本Rag能力上3Pro已经大幅超越,叠加 Google 自有搜搜索+Workspace+Android 生态,有望在搜索AI mode商业化、文档问答、企业AI等场景实现市场开拓能力的大幅提升,并且涌现大量多模态新场景。继续看好谷歌与谷歌链的受益者。
新浪微博 2025-11-18 00:00:00
29. 【AI前沿】刚刚!GPT-5.2 震撼发布:为真实工作而生的前沿模型,超级助手来了!
微信公众号 2025-12-12 00:00:00
30. GPT5.2亮点解读,OpenAI重夺年度最强 OpenAI甩出王炸GPT5.2,核心基准测试,全面碾压Gemini 3 Pro和Claude Opus4.5,强势夺回地表最强 奥特曼放话GPT5.2不仅是最强通用大模型,还要成为你日常办公的AI合伙人 亮点1、最强视觉能力 亮点2、最强上下文 亮点3、最强办公能力 亮点4、最强编程能力 #AI新星计划 #抖音知识年度大赏 #人工智能 #OpenAI #大模型
抖音 2025-12-12 00:00:00
31. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人
抖音 2025-12-07 00:00:00
32. 字节今天(2026年2月10日)正式发布了图像生成模型 Seedream 5.0(预览版),这确实是字节跳动在AI领域的又一重磅动作,尤其是在Seedance 2.0热度还没完全消退的时候就快速跟进。官方直接定位对标Nano Banana Pro(可能是Google Gemini系列的某个高阶图像模型),而且价格更友好,目前在多个平台限时免费体验(比如每天20次免费生成)。Seedream 5.0的核心能力与升级点• 分辨率:支持2K直出 + AI增强4K输出,细节纹理和质感大幅提升。• 首次支持检索生图(联网实时搜索整合知识),能拉取最新信息生成信息图或知识驱动的内容。• 提示词理解更强:对抽象、复杂指令的理解准确性提升,生成更符合意图、布局清晰、细节丰富的图像。• 精准编辑:新增笔刷局部调整功能,能精确修改元素。• 其他亮点:风格化图像到图像功能增强,照明平衡更好;生成速度快,适合实用场景。它目前已在剪映、CapCut(海外版)、小云雀全面上线,在即梦AI(Dreamina)平台灰度测试中可以免费玩。想试的话,直接去即梦或剪映的AI生图功能选“图片5.0 Preview”即可。对标Nano Banana Pro的表现如何?从媒体实测和网友对比看:• 在知识密集型任务(如生成带详细步骤说明的信息图)上,Seedream 5.0很强,步骤解释最详细,每步都有文字标注,逻辑推理和联网能力是亮点。• 但在纯艺术设计感、复杂构图稳定性、人脸/角色一致性上,有些反馈认为比Nano Banana Pro稍弱,艺术美感和某些多元素融合还有差距。• 整体定位偏“智能+实用”而非极致美学(美学党可能还是更爱Seedream 4.5或Nano Banana Pro的顶级输出)。• 价格优势明显:官方称比对标竞品更便宜,免费额度高,适合日常高频使用、广告/电商/教育/营销场景。简单说:如果你需要生成带真实知识、逻辑清晰的信息图、海报、教程图,或者快速迭代实用内容,Seedream 5.0很香;如果追求顶级电影感、极致一致性或艺术范儿,可能Nano Banana Pro或前代4.5还更有优势。但作为预览版,完整5.0预计会进一步融合智能与美感。字节这波操作很猛:视频有Seedance 2.0,图像接连Seedream 4.5→5.0,生态闭环越来越完整。集成在剪映/CapCut这种亿级DAU的产品里,门槛低、传播快,很容易让普通用户和创作者大规模用起来。尤其免费+高额度,会加速国内AI生图的普及,估计过年这波“AI年”大家都在刷Seedream的作品了。#字节发布新模型Seedream5.0##过个有AI年##HOW I AI#
新浪微博 2026-02-10 00:00:00
33. AI生成的音乐现在到这水平了?实测给你答案
哔哩哔哩 2026-02-12 00:00:00
34. 【谷歌推出新一代图像生成与编辑模型NANO BANANA PRO】财联社11月20日电,谷歌推出NANO BANANA PRO(Gemini 3 Pro图像),全新一代尖端图像生成与编辑模型。谷歌表示,其全新图像模型Nano Banana Pro能够生成更清晰的图像,并支持多种语言的更精确、更易读的文本。#谷歌总市值超过微软#
新浪微博 2025-11-20 00:00:00
35. 如何评价Google在9月26日更新的Gemini 2.5 Flash/Flash-Lite模型?
知乎 2025-09-26 00:00:00
36. 腾讯王者归来:混元图像3.0登顶LMArena!一手实测全球最强图像AI
知乎 2025-10-05 00:00:00
37. #Google 发布 Nano Banana Pro:Gemini 3 Pro 图像生成模型#Google DeepMind 正式推出 Nano Banana Pro(基于 Gemini 3 Pro 的图像生成与编辑模型),这是 Nano Banana 的升级版,被戏称为“香蕉尺度”中最强的 AI 图像工具。主要亮点:- 更强推理能力:能生成高度准确、富有上下文的教育图表、信息图、实时数据可视化(如天气、赛事)。- 多语言精准文字渲染:支持各种字体、纹理、书法,甚至直接翻译并美观嵌入文字。- 高级图像编辑:一次融合最多 14 张图片,保持最多 5 人的身份一致;可局部控制光影、焦距、色调,日景变夜景、电影级打光等。- 工作室级输出:支持 2K/4K 分辨率、任意宽高比,所有图片带 SynthID 隐形水印(可验证是否 AI 生成)。- 立即可用:Gemini App、Google Ads、Workspace、Slides、Gemini API、Vertex AI 等均已开始推送,免费用户有限额,付费用户(Pro/Ultra)体验更佳。虽然名字听起来像愚人节玩笑,但功能极其强大,目前是最强的消费级 AI 图像生成工具之一。感兴趣的朋友可以直接在 Gemini App 里试“Create images”功能,选“Thinking”模型就能体验 Nano Banana Pro!
新浪微博 2025-11-22 00:00:00
38. 空间推理基准测试 SpatialBench 更新了最新一期榜单,阿里千问的视觉理解模型 Qwen3-VL、Qwen2.5-VL 位列头两名,超越 Gemini 3、GPT-5.1、Claude Sonnet4.5 等国际顶尖模型SpatialBench 榜单显示,Qwen3-VL-235B 和Qwen2.5-VL-72B 分别斩获 13.5 和 12.9 分,领先于 Gemini 3.0 Pro Preview(9.6) 、GPT-5.1(7.5)、Claude Sonnet 4.5 等海外顶尖模型
新浪微博 2025-11-28 00:00:00
39. 【AI辅助设计】Nano Banana Pro 实战全攻略:AI生图的10+创意应用场景
微信公众号 2025-11-21 00:00:00
40. 【AI辅助设计】就在刚刚!GPT Image 1.5 正式发布:是设计神器,还是“挤牙膏”?
微信公众号 2025-12-17 00:00:00
41. 又变强了!Nano Banana 2究极强大玩法~【免费渠道合集】
哔哩哔哩 2026-03-02 00:00:00
42. 东大和漂亮国,AI实力的全面对比#AI #Deepseek #chatgpt #Gemini #AI技术
抖音 2025-12-29 00:00:00
43. 海外华人15人团队打造,统一理解与生成的图像模型,超越Nano banana登顶图像编辑
微信公众号 2026-03-06 00:00:00
44. 美团开源 longcat-image 图像生成模型,将对 AI 领域带来哪些影响?
知乎 2025-12-09 00:00:00
45. Gemini 3即将发布,谷歌吹响反击号角,巴菲特用了都说好?#跟傅盛学AI##Gemini3##谷歌# 傅盛的微博视频
新浪微博 2025-11-17 00:00:00
46. 谷歌将于下周(11月22日当周)推出Gemini 3和Nano Banana Pro这两款重磅AI产品?其中Nano Banana Pro由Gemini 3 Pro驱动,专为专业创作者和企业用户设计,提供更高分辨率和品质的图像生成能力。在Google Vids应用中已发现隐藏宣传,强调其能快速为视频生成精美图像和视觉效果。该更新将同时覆盖Vids、Slides和Design等工具,提升创意工作流程的输出保真度。这标志着谷歌在创意AI领域的战略推进,旨在与竞争对手一较高下,提供生产级生成工具,助力企业和个人内容创作者。
新浪微博 2025-11-16 00:00:00
47. 谷歌发布 Gemini3Pro,其多模态理解和生成能力将如何影响 AI 发展?
知乎 2025-12-07 00:00:00
48. 豆包图像创作模型4.0:4个简单实操案例!主体一致素材轻松做
微信公众号 2025-09-14 00:00:00
49. P图能力太炸裂,豆包Seedream4.0模型4大终极玩法分享!#豆包P图#豆包 #AI新星计划#豆包P图已经nextlevel了#豆包P图4.0
抖音 2025-09-10 00:00:00
50. 实测GPT Image 1.5,拼尽全力还是没能打败Banana。
知乎 2025-12-17 00:00:00
51. 知情人士称 GPT-5.2 有望弥补谷歌 Gemini,这将如何改变 AI 大模型竞争格局?
知乎 2025-12-06 00:00:00
52. 刷到一个挺有意思的帖子,整理了未来四个月可能上线的AI模型。OpenAI、Anthropic、Google、马斯克的Grok,还有国产的DeepSeek,几乎都在更新节奏里:1、ChatGPT 5.1、ChatGPT 5 Deep Think(推理版)2、 Claude 4.5 / 4.63、Gemini 3 flash / pro4、 Grok 55、 DeepSeek v4(待定)这波的核心看点,是推理能力全面上台面:ChatGPT 深思版主打复杂逻辑链,Claude 强调多轮连贯性和长文生成,Gemini 继续走轻量快推路线。如果节奏都能对上,年底这几个月可能会看到AI在理解力和连贯思考上的质变。
新浪微博 2025-11-04 00:00:00
53. AI生图大战升级!OpenAI紧急推出GPT Image 1.5,对战谷歌Banana Pro,是露一手还是出洋相?
微信公众号 2025-12-17 00:00:00
54. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群
抖音 2025-12-22 00:00:00
55. OpenAI神秘生图AI爆出!实测不敌谷歌一根香蕉,网友:就这?
知乎 2025-12-10 00:00:00
56. #凌晨2:30随手起的搞笑代号,怎么就火遍全球了?谷歌Nano Banana命名内幕#Google 官方博客近日(2026年1月15日)发布了一篇有趣的文章,标题为《How Nano Banana got its name》(Nano Banana 这个名字是怎么来的),详细讲述了旗下最受欢迎的图像生成/编辑模型“Nano Banana”这个超魔性名字的诞生过程。故事的起源:凌晨2:30的紧急命名去年7月,Google DeepMind 团队正准备把一款当时技术名为 Gemini 2.5 Flash Image 的图像模型,匿名提交到公开评测平台 LMArena 上进行盲测(这样别人不会知道这是谷歌的产品)。提交前一刻,已经是凌晨2:30了,团队才发现需要一个临时代号(codename),不能直接用官方技术名称,不然一眼就被认出是谷歌家的。于是产品经理 Naina Raisinghani 被紧急@到,她随手提出了一个听起来很无厘头的名字——Nano Banana。为什么是这个名字?其实来源于她自己的两个私人昵称:朋友们叫她 Naina Banana(大概是“Naina”和“Banana”的可爱组合) 另外一些人叫她 Nano(因为她身材娇小 + 超级喜欢计算机)她就把两个昵称直接“砸”在一起 → Nano Banana 团队当时觉得“这也太离谱了吧”,但时间紧迫,还是用了这个名字提交。意料之外的病毒式爆火结果这个模型一上线 LMArena,就凭借超强的图像编辑能力(特别是保持人物肖像一致性、多图编辑、复杂指令理解等)迅速冲到排行榜第一。用户们一边惊叹技术牛,一边对“Nano Banana”这个名字疯狂玩梗、刷屏,社交媒体彻底“香蕉化”(went bananas)。原本只是个临时隐藏代号,没想到用户们爱屋及乌,把名字和模型绑定得死死的。 几周后谷歌官方才在 X(Twitter)上承认:对,就是我们做的~既然大家都这么喜欢,谷歌索性正式拥抱这个名字:AI Studio 里的运行按钮变成了香蕉黄色 Gemini App 的“创建图像”按钮旁边加了🍌表情 甚至出了限量版香蕉主题周边(swag)后来推出的升级版也顺势叫作 Nano Banana Pro(对应 Gemini 3 Pro Image),继续延续这个魔性品牌。小结:认真搞技术,也要会玩梗这篇文章最有趣的地方在于,它展现了谷歌内部其实也很有“人味儿”——一个凌晨随口起的搞笑代号,因为模型本身够强 + 用户社区的疯狂二创,最终逆袭成了官方品牌名。现在提起谷歌最强的消费级图像AI,很多人第一反应已经不是“Gemini什么什么Image”,而是直接:Nano Banana!🍌一个完美的互联网时代AI产品故事:技术硬核 + 名字魔性 + 全球同步上线 + 官方主动玩梗 = 现象级爆款。 谁能想到,一根小小的香蕉,竟然成了2025-2026年AI圈最出圈的名字之一呢?😂🍌
新浪微博 2026-01-17 00:00:00
57. AAAI'26开源 | 比4D GS更细更稳!FLAG-4D如何让4D重建兼顾精度和时间一致性?
知乎 2026-02-27 00:00:00
58. Google 杀疯了! Gemini 3.0 设计美感史诗级进化!一句话生成完整应用、精美3D 网页
微信公众号 2025-11-29 00:00:00
59. OpenAI大溃败!GPT-5「换皮」GPT-4o,两年半预训练0突破
知乎 2025-12-01 00:00:00
60. 国外一个网友总记得《Gemini 3 提示词最佳实践:日常使用指南》,内容如下:我用 Gemini 3 Pro 有一段时间了,直接说吧,它比 2.5 Pro 强太多了!这篇文章分享的是目前对我最有效的一些原则和结构模式。这不是什么金科玉律,更多是给你一个起点,帮你找到适合自己的策略。拿去试试,调整优化,不断迭代。核心原则Gemini 3 更喜欢直接明了的指令,逻辑胜过冗长。要想发挥最佳性能,遵循这些核心原则:1、精确指令:输入提示词时要简洁。Gemini 3 对直接、清晰的指令响应最好。明确说出你的目标,别绕弯子。2、一致性与明确参数:在提示词中保持统一的结构(比如标准化的 XML 标签),并明确定义那些容易产生歧义的术语。3、输出简洁度:默认情况下,Gemini 3 不太啰嗦,倾向于提供直接、高效的答案。如果你需要更像聊天或者更随性的风格,必须明确提出要求。4、多模态协调:文本、图像、音频或视频都应该被同等对待。指令中应该明确提到具体的模态,确保模型能综合处理它们,避免孤立分析。5、约束条件放置:把行为约束和角色定义放在系统指令中,或者提示词最开头的位置,这样能确保它们锚定模型的推理过程。6、长上下文结构:处理大量上下文(书籍、代码库、长视频)时,把你的具体指令放在提示词末尾(数据内容之后)。7、上下文衔接:从大段数据过渡到你的问题时,要明确做好衔接。用一个过渡短语,比如"基于以上信息……",然后再提问。内容很长,可以看原文,也可以看我的配图。原文链接见评论区。#提示词##提示词工程##科技先锋官##微博兴趣创作计划#
新浪微博 2025-11-21 00:00:00
61. 【教程】Gemini3给小朋友的词典(附关键词)
小红书 2025-11-27 00:00:00
62. 免费生成AI视频?工作流大分享!
哔哩哔哩 2025-09-29 00:00:00
63. 字节seed最新工作RewardDance揭秘视觉生成的RLHF关键:扩展reward model!
知乎 2025-09-11 00:00:00
64. 回复@嘻嘻dzj:gpt-4o image我写过类似提示词,但是是每个品牌都要单独写,现在是一套通用的提示词模板,只要输入品牌名,自动生成品牌对应风格的迷你店,模型在进步,提示词也应该跟着进步,至于图画只是结果//@嘻嘻dzj:这套图已经出来好几年了吧以前就有一模一样的
新浪微博 2025-12-01 00:00:00
65. GPT-5.2真身是它?OpenAI紧急端出全套「下午茶」,新一代图像模型同步泄露
微信公众号 2025-12-10 00:00:00
66. 【白TV】990g轻的电脑装了一颗45W性能的强大的心——华硕a豆14 Air 2026轻薄笔记本上手体验
哔哩哔哩 2026-02-06 00:00:00
67. Gemini3.0手搓适合5岁小朋友的英文小工具
小红书 2025-11-24 00:00:00
68. Gemini 3 Pro比之前的2.5确实好非常多,分析,做图像视频都很厉害。但个人感觉,还不到能取代gpt 5.1 thinking的强度。尤其GPT “长期记忆”这一块很强,也已经被我训成很懂我的工作合伙人了,这部分太难替代。各有千秋吧,我自己还是要两个都用。AI总结:Gemini 更像“超级检索式分析器”GPT-5.1 更像“策略家 + 思考伙伴”纯信息密度 & 资料整合能力:Gemini 3 Pro 更强多层推理、跨主题整合、结构化深度分析:GPT-5.1 Thinking更强Gemini 3 Pro 的优势多模态 & 超大上下文处理。Gemini 3 Pro 支持文本、图像、视频、PDF 等多种输入模态,也能处理非常长的上下文 (比如大量文档 / 长篇报告 /大数据集) — 这是它的一大杀手锏。逻辑推理 + 数理 / 复杂任务处理能力强。在多个基准测试 (数学、逻辑推理、视觉 + 推理、多模态理解等) 中,Gemini 3 Pro 的成绩在很多项都超过 GPT-5.1。擅长“重”/“大规模”内容处理 + 综合型任务。如果你的任务需要跨文档整合、图文混合分析 (比如政策 + 数据表 + 图表 + 图片)、长时间 context 的研究 — Gemini 会表现得更稳定。GPT-5.1 Pro / Thinking 的优势自适应推理 + 工具 / 代理 整合 + 高效对话 / 编码工作流程。GPT-5.1 最新版本 (Pro / Thinking) 强调“根据任务难度自动分配思考资源 + 支持工具调用 / 代码执行 / 多轮对话 + 稳定性 / 开发者友好性”。更适合迭代、动态交互、对话与写作 / 编码。比如你做写作、策略分析、代码编写、快速原型、反复调整 prompt/输出 — GPT-5.1 在速度、连贯性、开发者体验上往往更顺手。在“记忆准确性 / 长对话稳定性 / 多轮交互”方面表现不俗。对于需要持续对话、多轮迭代、状态保持、复杂 prompt chain 的任务,GPT-5.1 更擅长维护连贯和响应一致性。#人工智能#
新浪微博 2025-12-02 00:00:00
69. 【Nano Banana Pro】AI生图新王来临!使用+玩法案例大全
哔哩哔哩 2025-11-28 00:00:00
70. Gemini3.0与GPT图像生成对比
什么值得买 2025-11-25 00:00:00
71. 🔥GPT和Gemini生图差距也太大了
小红书 2025-09-21 00:00:00
72. 深度对比|Gemini vs GPT-4o
微信公众号 2025-11-03 00:00:00
73. GPT Image 1.5
微信公众号 2025-12-17 00:00:00
74. 【真实测评】GPT 4o秒杀图像类套壳应用?
人人都是产品经理
75. 实测GPT Image 1.5,拼尽全力还是没能打败Banana。
今日头条
76. Gemini 2.0原生绘画能力惊艳我了,兑现了我对GPT-4o曾经的幻想
腾讯网
77. 9个案例实测谷歌Gemini文生图,设计行业“快变天了”
新浪财经
78. 实测GPT Image1.5,拼尽全力还是没能打败Banana。
虎嗅网
79. 【AGI-Eval评测报告 NO.3】第一手实测GPT-4o文生图能力!最权威报告输出
80. 4o/Gemini/豆包谁生图强?我感觉不用比了......
81. 谷歌被曝翻车内幕:内部群龙无首,生图机制过分“多元化”
82. s AI Controversy: A Detailed Analysis
83. 谷歌openAI大招对轰!GPT4O生图能力横扫全场
腾讯网
84. Gemini 3.0之后,人类只剩三条路
网易
85. 国诚投顾:谷歌图像模型NanoBanana火爆上线
知乎 2025-09-10 00:00:00
86. 免费使用最强生图模型Google Gemini Nano Banana 2
微信公众号 2025-11-21 00:00:00
87. 谷歌最新发布:功能强劲的图像模型!
知乎 2025-10-22 00:00:00
88. Nano Banana Pro的"黑科技":从图文不符到"理解型"生成的AI创意设计
微信公众号 2025-11-25 00:00:00
89. 统一多模态大模型:GPT-4o、Gemini 实现文本 - 图像 - 视频一体化生成
知乎 2025-10-15 00:00:00
90. Gemini 2.5 Flash Image(Nano banana 2)简介及API对接教程
知乎 2025-11-18 00:00:00
91. Gemini深度用户的Banana图像多方面测试 - 哔哩哔哩
哔哩哔哩 2025-11-29 00:00:00
92. Gemini 2.5 Flash Image(Nano banana)简介及API对接教程
知乎 2025-11-18 00:00:00
93. Nano Banana 2 :图片更清晰,文字更出彩,价格更便宜
微信公众号 2026-02-27 00:00:00
94. ai为什么读不准图像
知乎 2025-12-06 00:00:00
95. Gemini App AI绘图进入“高清无码”时代!最新一代图像生成模型-- Nano Banana 2 正式上线
微信公众号 2026-02-27 00:00:00
96. 超越人眼:AI摄影时代的到来(nano banana pro实例(全),带prompt)
微信公众号 2025-11-23 00:00:00
97. Gemini 3 生图实测
小红书 2025-11-23 00:00:00
98. Gemini 3.0展现惊人推理能力,多模态融合创新高
知乎 2025-12-10 00:00:00
99. Nano Banana2即将上线,图像生成进入“秒速时代”
微信公众号 2025-11-07 00:00:00
100. Google's Nano Banana 2.0 效果实测
哔哩哔哩 2026-02-28 00:00:00
101. 🍌Nano Banana 2 强在哪?。谷歌昨天发布了他们最强大的图片生成和编辑模型 Nano Banana 2(正式名称:Gemini 3.1 Flash Image)。 刚刚,Arena 平台公布了 Nano Banana 2 的最新表现。它在 Image Arena 的文本到图像部分拿到第一名。分数是 1279。这个分数比 GPT Image 1.5 高。也超过了之前的 Nano Banana Pro。 在单张图像编辑上它得分 1407,和 ChatGPT Image Latest 并列第一,在多张图像编辑中它进入前三名。 Nano Banana 2 和价格是每张图像 0.067 美元,大概是 Nano Banana Pro 的一半。 Nano Banana 2 比前一个版本进步很大。在 3D 成像和建模上分数多了 71 分。文本渲染多了 60 分。产品 品牌 和商业设计多了 57 分。卡通多了 52 分。这些提升让它在实际使用中更有优势。 GPT Image 1.5 在肖像类别还比 Nano Banana Pro 高 16 分。在卡通上也有一些领先。 Arena 把图像生成任务分成七个子类别。这样划分后大家能看清模型在不同场景的表现。产品品牌和商业设计类别适合企业做营销图片。生成的图像能匹配品牌风格。3D 成像和建模能做出有立体效果的图片。设计师可以用它来创建产品原型。文本渲染强就意味着图像里的文字清楚正确。不会出现错别字或者变形。这对制作海报或者说明书很有帮助。卡通风格的提升让它在娱乐内容上更好用。 Nano Banana 2 属于 Flash 系列,生成速度很快,质量却能达到 Pro 的水平,它还整合了网页搜索的实时数据和图像。所以结果更符合当前情况,生成的图像能包含最新的事件或者产品信息,不用手动输入太多细节。 对于开发者或者创作者来说这很实用,可以快速生成和修改图像,并且成本大幅降低。 当然它不是在每个类别都领先,但是它在几个关键领域做了针对性改进,而且价格亲民,这让图像生成工具的选择空间变大。 #Gemini #AI生图 #AI工具 #AI资讯 #前沿科技
抖音 2026-02-27 00:00:00
102. AI圈再次炸裂!谷歌 Nano Banana 2 来了,更快,更强,免费用!
微信公众号 2026-02-27 00:00:00
103. 2026开年王炸!AI绘画格局彻底大洗牌。2026年1月的榜单出炉,变动大到离谱! ✅ OpenAI 再次封神: GPT-Image 1.5 强力登顶,摄影级写实+超长指令遵循,画质天花板! ✅ Google 降维打击: Gemini 3 Pro 图像理解断层领先,复杂构图再也不是问题。 ✅ Midjourney 跌落神坛? v7版本虽然审美依旧在线,但评分竟然出现了下滑... ✅ 开源之光: Flux.2 Max 稳坐梯队前列,细节纹理简直是细节控的福音。 你是选审美无敌的MJ,还是选理解力满分的Gemini?评论区聊聊,你现在的生产力工具是哪一个?👇#AI #Ai生图 #gpt #gemini #AI新星计划
抖音 2026-01-01 00:00:00
104. 【AI探索】AI 生图总画 “怪东西”?一文看懂真相
微信公众号 2025-11-14 00:00:00
105. UniLumos: 物理反馈统一图像视频重打光框架,20倍加速光影重塑
今日头条 2025-11-25 00:00:00
106. Nano Banana Pro 正式登场!
小红书 2025-11-21 00:00:00
107. 【随手测评】Gemini 3 在内容生成上表现如何?
知乎 2025-11-25 00:00:00
108. Gemini3.0与GPT技术架构核心差异:原生融合VS模块扩展的范式之争
什么值得买 2025-11-23 00:00:00
109. GenExam:首个跨学科文生图考试基准,揭示GPT-4o/Gemini等顶尖模型在整合知识、推理与生成能力上的巨大鸿沟
知乎 2025-09-27 00:00:00
110. 深度评测:Gemini长上下文推理中的“大海捞针”能力与逻辑一致性
什么值得买 2026-02-28 00:00:00
111. Google Nano Banana Pro 重塑AI视觉生成,让创意“理解式”爆发
微信公众号 2025-11-21 00:00:00
112. 让AI图像生成器学会"常识推理"!双过程蒸馏技术实现分钟级多模态控制
微信公众号 2025-09-19 00:00:00
113. 刚刚!OpenAI发布图像生成模型 GPT Image 1.5,附上一手实测
微信公众号 2025-12-17 00:00:00
114. Gemini 2.5 Flash Image ("Nano Banana") 训练数据集构建与架构深度技术报告
知乎 2025-11-27 00:00:00
115. 告别AI“乱画图表”!港中文团队发布首个结构化图像生成编辑系统
微信公众号 2025-10-11 00:00:00
116. 谷歌推 Nano Banana 2 提升图像生成 并成 Gemini 默认选项
今日头条 2026-02-27 00:00:00
117. 用3D白膜控制AI生图,这个方法非常好用
小红书 2025-11-27 00:00:00
118. 腾讯图像大模型 hunyuan-image-3.0 排行榜第一,相比即梦 4.0,Gemini 2.5 优势是啥?
微信公众号 2025-10-10 00:00:00
119. 谷歌正式发布 Gemini 2.5 Flash 图像模型:重塑 AI 视觉创作,自然语言交互与高性价比成核心突破
微信公众号 2025-10-11 00:00:00
120. AI生成内容已“真假难辨”?最新细粒度真实感与合理性评估来了!
知乎 2025-12-05 00:00:00
121. AI生图中可控性差常见遇到哪几个问题?
小红书 2025-11-04 00:00:00
122. 别信营销号吹牛!2025 专业的AI生图软件测评推荐:测了 4 款
今日头条 2025-12-24 00:00:00
123. 谷歌发布Nano Banana 2模型 Nano Banana 2是谷歌 DeepMind 发布的新一代图像生成模型,核心是Pro 级 4K 画质 + Flash 级速度 + 成本腰斩,已成为 Gemini、Google Search 等全线产品的默认图像引擎。 Nano Banana 2将图像输出分辨率从2K提升至4K,能够处理更精细的视觉细节,为用户提供更高质量的图像生成服务。 Nano Banana 2继承了Flash系列模型的高速生成特性,能够在短时间内完成高质量图像的生成。据谷歌介绍,该模型能够在4-6秒内完成4K分辨率图像的生成。 新模型支持多语言文本的生成和翻译,为出海企业等需要国际化应用场景的用户提供了便利。此前该功能仅限Gemini付费订阅用户使用,现向所有免费版Gemini用户开放。 Nano Banana 2直接继承了Gemini大语言模型的世界知识库,并能够实时调用谷歌图像搜索作为“视觉参考库”,从而生成更加准确的图像。 #AI #ai #人工智能 #nanobanana #nano
抖音 2026-02-28 00:00:00
124. Google DeepMind推出了新的图像生成和编辑模型Nano Banana Pro
微信公众号 2025-11-29 00:00:00
125. 008-谷歌Nano Banana 2:4K画质与极速生成的完美结合 | Nano Banana 2: 4K Quality at Flash Speed
哔哩哔哩 2026-03-02 00:00:00
126. OpenAI推出GPT-4o图像生成功能
知乎 2025-10-08 00:00:00
127. 如何解决AI生图时人体结构畸形的问题?
小红书 2025-09-28 00:00:00
128. 【Max_AI】Gemini3.0行研能力测评,相比搜集、更会画图?
哔哩哔哩 2025-11-26 00:00:00
129. AI 肖像实测 Vol.08 | 古希腊遗迹光影与材质一致性实测
知乎 2026-03-05 00:00:00
130. Nano Banana爆火,好用与“聪明”谁更重要?谷歌顶尖产品经理眼中的AI新范式
微信公众号 2025-09-17 00:00:00
131. AI科研绘图实测对比!GPT-4o实力碾压GPT-5与Nano Banana,仅需四步打造顶刊级图文摘要(附AI提示词)
微信公众号 2025-10-09 00:00:00
132. Google用生成式AI拍动画片,DeepMind新作登上日舞影展
微信公众号 2026-02-02 00:00:00
133. AI生图不可控有哪几种现象?如何解决?
小红书 2025-10-20 00:00:00
134. 谷歌图像模型特性与提示词指南
微信公众号 2025-12-14 00:00:00
135. 面试官:如何保障 AI生图 结构的准确性?
小红书 2025-09-25 00:00:00
136. AI 视频生产全流程:从逻辑解构到视觉一致性生成的闭环实操
今日头条 2026-01-25 00:00:00
137. 为什么 AI 突然不画“六指琴魔”了?真相:它学会了思考
微信公众号 2026-02-07 00:00:00
138. 解决AI生图时物体透视错误的问题
小红书 2025-10-08 00:00:00
139. 面试官:如何解决AI生图多手多脚的问题?
小红书 2025-10-16 00:00:00
140. 图像生成的下一个拐点
小红书 2025-10-30 00:00:00
已收藏
去我的收藏夹