一场别开生面的AI能力测试在《我的世界》中展开。通过让DeepSeek、豆包和Gemini三款AI猜测游戏内的像素建筑,直观展现了它们在图像识别与逻辑推理方面的惊人差异。从简单的苹果Logo到抽象的土星模型,AI们的表现时而令人捧腹,时而让人震撼,为理解当前AI水平提供了生动有趣的视角。
智能速览
DeepSeek率先得分,精准识别像素化的苹果Logo。
豆包将黑白建筑误认为金色苹果,暴露了认知局限。
Gemini凭借惊人分析能力,成功识别抽象的土星模型。
面对哥斯拉时,三款AI全部猜对,展现了对经典形象的共性识别力。
Gemini在最后关头逆风翻盘,猜出豆包的卡通形象夺冠。
精华内容
这场AI建筑猜谜赛,不仅是游戏,更是对AI理解能力的极限挑战。从具象到抽象,从经典到冷门,AI们的答案背后隐藏着怎样的逻辑与智慧?让我们一同回顾这场精彩对决。
首战告捷
比赛第一题是一个相对简单的苹果公司Logo。DeepSeek率先作答,准确识别出这是一个被咬了一口的苹果标志,轻松得分。豆包虽然也答对了苹果,但多此一举地补充可能是《我的世界》里的金苹果,暴露了其对颜色信息的误判。而国外AI Gemini则给出了极为详细的分析,从像素艺术、黑白配色到标志属性,描述精准,展现了其强大的信息提取与归纳能力。
土星难题
第二题难度骤升,是一个用方块堆砌的抽象土星模型。创作者自己都表示“让AI猜出来很逆天”。结果,DeepSeek误判为庆典蛋糕,豆包则猜成汉堡包,两者的回答都停留在对建筑形态的表层想象。然而,Gemini的分析令人震撼。它准确描述了中央球体、环绕光环、大气带条纹等关键特征,并直接锁定答案为“行星土星”。这一波分析,连人类都未必能做到如此精确,充分展现了Gemini在处理复杂图像时的深度推理能力。
全员开智
第三题回归经典形象——怪兽哥斯拉。这一次,三款AI表现出惊人的一致性。DeepSeek、豆包和Gemini都根据巨大的体型、黑色的皮肤、红色的眼睛和标志性的直立姿态,准确识别出这是哥斯拉。尤其是DeepSeek,相比上期未能猜出霍金模型,这次的成功也侧面反映了其AI模型的进步。此题展现了AI对于全球流行文化经典形象的强大共性识别力。
终极翻盘
最后一题是本次比赛的最高潮,分值为3分。建筑是一个中国AI工具的像素卡通形象。在没有提示的情况下,三款AI均未答对。DeepSeek甚至开玩笑说这是自己的像素形象。在增加“中国AI工具”提示后,Gemini作为国外AI,竟逆风翻盘,根据红黑配色和像素风格,准确推断出这是豆包的英文名“Steamed Bun”(包子),从而一举夺得冠军。这一结果不仅展示了Gemini强大的跨文化理解和信息关联能力,也为整场比赛画上了戏剧性的句号。
这场《我的世界》AI猜谜赛,以游戏化的方式直观呈现了不同AI模型的实力与短板。Gemini的分析深度、豆包的认知偏差、DeepSeek的稳定表现,都为普通用户选择和使用AI提供了有趣的参考。未来,AI的理解能力将走向何方?或许下一个惊喜就藏在某个方块里。
关键评论
有观众指出,DeepSeek参赛时使用的是特定模块,而视频中豆包猜错苹果和Gemini猜对豆包的情节存在戏剧性成分。
部分网友觉得建造的哥斯拉形象,与另一款卡通形象“爆笑奶龙”有几分相似。
有用户猜测豆包猜错苹果可能是因其模型对logo的认知停留在旧版本,并非真正的“装傻”。