“看不懂就拍照问AI”,正在变成一种新的本能。10月6日,国庆假期尾声,一条小红书笔记的标题只有半句话:“已成为只会拍照问AI这是什么的人了”。出国的人拍路牌、拍景点简介问,逛博物馆的人拍文物问"先看哪件",还有人对着自家冰箱拍一张,问AI"今晚吃什么"。同一周,另一条笔记把爸妈的三高饮食交给了AI:饭菜拍张照,让AI给这一口亮红绿灯。小红书小红书小红书

CNNIC口径的报告把国内生成式AI用户规模推到7亿人以上、普及率过半,而普通人拿到AI之后问得最多的到底是什么,"拍照问AI"大概率是最快增长的那类答案。小红书
一年时间,"相机"被接到了AI嘴上
把时间线摊开看,这个动作从卖点变成习惯,前后只用了约一年:
2024年10月,OPPO把"一键问屏"做进ColorOS 15,微博上2600多个赞的讨论核心就一句话:屏幕上有啥,问啥都行。微博
2025年3月,央视新闻实测"AI挑西瓜":清华教授沈阳拿手机对8个瓜挨个拍照问AI哪个甜,AI煞有介事地分析纹理和瓜藤。央视新闻
2025年4月底,夸克发布"拍照问夸克"AI相机。 到五一,"年轻人拿AI相机拍照查价再砍价"成了景区里的新操作,美国博主埃文·凯尔在广州用它挑榴莲也刷了屏。微博微博
2026年4月29日,以纯文本立身的DeepSeek上线识图模式,知乎相关问题攒下121条回答、251万浏览。 到5月10日,"DeepSeek大范围开放识图模式"成了新的提问。知乎知乎
9月10日,快速、专家、识图三个模式合并成统一的智能模式。 紧接着发布的V4.1 Flash识图时会自动挂联网检索,“带搜索了22个网页,快到来不及反应”。知乎知乎
到这个国庆,连理想AI眼镜Livis都被用户晒出来现场讲解宛平城的石狮子和建城史,205个赞、87条评论,评论里吵的是"这算不算剧透式旅游"。微博
也就是说,"拍一张、问一句"已经不是某个App的独门卖点,而是手机系统、搜索引擎、大模型、眼镜四路产品在同一个入口上会师。单个用户很难把这条线串起来——它散在四五个平台、跨度十二个月里。
但翻车案例也在同一个时间轴上堆着
对着一年的公开样本过一遍,"拍照问AI"翻车的方式相当集中:
今年7月那个刷屏问题:一对情侣用AI拍照判断菌子毒性,采了10多斤回家,被本地小孩哥一眼筛得只剩2斤。高赞回答点破了要害:同一株植物换个角度拍,AI可能给你两个不同答案。知乎
DeepSeek识图模式开放后,350万浏览的评价问题下,"这水平有点不忍直视了"这类吐槽冲在前面。 V4.1 Flash也有用户实测:丢个软件截图问这是啥,AI一本正经扯到了加拿大。知乎知乎
有人问AI拍图识景点能不能当随身导游,被泼了冷水:它能把结算界面加RGB灯效认成"圆形彩色玻璃窗"。知乎
而"AI挑瓜保甜吗"那个热搜下,评论区从第一天就没停过——拍完照问AI,AI说得头头是道,瓜切开还是不甜。
把成功案例和翻车案例对起来,边界其实只有一条:让它"读",别让它"判"
这是把两边样本并排看之后浮出来的规律,也是这篇最想给的判断——
照片里"写得出来的信息",AI读得很稳;照片里"看不出来的属性",AI判得很飘。
菜单、路牌、文物铭牌、说明书故障码、作业题干,这些信息本来就以文字形式在画面里,AI做的是识别加翻译加解释,错的比例低、错了也容易当场看出来。今年国庆大量"拍照问AI"帖里晒的,几乎全是这一类:有人和姐妹看展,谁都没做功课,进场直接问AI先看哪些重点文物。 拍照搜题能被拿来做四款主流产品的横评,也是因为它考的就是"读题"。小红书知乎
但甜度、毒性、真伪、“这是什么物种”、“能不能入口”,这些属性根本不在像素里。AI不是读出来的,是看着外表"补"出来的——它是在把概率最高或最像教科书的那句话递给你。挑瓜、辨菌、鉴宝这类"判物",恰好是翻车案例密度最高的区域;三高人群问"能不能吃",同理:饭菜照片里读得出食材,读不出一家三口的指标和用药,AI给的只能是通用常识,不是针对你爸妈的诊断。

照着这个边界,把活分三档派
放心派的(读字类):外语菜单和路牌翻译、景点铭牌和展览讲解、家电故障码查说明书、比价查价(景区砍价前拍一张查同款行情)、假期回家几千张照片的AI整理筛选。
派了要复核的(读图推理类):花草植物识别——可以当线索,别当结论,尤其家里有老人小孩的,把"疑似可食"三个字永远手动降级成"待确认";健康类"能不能吃"——拿它筛"明显不该吃的"可以,拿它放行"可以放心吃"不行;景点建筑讲解——当故事听不错,当事实引用要小心。
不派的(判物类):菌子野果能不能吃、药品药盒替医生做决定、二手货和古玩的真伪、西瓜榴莲的甜度、以及拍陌生人识别身份(技术不靠谱之外,隐私和法律上都靠不住)。一句口诀:入口、上秤、进医院的事,不派给照片。

问法比模型更值钱:加三个约束,翻车率立刻降
流传最广的那条东南亚菜单模板值得抄,它的好不在于问,而在于加了限制条件:请翻译成中文,保留原文菜名和价格,注明币种;看不清的地方标出来,不要猜。 9月那篇被转发的《12个拍照提问模板》思路也一致:先说清"这是什么、要用来干嘛",再要求AI给出置信度(“有几分把握”),最后逼它列依据(“你根据画面里哪几处判断的”)。 把这三条约束挂上,比换哪个App都管用——尤其当你用的还是9月刚合并成"智能模式"、识图行为还在被大量重新摸底的那些产品。小红书知乎
接下来值得盯的三件事
DeepSeek"智能模式"合并后识图到底走"默认带检索"还是"看图硬猜",社区还在吵,实测样本一个月后会更清楚;
AI眼镜正把"拍照问AI"从掏手机变成随口一问(Livis这类已经上手晒单),设备替你看世界的频率上去了,"读"与"判"的边界会更频繁地被考验;
系统级"一键问屏"继续铺开,问屏本质是"把屏幕拍给AI"——同样的分档逻辑直接适用,屏幕上的支付页、合同页、健康数据页,属于"不派"档。
这个假期最后两天还在外面的,尽管放心把菜单和路牌交给AI——它替你"读"世界的这半只眼睛,一年下来真的练出来了。但任何要进嘴、要花钱、要看医生的那一下,把照片收回来,自己上手。