8月26日,华为终端官宣了2026年中国电信研究院翼矩AITMark的评测结果:小艺拿下AI手机智能体综合评分第一,Pura X Max拿下旗舰手机场景智能评测综合第一。但真正让我停下来的是同一天在知乎传开的完整名次——小米小爱第二,三星Bixby第三。
不少三星老用户的第一反应是不信。也难怪,就在上一轮同一套评测里,Bixby还是最后一名。
不是野榜:同一套评测,隔了八个月的两张成绩单
先交代AITMark是什么,这决定了这个名次能不能信。它不是一次媒体横评,而是中国电信在2025年8月的终端评测合作论坛上发布的业界首个专业AI终端评测体系,2026年又把评测范围升级扩展到AI芯片、AI泛终端与AI助手智能体,是一套年度延续的运营商评测。知乎微信公众号弄清了尺子,再看尺子量出来的结果。
2025年12月那一轮AI助手智能体评测总分556分,今年1月底公布的结果是:小艺409.0分第一,荣耀YOYO 377.4分第二,OPPO小布358.5分第三,vivo蓝心小V 345.8分第四,小米小爱289.5分第五,三星Bixby 286.1分第六——垫底。今日头条而8月26日公布的2026年结果,目前公开信息能确认的是前三名:小艺第一、小爱第二、Bixby第三。知乎完整榜单和具体分数,华为官宣海报只展示了自己两项第一,并未全量公开,这点要先说清楚,不脑补。
把两轮摆在一起,变化就很直观:Bixby从第六到第三,小爱从第五到第二,而上轮榜眼探花的YOYO和小布,这次没进公开的前三。八个月,是这轮评测里幅度最大的两次跃升。
Bixby这八个月,到底补了什么
名次跳升不是评测放水。核对下来,国行Bixby今年至少补上了三块短板。
第一块是接入DeepSeek。三星中国官方新闻稿宣布国行Galaxy S25系列接入DeepSeek-R1,入口就在Bixby和三星生活助手里的AI"智能体中心",不用下载App、不用注册账号。微博这是国行Bixby第一次在本土环境里接上能打的推理模型。
第二块是合规身份。7月8日网信办公示首批7款手机端侧生成式AI服务备案,"三星盖乐世AI"在列。知乎备案意味着国行Galaxy AI的智能体能力可以正式运营,功能迭代的闸门打开了。

第三块是智能体功能上机。Fold8国行搭载的One UI 9带来了AI全局收藏、AI简报等智能体功能,其中全局收藏能实现跨应用收藏、搜索和总结。微博评测考的正是这类跨应用任务执行,而这恰恰是国行Bixby过去最缺的部分。

说句公道话:上轮垫底不冤,这轮第三也不是天上掉的。
但"第三"不等于"好用",三笔账要分开算
想喊"Bixby站起来了"的先别急,评测分和日常手感是两本账。
评测考的是智能体跨应用任务,而你日常吐槽的是语音唤醒、中文场景理解和国产App生态。今年B站上"bixby语音唤醒好智障"的求助还有几十条回复,知乎"Galaxy AI实际体验如何"的问题下,高赞回答是"一塌糊涂,还是单独用ai软件吧"。评测名次变了,这些老毛病没有一夜消失。
第二本是生态账。海外Galaxy AI是Gauss加Gemini双引擎,即圈即搜这类明星功能靠的是Gemini;国行没有Gemini,底座换成了DeepSeek、百度等本土模型,功能清单和体验边界都不一样。三星官网确认Galaxy AI基础功能免费,但也留了一句"未来发布的增强型功能或新服务可能会以付费形式提供"。知乎免费的是基础盘,天花板在哪,还得看后续。
第三本是使用规模账。QuestMobile 6月的终端系统型AI助手数据里,OPPO小布1.65亿月活霸榜、华为小艺1.48亿紧随其后,小米超级小爱渗透率74.4%,榜单上找不到Bixby的名字。微博用的人少,国产App适配就慢,生态飞轮就转得慢——这是评测分数解不开的结构性问题。
所以第三名更准确的读法是:Bixby的"智能体能力"被官方评测认可了,"日常体验"的差距还在原地。
国行三星用户,现在该做什么
手里是S25、S26、Fold8这一代国行机型的,三件事值得做:把"智能体中心"里的DeepSeek用起来,这是目前国行智能体浓度最高的入口;把通话助手、写作助手、笔记助手这些永久免费的基础功能用足,它们本来就含在你付过的NPU钱里;等One UI 9稳定版9月开推,老机型升级后智能体功能还会再补一波。

两件事别期待:别等即圈即搜这类Gemini功能原样落地国行,别指望唤醒和方言体验一步追平小艺。
这轮评测最打动我的,其实不是Bixby的名次,而是它把一个事实摆上了台面:手机AI的差距,已经从"能不能做"变成"生态做得多深"。模型和跑分八个月就能追,生态和手感要还更久的账。对三星用户来说,这个第三名值得小小高兴一下,但更值得等的,是国行在评测之外交出的下一份答卷。