当前位置:
AIGC文章详情

一个星火,两份截然相反的高考成绩:昨晚的半年报之后,该搞清楚它服务谁了

源自73位全网作者

21:27

6月24日,广东高考放榜。《羊城晚报》用2026年高考真题让8款国内外大模型"应试",资深教师双盲阅卷:物理类,讯飞星火X2与Claude-Opus-4.8同取708分并列第一,进入广东"屏蔽生"(省前10名)行列;历史类,只有星火X2上了700分。微博

18天后的7月11日,B站UP主wycode_cn做了一场更大的测试:49个大模型,6门高考真题,总分750分。哔哩哔哩这场测试里,星火X2的成绩被挤到了下游,视频标题直接发问:“价格极致,但成绩垫底?”

同一个模型,两份高考成绩,两种命运。而昨晚,科大讯飞交出了2026年半年报。把这三件事放在一起看,我觉得终于可以回答一个很多用户真正纠结的问题:2026年了,讯飞星火还值不值得用?它到底适合谁?

一、半年报说了什么:星火的钱,不是从你每天打开的App里赚的

先看8月20日晚间披露的半年报:营业总收入116.23亿元,同比+6.52%;归母净利润-2.04亿元,同比减亏14.68%;扣非归母净利润仍亏6.37亿元,非经常性损益约4.33亿元填平主业窟窿,经营现金流要到二季度才单季转正;研发投入30.07亿元,占营收25.73%。微博战略口径九个字:“做强C端、做深B端、优选G端”,G端收入同比-2.65%。

产品端的突破口,集中在教育硬件和校园批改上。星火智能批阅机签约销售量同比+14倍,累计覆盖5000余所学校。微博续购率超90%,2026年春季学期日均批改超360万份,接口调用量较上学期翻5倍,语文批改量涨10倍。微博AI学习机推出T90旗舰和S90进阶款,拿下618京东天猫双平台销冠,6000元以上机型线上占比49%,海外营收同比+160%。

一个星火,两份截然相反的高考成绩:昨晚的半年报之后,该搞清楚它服务谁了

分业务看,收入结构也很清楚:开放平台是第一大收入来源,37.05亿元,同比+36.01%;智慧教育34.90亿元,微降1.16%;智慧汽车4.81亿元,+20.46%;智慧医疗4.38亿元,+58.56%。知乎教育仍是压舱石,但增长引擎已经明显转向平台和行业模型。

换句话说,星火商业化的主战场,不在你我每天打开的C端聊天App,而在教育硬件+校园端批改+行业接口这三块。这也解释了为什么微博上有财经博主讨论"星火应该从公司最终产品降级为公司基础设施"——话虽尖锐,方向确实和半年报数据对上了。

二、为什么两份高考成绩差这么多?这比分数本身更值得看

先说清楚:两份测评都不是假的,但测的东西不一样。羊城晚报那场是8款主流模型,用新课标I卷+广东自主命题卷,资深教师双盲人工阅卷,连作文这类主观题都算进去,考的是"应试场景下的综合水平";wycode那场是49款模型统一走API应试,科目6门,模型版本和调用方式差异很大。

常看大模型榜单的人对这种分歧其实不陌生,它背后至少有三个原因。一是测的版本可能不一样,今年4月星火X2-Flash发布并同步开放API,主打降低开发者构建Agent应用的使用成本。知乎满血旗舰与走量版之间,API价格档位差异必然带来分数差异。二是主观题评分口径不同,人工双盲阅卷和程序化对答案,作文一科就能拉开十几分。三是题量和题库不同,模型训练时是否见过类似题型,对不同测试的影响也不一样。

所以,任何单一榜单都只能当参考,真正值得看的是分歧背后的稳定信息。从社区反馈看,星火在通用聊天、写作、代码场景的存在感确实不如从前,那条测评视频下能看到"讯飞星火都多老的模型,两年前讯飞星火在国内还能打一打,现在应该早就落伍了""讯飞好像就没搭上大模型的车"这类高赞评论。哔哩哔哩

但另一条评论很有意思:"我们这里的英语考试听说都是用的讯飞模型。"这正是星火2026年的真实状态:通用大模型的军备竞赛里它退后了,但教育、语音、批改这些垂直场景里,它扎得很深。

一个星火,两份截然相反的高考成绩:昨晚的半年报之后,该搞清楚它服务谁了

三、那么星火现在还适合谁?分人群说

①如果你想找一个通用AI助手(聊天、写文案、写代码)——不必优先星火。DeepSeek、豆包、通义这类免费通用大模型能覆盖八成日常需求,星火的通用能力在社区口碑里也不再占优,知乎上"讯飞星火与Deepseek的差距到底在哪里"这类问题至今仍在被讨论,讨论的正是这层通用能力的落差。

②如果你准备给孩子买学习机——星火的教育数据是目前讯飞最硬的底牌:批阅机覆盖5000余所学校、续购率超90%,这套模型在K12场景积累的题库和错因数据,是通用模型短期追不上的,家长也确实在用钱投票。但提醒一点:受芯片/存储涨价、学习机阶段性缺货等因素影响,上半年学习机销量未达预期。知乎价格未必好谈,可以蹲8、9月开学季大促再决定。

恢复的信号也已经出现:7月单月销量同比+30%,累计销量恢复正增长。微博另外值得留意的是,T30 Pro这类新机型上,讯飞已经用上了"星火+DeepSeek"双模型配置。哔哩哔哩别把"AI强"当成"不用管",选学习机看的是讲解思路能不能引导孩子思考,而不是功能清单的长度。

③如果你有考试听说练习、会议录音转写、语音输入这类需求——这是讯飞的老本行,从高考英语听说考试起家的语音积累依然在线:讯飞听见23H1-26H1的收入CAGR达到42%。微博按需选择即可。

一个星火,两份截然相反的高考成绩:昨晚的半年报之后,该搞清楚它服务谁了

④如果你是开发者/企业用户——星火X2/X2-Flash的卖点是全国产算力训练和行业落地。星火是我国首个基于全国产算力平台训练的全栈自主可控大模型。知乎医疗大模型MedBench得分98.9。微博教育接口调用量一学期翻5倍,政企信创场景里它几乎是必选项。

四、值得继续盯的三个信号

  1. 学习机月度销量。7月已同比转正,8、9月开学季能否延续,决定C端飞轮是否真的转起来。

  2. X2的迭代节奏。多模态的X2-VL已在6月发布,覆盖视觉推理、图文理解等任务。知乎下一代能否把通用能力补上,决定社区口碑会不会反转。

  3. 减亏的含金量。这次减亏有约4.33亿非经常性损益填窟窿,扣非亏损能否在年报收敛,才是真正的分水岭。

一句话总结:如果你指望星火是"最强全能AI",大概率失望;但如果你要找的是教育、语音、批改这些场景里真正扎下根的AI,星火是目前数据证明最充分的选手。与其争论榜单分数,不如看清它到底是谁的生意。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章