在医疗这个容错率极低的领域,百川智能发布的新模型 Baichuan-M3 Plus 实现了里程碑式突破。它将医学问题推理能力推向新高度,通过技术创新将幻觉率降至全球最低水平,并确保每项医学结论都有据可查,为 AI 辅助医疗的落地扫清了关键障碍。
智能速览
百川发布医疗大模型 M3 Plus,幻觉率低至 2.6%。
采用“证据锚定”技术,实现医学结论逐句溯源。
启动“海纳百川计划”,向医疗机构免费开放 API。
通过 Gated Eagle-3 等技术,API 调用成本降低 70%。
创始人王小川预测,三年内 AI 辅助医疗将大规模落地。
精华内容
在医疗这个不容有失的领域,AI 如何赢得信任?百川智能给出了答案:通过极致的技术攻坚,让模型的每一次输出都有据可依,从而打破 AI 落地医疗的最后一道壁垒。
全球最低幻觉率
医疗领域对 AI 的核心矛盾在于信任,即如何避免其“一本正经地胡说八道”。百川 M3 Plus 模型在 Hallucination Rate 评测中,幻觉率仅为 2.6,比 GPT-5.2 低超过 30%,刷新了医疗模型低幻觉世界纪录。
这一成就源于其首创的 Fact-Aware RL(事实感知强化学习)技术。该技术将模型生成的文本拆解为可核查的医学判断,再与权威医学来源进行比对,从源头上大幅降低了信息错误的风险。
结论可逐句核验
除了降低幻觉,确保 AI 引用的准确性同样关键。许多医生反映,验证通用大模型的引用比自己查书还累,因为引用内容与原文往往不匹配。
为此,百川智能首创了“证据锚定”技术,将引用准确性作为核心训练目标。模型生成的每一句医学结论,都必须精确对应到原始文献的具体段落,结论与证据段落的匹配准确率超过 95%,实现了可核验、可追责。
免费推动行业共荣
要让 AI 在中国医疗市场普及,高昂的订阅费是不可行的。百川智能提出了更大胆的方案:启动“海纳百川计划”,面向所有为医务工作者提供服务的机构,免费提供 M3 Plus 的 API。
王小川表示,即使全国临床医生都在使用,年成本也在可控范围内。这得益于极致的工程优化,如 Gated Eagle-3 投机解码框架和 MoE 模型量化,使 API 调用成本较上一代降低 70%。
AI 医疗的关键一年
王小川判断,今年是 AI 进入医疗的关键一年。开年以来,OpenAI、Anthropic 等巨头均已布局医疗赛道,证明了该场景的重要性。
与其他玩家试图成为“健康管家”不同,百川选择直面严肃场景,进入医院核心科室,成为医生的“第二大脑”。通过在垂直赛道的深耕,百川正在构建属于自己的技术护城河。
M3 Plus 的发布不仅是技术上的里程碑,更是一次对行业生态的积极探索。通过免费开放与极致优化,它为 AI 在严肃医疗场景的普及铺平了道路。未来,AI 真能成为医生的得力助手吗?时间会给出答案。