百川智能发布的M3 Plus医疗大模型,在严肃医疗场景中实现了突破。它不仅将幻觉率降至全球最低的2.6%,更首创“证据锚定”技术,让AI生成的每一句医学结论都能精确溯源,真正解决了AI医疗的可靠性难题。目前,该模型正通过「海纳百川」计划向国内医疗机构免费开放。
智能速览
M3 Plus医疗大模型将幻觉率降至2.6%,达到全球最低水平。
首创“证据锚定”技术,使每一句医学结论都可精确溯源核验。
在多项权威评测中,M3 Plus的综合表现超越GPT-5.2。
通过工程优化,API调用成本相比上一代降低70%。
「海纳百川」计划将模型免费开放给中国医疗服务机构。
精华内容
M3 Plus之所以能实现如此高的可靠性与性价比,背后是多项核心技术的突破与系统工程的深度优化,这些细节共同构筑了其技术壁垒。
全球最低幻觉率
Baichuan-M3 Plus在严肃医疗问答的准确性与可靠性上创下新纪录,其核心指标事实性幻觉率降低至2.6%。这一数据不仅显著低于前代M3模型的3.5%,相较于GPT-5.2的3.5%也实现了超过30%的大幅下降,甚至超越了行业标杆Open Evidence,成为全球幻觉率最低的循证增强医疗大模型。
证据锚定技术
该模型首创的“证据锚定”技术,实现了AI医学判断的可核验、可追责与可教学。不同于简单的文献引用,该技术要求模型生成的每一句医学结论,都必须精确对应到原始论文或指南中的具体证据段落。通过引入Citation Reward Model对错误引用进行惩罚训练,结论与证据段落的匹配准确率超过95%,让每一句判断都能被逐字溯源。
工程优化降成本
为保证模型能力的同时实现规模化应用,M3 Plus在系统层面进行了全面的工程重构。通过MoE架构优化、模型量化以及Gated Eagle-3投机解码等关键技术,在严格保证可靠性的前提下,API调用成本较上一代降低了70%,为AI在医疗场景的广泛应用扫清了成本障碍。
海纳百川计划
为推动国内AI医疗生态繁荣,百川发起「海纳百川」计划,将M3 Plus以API形式免费开放给服务于医务工作者的机构。该计划明确了适用对象(医生、护士、医学生等)和场景(临床辅助决策、医学教育),并要求产品需明确展示“Powered by 百川”,且不得对模型输出进行影响准确性的修改。
百川M3 Plus通过“证据锚定”与极低幻觉率,为严肃医疗场景中的AI应用设立了新的可靠标准。其免费开放的策略,有望加速AI技术在中国医疗体系中的深度融合与普及,真正成为值得信赖的医疗助手。这会是AI医疗变革的起点吗?