幻觉率不到3%,王小川把医生版的DeepSeek免费了

源自公众号:机器之心

01-23 19:09

在医疗这个容错率极低的领域,百川智能发布的新模型 Baichuan-M3 Plus 实现了里程碑式突破。它将医学问题推理能力推向新高度,通过技术创新将幻觉率降至全球最低水平,并确保每项医学结论都有据可查,为 AI 辅助医疗的落地扫清了关键障碍。

幻觉率不到3%,王小川把医生版的DeepSeek免费了智能速览

  • 百川发布医疗大模型 M3 Plus,幻觉率低至 2.6%。

  • 采用“证据锚定”技术,实现医学结论逐句溯源。

  • 启动“海纳百川计划”,向医疗机构免费开放 API。

  • 通过 Gated Eagle-3 等技术,API 调用成本降低 70%。

  • 创始人王小川预测,三年内 AI 辅助医疗将大规模落地。

幻觉率不到3%,王小川把医生版的DeepSeek免费了精华内容

在医疗这个不容有失的领域,AI 如何赢得信任?百川智能给出了答案:通过极致的技术攻坚,让模型的每一次输出都有据可依,从而打破 AI 落地医疗的最后一道壁垒。

全球最低幻觉率

医疗领域对 AI 的核心矛盾在于信任,即如何避免其“一本正经地胡说八道”。百川 M3 Plus 模型在 Hallucination Rate 评测中,幻觉率仅为 2.6,比 GPT-5.2 低超过 30%,刷新了医疗模型低幻觉世界纪录。

这一成就源于其首创的 Fact-Aware RL(事实感知强化学习)技术。该技术将模型生成的文本拆解为可核查的医学判断,再与权威医学来源进行比对,从源头上大幅降低了信息错误的风险。

结论可逐句核验

除了降低幻觉,确保 AI 引用的准确性同样关键。许多医生反映,验证通用大模型的引用比自己查书还累,因为引用内容与原文往往不匹配。

为此,百川智能首创了“证据锚定”技术,将引用准确性作为核心训练目标。模型生成的每一句医学结论,都必须精确对应到原始文献的具体段落,结论与证据段落的匹配准确率超过 95%,实现了可核验、可追责。

免费推动行业共荣

要让 AI 在中国医疗市场普及,高昂的订阅费是不可行的。百川智能提出了更大胆的方案:启动“海纳百川计划”,面向所有为医务工作者提供服务的机构,免费提供 M3 Plus 的 API。

王小川表示,即使全国临床医生都在使用,年成本也在可控范围内。这得益于极致的工程优化,如 Gated Eagle-3 投机解码框架和 MoE 模型量化,使 API 调用成本较上一代降低 70%。

AI 医疗的关键一年

王小川判断,今年是 AI 进入医疗的关键一年。开年以来,OpenAI、Anthropic 等巨头均已布局医疗赛道,证明了该场景的重要性。

与其他玩家试图成为“健康管家”不同,百川选择直面严肃场景,进入医院核心科室,成为医生的“第二大脑”。通过在垂直赛道的深耕,百川正在构建属于自己的技术护城河。

M3 Plus 的发布不仅是技术上的里程碑,更是一次对行业生态的积极探索。通过免费开放与极致优化,它为 AI 在严肃医疗场景的普及铺平了道路。未来,AI 真能成为医生的得力助手吗?时间会给出答案。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章