蚂蚁集团开源的百亿参数医疗大模型AntAngelMed,一经发布便在多项国际权威评测中超越GPT等模型,位列开源第一。它通过技术创新,实现了专业性与人性化结合,为医疗AI的规模化落地提供了清晰的路径,展示了在真实复杂医疗场景下的强大应用潜力。
智能速览
蚂蚁·安诊儿开源即登顶HealthBench等权威榜单。
它是目前参数规模最大的开源医疗模型,达100B。
模型兼具专业严谨的医学推理与人性化的沟通能力。
应用门槛低,可支撑中小医疗机构实时交互与规模化部署。
基于百灵大模型架构优化,推理效率最高提升94%。
精华内容
一个开源模型如何在激烈的医疗AI竞赛中脱颖而出?AntAngelMed给出了答案,它不仅追求评测榜单上的高分,更致力于在真实场景中实现智商与情商的双重在线。
硬核实测表现
AntAngelMed的性能体现在其霸榜多项权威医疗基准测试上。在OpenAI发布的HealthBench评测中,它以62.5的评分超越DeepSeek-R1、Qwen3等一众开源模型,位列第一。面对专门为困难场景设计的子集HealthBench-Hard,它也成功打破了32分的“魔咒”,证明了其在复杂医疗环境下的稳定性。此外,在国家权威测评体系MedAIBench和面向中文场景的MedBench中,AntAngelMed在医疗知识问答、伦理安全及本土化适配等多个核心维度均表现突出,展现了全面且均衡的医疗能力。
真实场景体验
在模拟问诊中,AntAngelMed展现出的专业与共情令人印象深刻。当被问及头晕原因时,模型首先安抚情绪避免恐慌,再结合医学知识严谨分析成因,最后给出建议并鼓励就医,全程逻辑清晰、表达暖心。在解读乳腺癌病理报告的专业任务中,它能用通俗语言解释ER、PR、HER2等复杂指标,准确判断癌症亚型,并给出倾向性治疗建议。更贴心的是,它还会提示用户可以咨询主治医师的问题,为患者提供了极大的便利。
技术实现路径
AntAngelMed的强大能力源于其三阶段的训练流程与技术优化。模型继承了百灵大模型Ling-flash-2.0的MoE架构,通过持续预训练融入海量临床指南与文献,再经监督微调增强通用推理与人性化表达。最后,采用GRPO强化学习算法与双阶段路径,对齐人类价值观,约束安全边界。在效率上,通过1/32激活比例、FP8量化及EAGLE3优化,模型在32并发场景中,推理吞吐能力实现大幅提升,其中Math-500任务提升高达94%,为低成本部署奠定了基础。
蚂蚁的AI棋局
AntAngelMed是蚂蚁集团深耕医疗AI的战略性一步,它不仅是技术基座,更是蚂蚁“三端一体”产品矩阵的核心驱动力,该矩阵覆盖了面向用户的AI健康管家、面向医生的好大夫在线及面向机构的医疗大模型一体机。去年,蚂蚁将数字医疗健康事业部升级为健康事业群,标志着医疗健康已成为其核心业务板块。此举源于蚂蚁对通用大模型与专业场景存在鸿沟的洞察,而医疗正是检验专业智能体能力的最佳“试金石”,能倒逼技术深度优化,实现商业价值最大化。