谷歌开源医疗模型MedGemma迎来重大更新。新版本1.5不仅拓展了CT、MRI等高维三维医学影像的解读能力,还在核心任务上实现了精度跃升,为开发者提供了更强大且高效的AI工具,有望加速医疗AI应用的落地与创新。
智能速览
MedGemma 1.5新增对CT、MRI三维成像及全切片病理的解读支持。
新模型在文本、医疗记录和2D图像处理的精确度超越前代。
CT影像分类准确率提升3%,MRI影像分类准确率大幅提升14%。
组织病理学预测准确率显著提高,媲美特定任务的专用模型。
4B模型体积小巧,支持离线运行,降低开发与部署门槛。
已在马来西亚和台湾的医疗机构中得到初步应用验证。
精华内容
此次升级的核心在于拓展了AI对复杂医学数据的理解维度,并在关键性能指标上实现了实质性的突破。
高维影像支持
MedGemma 1.5的最大亮点在于其扩展的多模态能力。相较于前代仅支持2D图像,新版本首次引入了对CT和MRI三维体积数据的处理,这意味着AI可以分析由多个切片构成的立体影像。同时,它还支持全切片组织病理学成像,让开发者能处理更完整、更复杂的病理图像数据,为更精准的诊断分析提供了可能。
性能实测跃升
在谷歌的内部基准测试中,性能提升的数据十分直观。针对疾病相关的CT影像分类任务,MedGemma 1.5的基线绝对准确率从58%提升至61%。而在MRI影像分类上,提升更为显著,准确率由51%跃升至65%,平均提高了14个百分点。这表明模型在解读不同类型的医学影像时,其鲁棒性和准确性都得到了加强。
病理分析对标
在处理全切片组织病理学成像时,新模型的表现同样出色。基于仅包含一张病理切片的病例进行测试,MedGemma 1.5的ROUGE-L评分从上一代的0.02大幅提升至0.49。这一成绩与经过专门训练的特定任务模型PolyPath的0.498分非常接近,显示出其通用性模型在特定领域已具备挑战专用模型的潜力。
开发与应用
为了方便开发者使用,新发布的4B版本模型体积小巧,计算效率高,甚至支持离线运行,极大地降低了部署门槛。目前,该模型已在全球范围内获得应用。例如,马来西亚的Qmed Asia将其用于构建临床实践指南的对话系统,台湾的健保署则用它从海量病理报告中提取关键数据,加速了术前健康状况的评估流程。
MedGemma 1.5的发布,标志着开源医疗AI在处理复杂临床数据方面迈出了坚实一步。它为开发者社区带来了更强大的工具,未来能否催生出更多解决实际医疗痛点的创新应用?