在AIGC开发者大会上,MiniMax开放平台解决方案高级总监冯雯阐述了公司对“下一代AI”的多模态愿景及开源策略。本次分享深入剖析了MiniMax如何通过开源模型、框架与评测集,构建良性的开发者反馈循环,旨在解决模型部署痛点,推动AI技术的普惠与行业标准的建立。
智能速览
MiniMax致力通过多模态与图灵测试定义下一代AI体验。
开源旨在收集反馈,从单纯发布权重进化到全流程优化。
适配国产推理框架,解决部署兼容性与延迟问题。
开源Mini Agent框架,提供包含记忆与工具的最佳实践。
发布Web评测集,填补App开发与模拟器场景的评测空白。
精华内容
从愿景到落地,开源不仅是代码的开放,更是连接模型能力与开发者创新的桥梁。
多模态技术愿景
MiniMax自2021年底成立以来,便致力于探索超越文本对话的多模态AI体验。团队将图灵测试作为衡量标准,旨在创造更沉浸式的生活方式改变。通过Talkie、星野等社区产品的早期验证,MiniMax逐步将大模型封装为API与原子能力,这种双向循环的机制让企业用户与开发者的反馈直接驱动了模型的快速迭代。
开源实践与优化
开源的核心逻辑在于通过社区力量获取反馈,从而优化模型底层的bytecase。早期的开源曾因仅发布权重文件导致开发者配置困难,随后团队补充了tokenizer规范、命名规则及格式转换流程。这种基于实际部署痛点的改进,使得模型在本地数据中心和云端的部署变得更加便利,大幅降低了开发门槛。
推理框架适配
为满足多样化的部署需求,MiniMax不仅兼容了vLLM和SGLang,更根据开发者建议增加了对国产推理框架的支持。这种适配工作有效地提升了推理速度并降低了延时,让更多企业用户能够在本地高效运行模型。同时,团队通过Tech Blog公开了数据构造与训练思路,推动了行业内的技术透明化。
框架与评测体系
MiniMax开源了内部沉淀的Mini Agent框架,该框架整合了规划器、记忆系统和工具合集,被视为模型的最佳实践。针对现有评测集在App开发等场景的缺失,团队发布了名为Web的评测集,专注于手机应用与模拟器开发能力的评估。这一系列举措旨在帮助开发者构建最佳实践,拓展AI的应用边界。
从最初的多模态愿景到如今模型、框架与评测集的全链路开源,MiniMax通过构建开放生态实现了技术与开发者的双向奔赴。未来,随着不同背景开发者的加入,AI技术将在实践中不断迭代,最终实现真正的普惠与价值最大化。