MiniMax 悄悄在其编程平台 MiniMax Code 上线了最新文本模型 M3.1-Flash-Preview。在此之前,一款名为 Space Bunny 的匿名大模型在多个开源社区与聚合平台上引发关注,后经分词器特征与技术指标对比,开发者普遍认为该模型即为 M3.1 Flash 的提前测试版本。随着 M3.1-Flash-Preview 的正式出现,这一新模型的面貌和实际表现也逐渐清晰。
作为 M3.1 家族中首个可以实际运行的预览版本,M3.1 Flash 主要面向高频的日常开发场景,主打快速、可靠的生产力交付。模型在配置上具备百万级(1M)的上下文窗口,并支持原生的多模态能力,能够接收文字、图片及视频输入。此外,该模型在调用接口上兼容主流格式,并允许使用者根据任务复杂度在 low 到 max 等多个档位间自主调节思考深度,深度思考功能为默认开启状态。
在日常开发任务中,M3.1 Flash 的定位是从问题定位、代码实现到测试验证形成闭环。实际体验显示,在处理具体的编程需求如修改小漏洞、编写函数、搭建界面或完成简单小游戏逻辑时,该模型的执行效率和顺从度表现较为出色。特别是在用户明确要求“直接输出结论和关键步骤、无需展开长篇推理”的指令下,模型能够快速给出简练答案,适合节奏快、交互频繁的轻量级开发工作。
不过,从目前的测试反馈来看,作为 Preview 预览版本,该模型仍存在一些改进空间。在遇到缺乏前提条件或逻辑设坑的复杂问题时,模型有时不会直接拒绝答题或声明缺少参数,而是会尝试给出基于经验的补充推论。另外,在部分测试场景中,调整不同的思考深度档位对实际思考 Token 消耗的影响还不够明显,而在执行超长链路的连续自动化工具调用时,偶有上下文状态未能完全同步的情况发生。
为了鼓励开发者尝试新模型,官方在上线期间同步推出了多项福利活动。所有用户的 Token Plan 额度已在上线当日完成重置。同时,在 9 月 28 日至 10 月 7 日期间,用户登录平台参与每日签到可获得双倍免费积分,这些积分不仅能用于体验 M3.1 Flash 进行代码开发,也可用于旗下其他音视频生成模型。
综合来看,M3.1-Flash-Preview 展现出了作为轻量高效开发辅助工具的潜质,尤其适合应对明确的日常编码与辅助测试工作。随着测试阶段的深入和开发者反馈的收集,后续正式版本的迭代表现以及完整的性能评测数据仍值得进一步关注。