近日,美团正式发布了其新一代自研的万亿参数大模型——LongCat-2.0,引发了科技界的广泛关注。这一事件的看点不仅在于模型本身的技术实力,更在于其背后独特的“出场方式”和重大的产业意义。

在正式发布前,一个名为“Owl Alpha”的神秘模型悄然登陆全球主流的大模型API路由平台OpenRouter。在没有任何宣传推广的匿名状态下,Owl Alpha凭借其强大的性能迅速获得了全球开发者的青睐。其API调用量一度冲进全球前三,在主流的Agent(智能体)应用场景中更是表现突出,例如在Hermes Agent框架下月调用量位居全球第一,在Claude Code场景下也仅次于Claude官方模型,成为最受欢迎的免费模型之一。正当外界纷纷猜测其开发者身份时,美团官宣确认,这只神秘的“猫头鹰”正是LongCat-2.0的测试版本。这种未经宣发、完全依靠真实用户“用脚投票”而走红的方式,有力地证明了模型在实际应用中的价值。
从技术上看,LongCat-2.0是一个总参数规模达到1.6万亿的MoE(专家混合)架构大模型,每次推理时根据任务难度动态激活约480亿参数。这一设计的优势在于,既能拥有万亿级模型的庞大知识储备,又能以相对较低的计算成本进行高效推理。此外,它原生支持高达100万Token的超长上下文窗口,这意味着模型能够一次性处理数百万字的文档或大型复杂的代码项目而“不忘事”,这对于其核心定位——“Agentic Coding”(智能体编程)至关重要。该能力使其在理解和执行代码生成、工具调用、多步推理等复杂任务时表现得更加稳定和高效。

然而,本次发布最引人瞩目的焦点,是LongCat-2.0的训练方式。据官方信息及媒体报道,它是业界首个在规模达五万张的国产算力集群上,完成从零开始的预训练、微调及推理全流程的万亿参数大模型。在当前全球高端计算芯片受限的背景下,美团从三年前便开始布局并押注国产算力,通过自研算子、优化框架、构建容错体系等一系列艰苦的工程实践,最终成功“点亮”并高效利用了大规模国产芯片集群。这不仅是美团自身技术实力的体现,更重要的是,它以一个工业级的成功案例,验证了国产算力已具备支撑前沿大模型完整研发生命周期的能力。这一突破对于推动中国AI产业链的自主化发展,无疑具有里程碑式的意义。

许多人对“送外卖的”美团为何要投入巨资研发底层大模型感到好奇。实际上,这与其复杂的业务场景密切相关。美团的核心业务,如外卖、到店、酒旅等,本质上是连接海量用户与商家的复杂任务网络,其中包含“找店-选券-订座”等多步、多决策的真实物理世界任务。这些场景天然是AI Agent的理想练兵场。因此,LongCat-2.0并非一个单纯用于聊天的模型,而是美团为驱动未来“AI-powered App”、赋能自身庞大业务生态而打造的“执行引擎”。
美团LongCat-2.0的发布,不仅是以匿名“黑马”姿态在国际舞台上证明了其产品能力,更通过全程采用国产算力,为中国AI产业的自主发展探索出一条切实可行的路径。随着其后续宣布将对外开源,预计将进一步推动相关技术生态的繁荣。