最近关注AI新闻的朋友,应该都绕不开上周一个数字:
在每天路由数万亿Token的Vercel AI Gateway平台上,截至8月22日,开源模型的调用份额冲到了62%,历史上第一次反超闭源模型。36氪而今年4月,这个数字还只有11%。
英伟达本周还敲定了一笔大交易:60亿美元技术授权费砸向开源模型公司Poolside,再追加10亿美元投资——卖铲子的,亲自下场挖矿了。36氪
很多人把这次反超解释成"开源便宜所以赢了"。但有一个人,两年前就拿自己的声家性命押了这个判断——他被骂过疯子、被嘲过气过,他就是杨立昆(Yann LeCun)。
回头看看这位老爷子最近一个多月点过的"赞",你会发现:这场反超,他早就一条一条转发预告过了。
一个月点赞三次,全给了中国开源
很多人对杨立昆的印象停留在"骂大模型的图灵奖得主"。但有个有意思的反差:骂LLM最狠的人,恰恰是转发推荐中国开源大模型最勤的人。
把时间线捋一下:
7月22日,转发推荐百度Unlimited OCR。 这个开源OCR模型6月发布就冲上GitHub和Hugging Face四个榜单第一,一个月后又杀回HF全球模型总趋势榜前三,把智谱GLM-5.2都超了。GitHub Star破1.65万、下载量224万——对一个OCR模型来说,这热度相当反常。
7月28日,“中国开源模型火遍硅谷”。 环球网当天报道,杨立昆公开推荐中国开源模型,相关话题直接登上知乎热榜,被总结为"中国开源模型超越专有模型"。知乎同一天,Unlimited OCR和Kimi K3包揽了全球趋势榜前两名。微博
8月3日,转发Qwen3.8宣传片。 阿里千问海外官号发布Qwen3.8宣传片、预告模型即将开源,这支不讲参数、只讲"AI帮人工作,人享受生活"的片子意外在海外爆火,观察者网报道称"大量海外网友自发点赞",杨立昆和知名投资人Jason都转了发。微博
还有两个花絮:7月11日,他转发力挺了一项MIT脑科学研究——人脑做逻辑推理时语言脑区并不激活,和他"LLM只学到语言模式、不是真理解"的主张正好呼应;8月11日,Meta开放30B Agent模型MuseGlimmer的权重,他直接出现在扎克伯格的评论区,为这一步鼓掌叫好。36氪
一个天天骂大模型的人,花了一个月给开源模型挨个点赞。这不是口误,是他一以贯之的立场。他点赞的方向,也正是数据里冲得最猛的方向:今年前七个月,前沿开源模型的参数规模上限,一直由中国实验室顶着。36氪

他骂的是闭源垄断,不是开源
很多人误会杨立昆的"LLM死路论"是无差别开炮。但他今年5月在播客里的表态其实很清楚:
他承认LLM是真好用——对话、文案、代码、检索极其能打,是划时代的产品,自己日常也高频使用。他否定的只有一件事:靠闭源加堆参数的纯文本路线,到不了AGI。
对闭源巨头,他有个著名比喻:"今天的OpenAI,就是昨天的Sun公司。"Sun当年靠Solaris和Java风光无限,最终被开源生态颠覆。他的原话更直接:就像当年Linux击溃微软,开源AI终将统治世界。知乎
这样看,矛盾就解开了:他骂的是闭源垄断,不是开源阵营;骂的是纯文本堆参数,不是中国模型。恰恰相反,中国开源是他最乐见其成的力量——便宜、开放、人人可查、不受任何一家公司控制。
他自己也一直这么做:在Meta的12年,他是推动Llama系列开源的核心人物之一;2025年底离开Meta创办AMI Labs、押注世界模型,对开源的态度也没变过。
一个月后,全行业跟上了
然后是大家都看到的8月转折:
Vercel AI Gateway数据:4月11% → 6月下旬28.4% → 8月22日62%,开源Token调用份额首次反超闭源。DeepSeek一家拿走22.6%;智谱GLM-5.2上线两周,日Token消耗量暴涨约50倍。36氪
OpenRouter周榜,调用量前五全是开源模型,全部来自中国团队。
全球最大开源模型平台的春季报告显示:中国开源模型下载量占全球41%,超越美国,累计下载100亿次。知乎
黄仁勋7月发文《Open Weights and American AI Leadership》,说"美国的AI领导力不取决于单一的闭源前沿模型";本周60亿美元砸向Poolside,目标是一年内做出超万亿参数的前沿开源模型。36氪
闭源巨头被拖进价格战:OpenAI的GPT-5.6系列破天荒把"单位美元性能"当卖点,Anthropic的Opus 5价格腰斩,谷歌Gemini 3.7 Flash距上一代仅三周、价格再对半砍。36氪
把镜头拉长:SemiAnalysis复盘了三代范式的追赶曲线——开源旗舰追上闭源旗舰的时间,从19.7个月缩到8.5个月,再缩到4.8个月;两者的起始分差,也从35.8分一路缩到12.1分、6.8分。36氪

更值得玩味的是硬币另一面。《华尔街日报》8月1日报道,硅谷开源公司Arcee AI用2000万美元、2048块B300、33天训出一个开源模型,找VC融资几乎全被拒绝,有合伙人原话是:“我不希望这种模式成功,这会损害我在OpenAI和Anthropic上的投资。”
美国资本攥着闭源的仓位,全球开发者用Token投票。中间的裂缝,正是杨立昆念叨了两年的东西。而下载量就是选票的原始记录:Qwen家族以20.45亿次下载,成为全球下载最多的开源模型系列。36氪

先泼盆冷水:"点赞"不等于背书
有几句降温的话要说在前面:
转发不等于性能背书。 杨立昆转的,一个是垂直工具模型,一个是品牌宣传片,点赞的是开源方向,不代表为每个模型的能力站台。
调用量份额不等于营收份额。 62%反超的是Token调用,闭源巨头的商业收入依然可观,OpenAI、Anthropic的生意没有一夜垮掉。
他自己的赌局还没开奖。 AMI Labs的10.3亿美元种子轮到位了,但世界模型产品仍未正式发布。开源判断被验证,不等于世界模型判断也被验证。
对普通玩家,现在真正值得玩的是什么
落到最实际的问题:这些被"杨立昆点赞过"和同类的中国开源模型,现在值得上手吗?
本地部署党(单张4090/24GB显存):
Qwen3.8-27B:本周刚开源,AMD已官宣Day 0支持,有微博玩家实测4090上本地能跑约100 tokens/s,27B稠密模型,是目前开源第一梯队里对消费级硬件最友好的选择。微博微博
Meta MuseGlimmer:30B Agent模型,Apache 2.0开放权重,24GB显存可跑,量化后不到20GB,断网也能用——就是杨立昆评论"很棒的一步"的那个。36氪
轻量工具党:
百度Unlimited OCR:Hugging Face和GitHub免费开源,224万下载,有文档识别、扫描件处理需求的朋友可以直接上手试。
API轻度用户:
DeepSeek V4 Flash缓存命中后约0.2元/百万tokens,Qwen3.7 Flash约0.03美元/百万输入token。日常干活,成本已经可以忽略不计。
纯围观群众,留三个观察信号:
阿里8月已开放Qwen3.8-Max的2.4T旗舰权重——最顶级开源模型,现在由中国公司先放出来。36氪
Meta预告旗舰模型MuseSpark 1.2也将开放权重,开源攻势还在继续。36氪
英伟达计划一年内产出超万亿参数的前沿开源模型,开源闭源真正的正面战,现在才开始。

两年前杨立昆说"开源AI终将统治世界",评论区一片嘲讽。今天,连卖显卡的都掏了60亿美元。
他的世界模型赌局还没开奖,但开源这一局,他先赢下一城。