当前位置:
AIGC文章详情

杨立昆三连赞中国开源模型,一个月后行业真的变天了:这些免费模型值得玩

源自145位全网作者

18:49

最近关注AI新闻的朋友,应该都绕不开上周一个数字:

在每天路由数万亿Token的Vercel AI Gateway平台上,截至8月22日,开源模型的调用份额冲到了62%,历史上第一次反超闭源模型。36氪而今年4月,这个数字还只有11%。

英伟达本周还敲定了一笔大交易:60亿美元技术授权费砸向开源模型公司Poolside,再追加10亿美元投资——卖铲子的,亲自下场挖矿了。36氪

很多人把这次反超解释成"开源便宜所以赢了"。但有一个人,两年前就拿自己的声家性命押了这个判断——他被骂过疯子、被嘲过气过,他就是杨立昆(Yann LeCun)。

回头看看这位老爷子最近一个多月点过的"赞",你会发现:这场反超,他早就一条一条转发预告过了。

一个月点赞三次,全给了中国开源

很多人对杨立昆的印象停留在"骂大模型的图灵奖得主"。但有个有意思的反差:骂LLM最狠的人,恰恰是转发推荐中国开源大模型最勤的人。

把时间线捋一下:

7月22日,转发推荐百度Unlimited OCR。 这个开源OCR模型6月发布就冲上GitHub和Hugging Face四个榜单第一,一个月后又杀回HF全球模型总趋势榜前三,把智谱GLM-5.2都超了。GitHub Star破1.65万、下载量224万——对一个OCR模型来说,这热度相当反常。

7月28日,“中国开源模型火遍硅谷”。 环球网当天报道,杨立昆公开推荐中国开源模型,相关话题直接登上知乎热榜,被总结为"中国开源模型超越专有模型"。知乎同一天,Unlimited OCR和Kimi K3包揽了全球趋势榜前两名。微博

8月3日,转发Qwen3.8宣传片。 阿里千问海外官号发布Qwen3.8宣传片、预告模型即将开源,这支不讲参数、只讲"AI帮人工作,人享受生活"的片子意外在海外爆火,观察者网报道称"大量海外网友自发点赞",杨立昆和知名投资人Jason都转了发。微博

还有两个花絮:7月11日,他转发力挺了一项MIT脑科学研究——人脑做逻辑推理时语言脑区并不激活,和他"LLM只学到语言模式、不是真理解"的主张正好呼应;8月11日,Meta开放30B Agent模型MuseGlimmer的权重,他直接出现在扎克伯格的评论区,为这一步鼓掌叫好。36氪

一个天天骂大模型的人,花了一个月给开源模型挨个点赞。这不是口误,是他一以贯之的立场。他点赞的方向,也正是数据里冲得最猛的方向:今年前七个月,前沿开源模型的参数规模上限,一直由中国实验室顶着。36氪

杨立昆三连赞中国开源模型,一个月后行业真的变天了:这些免费模型值得玩

他骂的是闭源垄断,不是开源

很多人误会杨立昆的"LLM死路论"是无差别开炮。但他今年5月在播客里的表态其实很清楚:

他承认LLM是真好用——对话、文案、代码、检索极其能打,是划时代的产品,自己日常也高频使用。他否定的只有一件事:靠闭源加堆参数的纯文本路线,到不了AGI。

对闭源巨头,他有个著名比喻:"今天的OpenAI,就是昨天的Sun公司。"Sun当年靠Solaris和Java风光无限,最终被开源生态颠覆。他的原话更直接:就像当年Linux击溃微软,开源AI终将统治世界。知乎

这样看,矛盾就解开了:他骂的是闭源垄断,不是开源阵营;骂的是纯文本堆参数,不是中国模型。恰恰相反,中国开源是他最乐见其成的力量——便宜、开放、人人可查、不受任何一家公司控制。

他自己也一直这么做:在Meta的12年,他是推动Llama系列开源的核心人物之一;2025年底离开Meta创办AMI Labs、押注世界模型,对开源的态度也没变过。

一个月后,全行业跟上了

然后是大家都看到的8月转折:

  • Vercel AI Gateway数据:4月11% → 6月下旬28.4% → 8月22日62%,开源Token调用份额首次反超闭源。DeepSeek一家拿走22.6%;智谱GLM-5.2上线两周,日Token消耗量暴涨约50倍。36氪

  • OpenRouter周榜,调用量前五全是开源模型,全部来自中国团队。

  • 全球最大开源模型平台的春季报告显示:中国开源模型下载量占全球41%,超越美国,累计下载100亿次。知乎

  • 黄仁勋7月发文《Open Weights and American AI Leadership》,说"美国的AI领导力不取决于单一的闭源前沿模型";本周60亿美元砸向Poolside,目标是一年内做出超万亿参数的前沿开源模型。36氪

  • 闭源巨头被拖进价格战:OpenAI的GPT-5.6系列破天荒把"单位美元性能"当卖点,Anthropic的Opus 5价格腰斩,谷歌Gemini 3.7 Flash距上一代仅三周、价格再对半砍。36氪

把镜头拉长:SemiAnalysis复盘了三代范式的追赶曲线——开源旗舰追上闭源旗舰的时间,从19.7个月缩到8.5个月,再缩到4.8个月;两者的起始分差,也从35.8分一路缩到12.1分、6.8分。36氪

杨立昆三连赞中国开源模型,一个月后行业真的变天了:这些免费模型值得玩

更值得玩味的是硬币另一面。《华尔街日报》8月1日报道,硅谷开源公司Arcee AI用2000万美元、2048块B300、33天训出一个开源模型,找VC融资几乎全被拒绝,有合伙人原话是:“我不希望这种模式成功,这会损害我在OpenAI和Anthropic上的投资。”

美国资本攥着闭源的仓位,全球开发者用Token投票。中间的裂缝,正是杨立昆念叨了两年的东西。而下载量就是选票的原始记录:Qwen家族以20.45亿次下载,成为全球下载最多的开源模型系列。36氪

杨立昆三连赞中国开源模型,一个月后行业真的变天了:这些免费模型值得玩

先泼盆冷水:"点赞"不等于背书

有几句降温的话要说在前面:

  1. 转发不等于性能背书。 杨立昆转的,一个是垂直工具模型,一个是品牌宣传片,点赞的是开源方向,不代表为每个模型的能力站台。

  2. 调用量份额不等于营收份额。 62%反超的是Token调用,闭源巨头的商业收入依然可观,OpenAI、Anthropic的生意没有一夜垮掉。

  3. 他自己的赌局还没开奖。 AMI Labs的10.3亿美元种子轮到位了,但世界模型产品仍未正式发布。开源判断被验证,不等于世界模型判断也被验证。

对普通玩家,现在真正值得玩的是什么

落到最实际的问题:这些被"杨立昆点赞过"和同类的中国开源模型,现在值得上手吗?

本地部署党(单张4090/24GB显存):

  • Qwen3.8-27B:本周刚开源,AMD已官宣Day 0支持,有微博玩家实测4090上本地能跑约100 tokens/s,27B稠密模型,是目前开源第一梯队里对消费级硬件最友好的选择。微博微博

  • Meta MuseGlimmer:30B Agent模型,Apache 2.0开放权重,24GB显存可跑,量化后不到20GB,断网也能用——就是杨立昆评论"很棒的一步"的那个。36氪

轻量工具党:

  • 百度Unlimited OCR:Hugging Face和GitHub免费开源,224万下载,有文档识别、扫描件处理需求的朋友可以直接上手试。

API轻度用户:

  • DeepSeek V4 Flash缓存命中后约0.2元/百万tokens,Qwen3.7 Flash约0.03美元/百万输入token。日常干活,成本已经可以忽略不计。

纯围观群众,留三个观察信号:

  1. 阿里8月已开放Qwen3.8-Max的2.4T旗舰权重——最顶级开源模型,现在由中国公司先放出来。36氪

  2. Meta预告旗舰模型MuseSpark 1.2也将开放权重,开源攻势还在继续。36氪

  3. 英伟达计划一年内产出超万亿参数的前沿开源模型,开源闭源真正的正面战,现在才开始。

杨立昆三连赞中国开源模型,一个月后行业真的变天了:这些免费模型值得玩

两年前杨立昆说"开源AI终将统治世界",评论区一片嘲讽。今天,连卖显卡的都掏了60亿美元。

他的世界模型赌局还没开奖,但开源这一局,他先赢下一城。

内容由AI生成

精选参考来源

1. 开源模型两个月内杀死比赛

2. 老黄斥资60亿美元,打造全球顶尖开源模型

3. 图灵奖得主杨立昆称中国开源模型超越专有,这释放了哪些信号?

4. Anthropic还在担心开放模型,会冲击公司的商业战略,结果中国开源模型UnlimitedOCR和KimiK3领衔全球开源模型榜单,并在国内外引起热议。图灵奖获得者杨立昆转发推荐UnlimitedOCR,多位AI领域大佬也都下场点赞,引发社区持续刷屏。要知道,这俩中国开源模型双子星包揽了全球趋势榜前两名,往大了说...全文

5. 【#中国AI宣传片Qwen3.8海外爆火#大量海外网友自发点赞】8月3日,Qwen海外官方账号发布Qwen3.8宣传片,并宣布模型即将开源。镜头里没有宏大的技术叙事,只讲了一件事:AI帮人工作,人享受生活。视频意外在海外爆火。图灵奖得主杨立昆和投资人Jason转发,还有网友盛赞“这是我看过AI模型发布的最佳广告...全文

6. 小扎高调开战闭源AI,推30B智能体模型,消费级显卡就能跑,杨立昆点赞

7. 过去7个月,美国开源模型向中国“抄作业”

8. 图灵奖得主杨立昆:现在的大模型方向错了,2027年答案就会揭晓

9. 美国VC拒绝开源那天,中国模型屠了全球榜

10. 【#AMD为Qwen3.827B提供Day0支持#】8月25日,@AMD中国表示,Qwen3.827B为千问家族的最新一代模型带来了非常适合本地AI开发的模型规模。AMD正式为Qwen3.827B提供Day0支持。从模型发布首日(Day0)起,开发者即可在基于AMD处理器的PC和工作站上本地运行这款领先的稠密模型。据CNMO科技了解,用...全文

11. Qwen3.8-27B开源,我直接说了,这就是本地能跑的Opus4.6,270亿参数,4090上100token/s,智商高得离谱。我拿它翻微信聊天,把意念回复全捞出来;答辩时当外挂,0.3秒出答案,真心爽。但别以为我吹本地部署是为了省钱——现在薅云端token羊毛比电费还便宜,100亿token才100块,老佛爷买单。Qwen27B真正...全文

1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章