OpenAI连砍33%背后:芯片自研+分层定价,一场锁定开发者的算力卡位战

源自122位全网作者

13:03

内容由AI生成

精选参考来源

1. GPT-5.6 Sol API 的费用将降价 20%以上

2. 属于AI应用层的“成本下移时刻”!GPT-5.6 Sol降价逾20% 智能体商业化获得新引擎

3. Kimi涨价、OpenAI降价:都想争行业定价权

4. OpenAI最强大模型降价!API直降两成

5. 输出价直降33%!OpenAI这次连旗舰都降价了

6. 上线三周开启屠龙刀法,OpenAI定价的底层逻辑正在被改写

7. 输出价直降33%!OpenAI这次连旗舰都降价了

8. 问OpenAI 降价后用户反馈 开发者叫好声中暗藏账单翻倍陷阱

9. GPT-5.6 降价 80% 后踩坑实录:Fast 模式 2 倍价、priority 自动迁移,5 个坑让账单翻倍

10. OpenAI自研芯片Jalapeño性能实测:每瓦吞吐量比英伟达GB300高1.9倍,AI推理芯片怎么选?

11. 2026年的AI行业,正在上演一场罕见的"围城"。 城外的人想冲进去,城里的人想逃出来。 据The Information报道,OpenAI发布了首款自研芯片Jalapeño,与博通联手从设计到流片仅用9个月,据称推理成本可降低约50%。Anthropic挖走了谷歌TPU业务创始人,砸2.5亿美元收购芯片公司,冲刺IPO前夜,最核心的故事不是模型,是"去英伟达化"。据报道,Meta自研芯片Iris即将量产。DeepSeek被曝秘密造芯已超一年。据市场消息,智谱正推进港股上市,芯片是重点投向。据36氪等媒体报道,字节跳动组建了数百人芯片团队,2026年AI总投入达1600亿元,其中850亿指向芯片。 与此同时,城墙另一边—— 英伟达正在全力研发下一代旗舰开源大模型Nemotron 4,上一篇技术论文署名570人,创下行业纪录。8月11日刚发布30B参数的Nemotron 3.5 Lightning。更早之前,英伟达还发布了物理AI世界模型Cosmos 3、人形机器人专用模型Isaac GR00T。 据公开报道,AMD收购了一家叫Taalas的公司,干的事更极端——把大模型的权重直接固化到芯片硬件上。单芯片推理速度据称可达1.7万token/秒,但代价是芯片只能跑设计时对应的模型,换个模型就废了。 大模型公司怕被芯片公司卡脖子,芯片公司怕被大模型公司抛弃。两边都在往对方的地盘冲,结果所有人都在变成自己曾经想摆脱的那个人。 为什么? 第一,推理成本是生死线。 2026年推理算力已占全部AI计算的三分之二以上。对大模型公司来说,推理成本就等于毛利率。英伟达GPU的溢价直接吃掉了他们的利润。OpenAI的Jalapeño据称把推理成本砍了一半——这不是优化,是换了一个定价权。 第二,模型架构正在收敛。 到2026年,主流AI模型架构基本趋于稳定。架构一旦稳定,就可以针对它做极致定制芯片。Taalas甚至把模型权重直接刻进硅片——模型就是芯片,芯片就是模型。 第三,AI在帮自己设计芯片。 传统芯片从设计到流片要18到24个月,OpenAI的Jalapeño只用了9个月。因为AI在辅助芯片设计,周期直接腰斩。以后模型迭代一次,芯片就能跟着迭代一次,两者的耦合会越来越紧。 历史上,苹果走的就是这条路。做iOS的同时自研A系列和M系列芯片,软硬一体碾压所有对手。规律很清楚:每当软件进入应用爆发期,就会反向吞噬硬件层。因为通用硬件无法满足极致需求,定制化才能吃到最后一滴效率。 未来的AI行业,可能只剩下3到5个"全栈玩家"。 英伟达:芯片加模型加CUDA生态。谷歌:TPU加Gemini加GCP云。亚马逊:Trainium加AWS(通过投资Anthropic绑定Claude)。微软:Maia加GPT加Azure。Meta:MTIA加LLaMA加社交帝国。 中间层的独立大模型公司如果不造芯片,就会被掐脖子。如果不做云服务,就会被渠道绑架。所以Anthropic必须在IPO前把芯片故事讲圆,所以DeepSeek和智谱必须秘密造芯。 对中国来说,这既是挑战也是机会。 挑战是显而易见的:美国出口管制让国内买不到英伟达顶级GPU,必须自研。但机会在于,中国的大模型公司和芯片公司更容易形成深度绑定。智谱找寒武纪,字节找中诚华隆,DeepSeek找国内芯片设计公司——这种"模型加芯片"的国产组合,在美国出口管制的倒逼下,反而可能加速跑通。 回到那座围城。 造芯片的想做模型,做模型的想造芯片。所有人都在试图摆脱对别人的依赖,结果所有人都在变成自己曾经想摆脱的那个人。 这像极了一句话:你以为你在选择赛道,其实赛道在选择你。 而英伟达的老黄,可能比谁都更早看透了这一点。他在GTC 2026上反复强调一个词——"极限协同设计"。芯片、封装、系统、数据中心,全栈协同,任何一个环节不协同,万卡集群效率就会指数级崩塌。 说白了,他不是在卖芯片,他是在卖一整套"AI操作系统"。 当所有人还在争论谁的模型更强、谁的芯片更快的时候,真正的战场已经不在这里了。真正的战场是:谁能定义整个AI工厂的构建模式。 单点突破的时代结束了,深度协同的时代开始了。 (本文仅为行业观察,不构成任何投资建议)

12. OpenAI下调GPT-5.6API价格。OpenAI 宣布,GPT-5.6 Sol 的 API 价格下调超过 20%。 降价覆盖 API 调用,以及符合条件的 ChatGPT Work 与 Codex 套餐积分。公司称,这是把模型效率提升带来的成本节省,直接回馈给客户。同时推出「banked reset」机制,让付费用户获得可灵活使用的额外额度。 在产品线里,Sol 负责扛起主力,与面向日常任务的 Terra、强调速度的 Luna 并列,统一处在 Astra Agent 框架之下。降价之后,写代码和复杂项目的门槛进一步降低,OpenAI 也在成本和质量两条线上同时加码竞争。 模型越强,若价格不同步下来,落地就会卡住。这次调价,等于把「能用」和「用得起」又拉近了一步。 #ai #AI #GPT

13. AI 价格战打响!OpenAI 下调 API,中端 20%、低成本直降 80%

14. 彭博社:中国正快速缩小与美国的AI差距

15. OpenAI、谷歌接连下调大模型价格,美媒称受中国大模型开源定价策略压力

16. 阿里重磅表态:自研芯片替代外购AI算力芯片,毛利率、盈利水平

17. OpenAI自研Jalapeño芯片首测亮相:性能超越顶尖推理处理器

18. 20% price reduction for GPT 5.6 Sol: API, Codex credits and ChatGPT Work

19. OpenAI宣布大幅降价:GPT-5.6 Sol模型API与Credit费用最高降33%

20. OpenAI大模型1个月内两次大幅降价 价格战引发市场变局

21. Token经济的:拆解 AI 推理成本的细节

22. Anthropic确认拥有内部芯片团队:协同设计有望将Claude的推理成本削减一半

23. 说好的暴涨呢?OpenAI竟降价80%

24. 砍到脚脖子!OpenAI 模型暴降 80%,AI 便宜得像水电

25. ChatGPT lost me on subscription experience, not product quality

26. 每天学点经济学的微博

27. OpenAI自研芯片取得关键突破:响应速度、能效表现击败英伟达GB300

28. OpenAI免费版升级GPT-5.6 Luna,API降价80%后ChatGPT订阅还值得买吗?

29. 2026大模型集体降价,推理芯片成本成痛点,DeepSeek等厂商自研之路难在哪? 转载

30. OpenAI首颗自研芯片Jalapeño实测:功耗吞吐提升1.9倍,9个月完成流片蓝图

31. 突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA

32. 突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章