大模型8月集中爆发,GLM-5.3-Flash价格仅为对手闲时价30%
源自315位全网作者
09-02 19:05
精选参考来源
1
日均Token破500万亿,智能体的大爆发,正在制造一场算力“海啸”,明天这几个方向有望继续“嗨”了……消息上:我国日均词元调用量破500万亿,中国大模型居全球第一梯队。竞争焦点转向智能体落地与生态建设,推理算力需求爆发,互联网大厂加速布局AI智算中心并锁定资源。(消息来源于央视财经)日均500万亿词元调用彰显真实需求爆发,指数级增长意味着整个产业链的盈利模式正变得清晰。从侧面也看得出我们的AI已从技术储备迈向市场规模化的商用。现在AI竞争焦点转向智能体落地,AI开始真正赋能千行百业,推动产业智能化升级。算力成为核心战略资源,大厂重金布局智算中心,预示基础设施投资浪潮正在加速阶段了。总的来说,此消息大利好四大方向:1️⃣最直接受益无疑是算力基础设施。词元爆发直接带来算力刚需,这是业绩确定性最高的环节。2️⃣算国产AI芯片/GPU以及光模块/PCB3️⃣ IDC/算力租赁和液冷4️⃣云服务与MaaS。云厂商正从租赁转向按词元消耗计费的MaaS模式,有望实现量价齐升。5️⃣AI应用与智能体(Agent)6️⃣电力
2
#牛来大模型6天用掉数十万亿词元##牛来大模型来自北京# 8月26日晚,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型,已面向全球开源。同日,此前在OpenRouter(全球头部大模型聚合平台)、OpenCode(开源AI编程助手平台)上匿名爆火的模型Ox-Alpha,也被证实来自这家总部位于北京的大模型公司。前沿智能不需要省着用,成了智谱此次发布模型的一大亮点,GLM-5.3-Flash定价约相当于海外知名模型Opus 4.8的40分之一。智谱团队表示,这主要源于GLM-5.3-Flash同时实现的多项架构升级,通过采用稀疏注意力与线性注意力混合架构,技术团队实现了保持精准长上下文能力的同时,大幅降低长上下文服务成本。智谱透露,为收集广大用户的广泛、专业反馈,在正式发布GLM-5.3-Flash前,团队以匿名模型Ox-Alpha在OpenCode和OpenRouter上进行了大规模测试。Ox意为“牛”,恰逢电影《牛来》走红,Ox Alpha也被中文开发者们称作“牛来大模型”。上线后,Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。公开信息显示,从8月20日匿名上线,到8月26日期间的六天,Ox Alpha已经让全球开发者用掉了数十万亿Token(词元)。值得注意的是,这些请求流量全部由国产芯片提供算力支持。智谱表示,这是其首次在大规模流量中尝试用国产芯片集群提供服务,这些芯片均通过自研高带宽互联网络连接。(来源:福布斯中文网)北京日报的微博视频
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹