张大妈

???神秘模型屠榜御三家;Grok4.20本周发布新版本 | 2月24日AI日报第316期

源自UP主:infinite灵感港

02-25 10:40

今日AI领域动态不断:新模型Apex-1横空出世,多项基准测试登顶;ChatGPT被曝将推新订阅档位;月之暗面收入实现爆发式增长;Grok也预告了新版发布。这些事件揭示了技术竞赛的激烈与商业变现的加速,值得深入关注。

???神秘模型屠榜御三家;Grok4.20本周发布新版本 | 2月24日AI日报第316期智能速览

  • 新模型Apex-1在多项基准测试中排名第一,引发行业关注

  • ChatGPT被发现代码中或有月费100美元的Pro Lite套餐,填补价格区间

  • 月之暗面近20天收入已超2025年全年,海外收入成主要增长点

  • Grok 4.2 Beta 2版本将于本周发布,计划修复此前版本问题

  • Apex-1采用按需付费模式,并公开嘲讽OpenAI的订阅限制

???神秘模型屠榜御三家;Grok4.20本周发布新版本 | 2月24日AI日报第316期精华内容

从新模型的横空出世到头部玩家的商业布局,今日的AI领域动态不仅揭示了技术迭代的迅猛速度,也反映了市场竞争进入白热化阶段。

Apex-1屠榜基准测试

一款名为Apex-1的新模型发布,其在多项权威基准测试中取得了第一名的成绩。其中,在SWE-bench Verified测试中获得82.0%的分数,在Terminal-Bench 2.0中得分70.2%,两项均为全球最高。此外,在ARC-AGI2、T2-bench等测试中也名列前茅。该模型支持100万token的上下文窗口,并能处理文本、图片、音频和视频等多种输入类型。

Apex-1定价与争议

Apex-1宣称采用按需付费模式,无订阅套餐。其定价为输入token每百万3至6美元,输出token每百万15至30美元,并借此公开嘲讽OpenAI的订阅限制。然而,该模型的超高调和宣传也引发了广泛质疑。有观点指出其可能为套壳模型,且所有测试数据均来自其单方面宣称,在官方榜单上并无记录,社区热度也几乎为零,可信度存疑。

ChatGPT或推新订阅档位

在ChatGPT的前端代码中发现了“Pro Lite”的字样,其定价显示为每月100美元。若属实,这将填补现有Plus(20美元/月)和Pro(200美元/月)订阅之间的价格空档,为用户提供更多选择。与此同时,得益于广告功能测试等商业化手段,OpenAI在2025年的总收入有望达到130亿美元,远超此前100亿美元的预期。

月之暗面收入激增

据澎湃新闻报道,AI独角兽月之暗面在发布Kimi K2.5模型后的近20天内,累计收入已超过2025年全年的总收入。此轮增长的最大增量来自海外市场,其海外付费用户高速增长,使得海外收入已反超国内。目前,月之暗面的估值已超100亿美元,其个人助手Kimi Claw也已正式上线iOS端,安卓版本即将推出。

Grok新版即将发布

马斯克在X平台宣布,Grok 4.2的Beta 2版本将在本周内发布。此前发布的Beta版本风评不佳,马斯克表示新版将修复很多问题。此次更新旨在提升用户体验,回应市场反馈,是xAI在激烈模型竞争中保持竞争力的举措。

Apex-1的搅局、ChatGPT的商业化探索、月之暗面的收入爆发以及Grok的快速迭代,共同构成了AI行业当下技术、商业和竞争的复杂图景。这些动态不仅影响着开发者的选择,也在重塑市场格局,未来的走向充满了变数与机遇。

???神秘模型屠榜御三家;Grok4.20本周发布新版本 | 2月24日AI日报第316期关键评论

  • Apex-1高分被质疑或为“把测试集加入训练集”的结果

  • 有用户认为Apex-1宣传过于高调,且公司背景不明,怀疑是纯纯烂炒

  • 部分用户肯定Kimi K2.5的实际表现,认为其在某些场景下可平替Gemini

  • 许多网友依旧对DeepSeek V4的发布抱有高度期待

  • 用户调侃ChatGPT的Pro Lite套餐命名逻辑混乱

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章