21. SpaceXAI 重磅发布 Grok 4.5:专注编码、Agentic 任务与知识工作的“最强模型”**
2026年7月8日,SpaceXAI(xAI)正式推出 **Grok 4.5**,这是该公司迄今为止最智能的模型,专为真实世界工程任务、编码和 Agentic(智能体)工作流优化打造。该模型与 Cursor 联合训练,在速度、效率和实用性上实现显著突破,被定位为“Opus-class”但更快速、更具成本效益的解决方案。
核心亮点
- 参数规模与训练:基于 V9 基础模型,约 **1.5 万亿参数**。在数万块 NVIDIA GB300 GPU 上训练,强调高质量数据过滤、强化学习(RL)和多步工程任务优化。
- **性能定位**:在编码和 Agentic 任务上表现出色,Intelligence Index 上位居前列(第4位),Coding Agent Index 得分强劲,与 GPT-5.5 相当,但成本和速度优势显著。
**基准表现亮点**(部分数据来自官方与第三方评估):
- Terminal Bench 2.1:Grok 4.5 得分 **83.3%**,接近领先模型。
- DeepSWE 等编码基准:在 SWE-Bench Pro 等任务中高效解决,**输出 token 效率高出 4.2 倍(平均仅用 ~16k token vs Opus 4.8 的 67k+)。
- 速度与效率:推理速度达 **80 TPS**(tokens per second),远超同级“闪电模型”,结合 token 高效性,让迭代开发更流畅,保持用户创造力“流状态”。
- 实际应用:擅长 Rust/C++ 等复杂编码、一键生成完整应用、Office 工具集成(Excel 复杂模型、PowerPoint 图表、Word 文档)。默认集成到 Grok Build,支持端到端工作流。
- 定价:输入 $2 / 百万 tokens,输出 $6 / 百万 tokens**,远低于竞品,结合效率优势,整体成本大幅降低。
市场意义与背景
Grok 4.5 的发布标志着 AI 竞赛从“纯智能”转向“实用效率+工作流闭环”。它充分利用 Cursor 数据飞轮,强化开发者工具生态。Elon Musk 表示,模型每周都会在 Grok Build 中带来可见提升,未来上下文窗口将升级至 1M tokens。
与 Fable 5、GPT-5.5、Claude Opus 等前沿模型相比,Grok 4.5 强调“足够好 + 极快 + 极便宜”的 Pareto 最优,特别适合日常工程、知识工作和 Agent 场景。
总结:Grok 4.5 不是单纯的参数竞赛产物,而是 SpaceXAI 在真实工程场景下的实用突破。它加速了 AI 从“实验工具”向“日常生产力引擎”的转变,为开发者与企业带来更高效的选择。
#SpaceX#