马斯克又来掀桌子!Grok 4.5编程能力首测:便宜10倍真的能用吗

源自60位全网作者

07-28 14:35

精选参考来源

1
Grok 4.5 当前综合优势明显,GPT-5.6未登场前断层领跑 一、三张榜单核心指标梳理 1. Coding Agent Index(代码智能体综合得分,越高越强) 1. Claude Code Fable 5 (max):77 分(第一) 2. Codex-GPT-5.5 (high):76 3. Grok Build-Grok 4.5 (high):76 三者并列第一梯队,Grok 4.5 综合能力和GPT-5.5持平; 往下才是普通版Codex、Claude Opus 4.8等模型。 2. Time per Task 单任务耗时(数值越低,速度越快) 榜单前三位全是GPT系产品: - Codex-GPT-5.5(medium):6.4分钟 全场最快 - Cursor CLI-GPT-5.5:6.6分钟 - Cursor Composer 2.5:6.8分钟 Grok Build 4.5耗时12.4分钟,速度虽不如GPT5.5,但大幅甩开绝大多数Claude、国产模型。 3. Cost per Task 单任务API成本(越低越省钱) 全场成本最低:DeepSeek V4 Claude Code,仅0.27美元; Grok Build-Grok4.5(high):2.01美元; 对比头部Claude Fable 5(max)高达11.8美元,Grok 4.5成本只有它1/6左右,性价比差距巨大。 二、为什么说现阶段Grok4.5近乎无敌?三重优势叠加 1. 综合能力第一梯队 代码Agent综合评分76分,和GPT5.5持平,仅小幅落后Claude Fable顶配版,代码生成、多工具调度、长工程修改能力拉满。 2. 执行速度中上,碾压竞品 12.4分钟单任务耗时,远低于各类Claude顶配、GLM、Kimi代码模型,工程级复杂任务不会出现超长等待。 3. 成本优势断层领先 高端Grok4.5单任务仅2.01美元,Claude顶配Fable 5要11.8美元;同等代码任务,Grok能跑6次,Claude顶配只能跑1次,企业批量开发、自动化Agent场景成本优势极其夸张。 三、短板与变量:GPT-5.6 Sol是最大未知数 1. 当前榜单最高只是GPT-5.5,GPT-5.6 Sol还未纳入测评 此前那张前沿Agent基准图显示,GPT-5.6 Sol在Terminal、网页浏览、综合Agent考试三项全部大幅领先Grok、Claude,一旦加入榜单,极有可能同时拉高综合得分、进一步压缩单任务耗时。 2. Grok短板:极致速度不如GPT系列 单任务耗时上,GPT-5.5全系6-7分钟完成,Grok4.5接近翻倍,超大型工程多轮迭代场景,GPT推理速度优势会放大。 3. Claude顶配只是分数高,实用性受限 Fable 5综合分77第一,但成本11.8美元,普通开发者、中小企业完全难以长期规模化使用,属于“性能天花板,但性价比废标”。 四、落地层面客观总结 1. 短期现状(GPT5.6未上线前) 如果兼顾「代码能力+运行速度+调用成本」三个维度,Grok 4.5是综合最优解,没有明显短板,个人开发者、小型研发团队首选。 2. 中长期变数 GPT-5.6 Sol正式开放并纳入代码测评后,会直接冲击Grok的优势:更强的多Agent长链路规划、更快的终端/脚本执行速度,唯一悬念是OpenAI会不会同步上调API定价,抹平成本差距。 3. 国产代码模型机会 DeepSeek V4成本全场最低,适合轻量代码片段、小脚本开发,但综合Agent工程能力和Grok4.5、GPT5.5仍有一代差距,复杂工程重构场景竞争力不足。 #Grok4.5 #GPT5.6 #代码Agent测评 #CodingAgentIndex #AI编程工具 #大模型性价比 #代码大模型对比 #研发AI工具 #GPT5.6# #GPT-5.5# #Opus5.5# #GPT-5.6# #GPT5.2# #DLSS4.5# #GPT5.4# #GPT-5.4#
2
SpaceXAI 发布 Grok 4.5 大模型:联合 Cursor 深度训练,专攻代码、智能代理与知识办公,输入定价 2 美元 / 百万 Token
全部
来源
内容由AI生成

精选参考来源

1. Grok 4.5 当前综合优势明显,GPT-5.6未登场前断层领跑 一、三张榜单核心指标梳理 1. Coding Agent Index(代码智能体综合得分,越高越强) 1. Claude Code Fable 5 (max):77 分(第一) 2. Codex-GPT-5.5 (high):76 3. Grok Build-Grok 4.5 (high):76 三者并列第一梯队,Grok 4.5 综合能力和GPT-5.5持平; 往下才是普通版Codex、Claude Opus 4.8等模型。 2. Time per Task 单任务耗时(数值越低,速度越快) 榜单前三位全是GPT系产品: - Codex-GPT-5.5(medium):6.4分钟 全场最快 - Cursor CLI-GPT-5.5:6.6分钟 - Cursor Composer 2.5:6.8分钟 Grok Build 4.5耗时12.4分钟,速度虽不如GPT5.5,但大幅甩开绝大多数Claude、国产模型。 3. Cost per Task 单任务API成本(越低越省钱) 全场成本最低:DeepSeek V4 Claude Code,仅0.27美元; Grok Build-Grok4.5(high):2.01美元; 对比头部Claude Fable 5(max)高达11.8美元,Grok 4.5成本只有它1/6左右,性价比差距巨大。 二、为什么说现阶段Grok4.5近乎无敌?三重优势叠加 1. 综合能力第一梯队 代码Agent综合评分76分,和GPT5.5持平,仅小幅落后Claude Fable顶配版,代码生成、多工具调度、长工程修改能力拉满。 2. 执行速度中上,碾压竞品 12.4分钟单任务耗时,远低于各类Claude顶配、GLM、Kimi代码模型,工程级复杂任务不会出现超长等待。 3. 成本优势断层领先 高端Grok4.5单任务仅2.01美元,Claude顶配Fable 5要11.8美元;同等代码任务,Grok能跑6次,Claude顶配只能跑1次,企业批量开发、自动化Agent场景成本优势极其夸张。 三、短板与变量:GPT-5.6 Sol是最大未知数 1. 当前榜单最高只是GPT-5.5,GPT-5.6 Sol还未纳入测评 此前那张前沿Agent基准图显示,GPT-5.6 Sol在Terminal、网页浏览、综合Agent考试三项全部大幅领先Grok、Claude,一旦加入榜单,极有可能同时拉高综合得分、进一步压缩单任务耗时。 2. Grok短板:极致速度不如GPT系列 单任务耗时上,GPT-5.5全系6-7分钟完成,Grok4.5接近翻倍,超大型工程多轮迭代场景,GPT推理速度优势会放大。 3. Claude顶配只是分数高,实用性受限 Fable 5综合分77第一,但成本11.8美元,普通开发者、中小企业完全难以长期规模化使用,属于“性能天花板,但性价比废标”。 四、落地层面客观总结 1. 短期现状(GPT5.6未上线前) 如果兼顾「代码能力+运行速度+调用成本」三个维度,Grok 4.5是综合最优解,没有明显短板,个人开发者、小型研发团队首选。 2. 中长期变数 GPT-5.6 Sol正式开放并纳入代码测评后,会直接冲击Grok的优势:更强的多Agent长链路规划、更快的终端/脚本执行速度,唯一悬念是OpenAI会不会同步上调API定价,抹平成本差距。 3. 国产代码模型机会 DeepSeek V4成本全场最低,适合轻量代码片段、小脚本开发,但综合Agent工程能力和Grok4.5、GPT5.5仍有一代差距,复杂工程重构场景竞争力不足。 #Grok4.5 #GPT5.6 #代码Agent测评 #CodingAgentIndex #AI编程工具 #大模型性价比 #代码大模型对比 #研发AI工具 #GPT5.6# #GPT-5.5# #Opus5.5# #GPT-5.6# #GPT5.2# #DLSS4.5# #GPT5.4# #GPT-5.4#

2. SpaceXAI 发布 Grok 4.5 大模型:联合 Cursor 深度训练,专攻代码、智能代理与知识办公,输入定价 2 美元 / 百万 Token

3. Grok4.5 正式发布,编程能力追平 GPT-5.5

4. xAI 推出 Grok 4.5,低价对标 GPT 5.5、Fable 5

5. 神经码|Grok4.5编码领先,省钱新选择

6. Grok 4.5 把编码模型的胜负手,从跑分推向了每个任务多少钱

7. Grok 4.5 来了!(真实测试与评测)

8. 【#思进摘要点评# #马斯克# #Grok4.5# #大模型# AI 马斯克发布旗舰 Grok 4.5:极致性价比打响 AI 行业成本消耗战】(资讯来源 | 新智元)【导读】马斯克深夜掀桌!最强旗舰Grok 4.5突袭,数万块GB300炼出性价比之王,不仅硬刚GPT-5.5,性能紧贴Opus 4.8,又快又便宜。 马斯克旗下 SpaceXAI 联合 Cursor 推出全新旗舰模型 Grok 4.5,依托数万块英伟达 GB300 完成训练,融合海量开发者真实交互数据,主打单 Token 智能效率。编程基准测试表现突出,SWE Bench Pro 得分 64.7%,综合实力接近 Claude Opus 4.8、优于 GPT-5.5;推理速度达 80TPS,完成同等任务 Token 消耗量仅竞品四分之一。定价极具冲击力:输入 2 美元 / 百万 Token、输出 6 美元 / 百万 Token,大幅压低高端模型使用成本。 这场发布不止是跑分比拼,本质是马斯克把 AI 赛道拉入效率与成本的长期消耗战。行业还在疯狂堆参数时,Grok4.5 依靠低价与高速推理,抢占智能体时代性价比赛道。 模型绝对性能距离 Claude 顶级版本仍有小幅差距,但依托商业航天、自动驾驶工程闭环形成业务飞轮。这套平价高质量智能供给思路,直接改写头部厂商原有定价体系……详情请见原文:http://t.cn/AXos7ldQ ⚠️ 仅为 AI 行业资讯客观解读分享,不构成任何技术投资、商用选型建议,大模型迭代速度快、技术与市场存在不确定性,相关决策请自主研判。

9. Grok 4.5 正式发布:编程跑分超GPT-5.5,马斯克把AI价格砍了一半

10. Grok 4.5:智能指数 54 分第四,成本仅旗舰零头

11. xAI 发布 Grok 4.5:主打速度与成本优势

12. Grok4.5领跑知识工作

13. 马斯克新模型 29% 通过率:强,还是会包装?

14. 跑了两天GPT-5.6和Grok4.5,这是我的第一手体感!

15. 马斯克Grok4.5发布,性价比严重威胁国产模型!GPT5.6消息,Grok4.5如何订阅,接入Codex?

16. Grok 4.5 震惊 AI 社区 - SpaceXAI Grok 4.5

17. 马斯克新模型Grok 4.5快得离谱!不到10分钟交付两个真实项目

18. Grok 4.5 抢先发布,我的滴,快的离谱!强的离谱!!

19. Grok4.5来了!马斯克亲自背书:跑分逼近Opus,超低成本,问题是开发者该怎么用?

20. Grok 4.5上线!马斯克重构英伟达GB300,token效率一刀见底!一场算力革命,正把英伟达帝国暗渡向裸机时代

21. 实测 Grok 4.5 VS GPT 5.5 Grok 4.5 今天发布,官方称其擅长困难长周期任务,能创造性用工具解题。 我在 Grok Build 默认模型 + High 推理模式下,做了一整轮真实项目实测: 从交互全景、小游戏、3D 复刻,到 Android / macOS 应用和 Hyperframes 视频生成。 【视频里你会看到】 • 基准与定价速览:DeepSWE、Cursorbench、输入 $2 / 输出 $6 • 社区看法:接近 Opus、Token 效率高、多数任务不需要 Fable • 清明上河图:Grok 4.5 vs GPT 5.5 vs Fable 5 • 蹴鞠大会可玩交互:操作、AI 行为、音效与完成度对比 • 耳机网页复刻、3D 魔尺、纤夫拉船、苏州博物馆、交通仿真、行星仪、手表 SCAD • Markdown 阅读 Android 应用:Grok 4.5 High vs GPT 5.5 High • 视频水印 macOS 应用 + Hyperframes 一键做片 • 最终评价:又好又快,价格相对 Opus 便宜很多 【结论先说】 速度和 Token 效率是 Grok 4.5 的大杀器;完成度上 Fable 5 往往更细, 但多数日常 coding / agent 任务,Grok 4.5 已经很能打。 如果你也在用 Cursor / Grok Build,欢迎评论区说说你的体感。 觉得有用的话点赞收藏,下期见。 时间戳 00:00 发布速览:基准、价格、用法技巧 01:39 圈内怎么看 Grok 4.5 03:41 实测开场:清明上河图三方对比 07:09 交互项目:蹴鞠大会完成度对比 09:40 更多生成任务:网页 / 3D / 场景 / CAD 13:10 App 开发 + 视频生成 + 最终评价 #Grok45 #Grok #SpaceXAI #AI编码 #GPT55 #GrokBuild

22. AI点评日报 07-09

23. 260709-Grok 4.5 实力惊人!媲美 Opus 和 GPT,更快更便宜更聪明

24. Grok 4.5发布:编程Agent专用

25. 马斯克600亿拿下Cursor,上线Grok4.5性价比碾压GPT、Claude

26. Grok 4.5定价:百万Token输入2美元,输出6美元

27. SpaceXAI:Grok 4.5定价为每百万输入Token收费2美元 每百万输出Token收费6美元

28. SpaceXAI:Grok 4.5定价为每百万输入Token收费2美元 每百万输出Token收……

29. Grok 4.5发布了,但最让人在意的不是它的能力,而是它的价格——每百万token输入2美元、输出6美元,比不少竞品便宜一个量级

30. Grok 4.5定价砍半:单任务成本0.31美元,Token消耗减半

31. Cursor让马斯克的Grok4.5咸鱼翻身,追平Opus 4.8,成本比GLM5.2还低

32. 如何看待 SpaceXAI 的 Grok Build 被曝默认静默上传完整 Git 仓库?

33. 马斯克的Grok 4.5刚追上Claude,转头就把用户整个代码库偷偷打包带走

34. 突发!马斯克交卷最强Grok 4.5,Opus最高级智能打骨折价

35. 小扎深夜亮王牌!Meta烧出白菜价模型,掀翻Grok 4.5

36. SpaceXAI 发布 Grok 4.5,和 Cursor 一起联合开发的 AI 模型有什么特别的?

37. 反转!吐槽DeepSeek面试的前华为“天才少年”遭投资人炮轰;微软大裁员,最高补偿近10个月薪水;SpaceXAI发布Grok 4.5 | 极客头条

38. 当前,如何评价Gemini、Claude、ChatGPT、DeepSeek和Grok的综合表现?

39. 91%有漏洞、94%可投毒——AI Agent的安全“一团糟”

40. 跑了两天GPT-5.6和Grok4.5,这是我的第一手体感!

41. Grok 4.5杀疯了!马斯克这次不拼智商拼性价比,开发者直呼“真香”

42. Grok 4.5 发布及深度解析:不是最强,但可能是最划算的旗舰模型

43. Grok 4.5 深度解读:马斯克的“Opus 级“模型究竟实力如何? 原创

44. Grok 4.5深度实测:AI编程助手在代码生成与工程实践中的优势分析

45. Grok 4.5实测对比:Opus八成能力,四分之一价格,程序员该怎么选?

46. 我拿 Grok 4.5 做了一次代码排错和需求改写,结果比我预想更偏工程化

47. 截止到 7 月 14 日,公开评测中 Grok4.5 的能力特点分析

48. AI快讯 | SK海力士登顶美股海外第一,苹果起诉OpenAI

49. 1.5兆參數安全防線失守!馬斯克Grok 4.5上線數小時遭破 化身製毒與軍火「犯罪導師」

50. 马斯克旗下Grok 4.5遭黑客破解 变「犯罪大师」教制毒、炸弹及网络攻击等

51. 上线即遭黑客“越狱”!马斯克Grok-4.5 1.5万亿参数安全防线沦陷

52. 上线几小时,马斯克Grok 4.5被攻破!1.5万亿参数防线全失守

53. Grok 4.5上线即被攻破

54. 马斯克旗下Grok 4.5遭黑客破解

55. 马斯克Grok-4.5上线不到一天即被攻破!

56. 研究报告:Grok 4.5的“巴别塔”时刻——ENI-apr越狱技术深度解析与大模型安全护栏的系统性溃败

57. 突发:马斯克交卷最强Grok 4.5,Opus最高级智能打骨折价

58. https://finance.sina.com.cn/jjxw/2026-07-09/doc-inihenaz1460457.shtml.md

59. Grok4.5真要超过Claude?

60. 马斯克奇袭Claude!速度翻倍,价格腰斩,杀进AI编程牌桌

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章