Grok 4.7重磅升级:主打长流程编程,核心亮点与实测评估

源自39位全网作者

07:17

SpaceXAI(前身为 xAI)正式推出了旗下新一代大语言模型 Grok 4.7。在不到三个月的时间里,从 Grok 4.5、4.6 到如今的 4.7,xAI 保持着极快的发展节奏。本次发布的 Grok 4.7 将核心目标明确锁定在“编程”与“长流程知识工作”上,主打更强复杂任务处理能力、保持前代基础售价以及更高的执行效率,试图通过高性价比和实用工具落地来占领专业生产力市场。

从技术与参数亮点来看,Grok 4.7 换装了规模更大的底层基座,模型参数量提升至约 2.1 万亿,相比前代的 1.5 万亿增长了约 40%。除了参数规模的扩充,SpaceXAI 还将大量的真实航天工程、星链遥测及相关技术文档等独家数据注入预训练过程,使其在工程领域的语料基础上具备天然优势。此外,该模型在 Cursor 等平台上的上下文处理能力提升到了最高 500K,能够更好地维持大型项目和多轮对话中的上下文信息稳定性。

Grok 4.7重磅升级:主打长流程编程,核心亮点与实测评估

在训练策略和任务处理能力上,Grok 4.7 延长了强化学习阶段,并将训练任务的难度大幅倾斜向需要持续数小时才能完成的复杂工作。这一改变带来了两个核心能力的提升:一是长流程任务的自我管理与持续执行力,降低了模型在面对多步骤长链条任务时中途放弃或逻辑中断的概率;二是增强了自检能力,模型在输出结果、编写代码或整理复杂文档时,能够更主动地对内容进行复核,从而降低幻觉和错误率。官方公布的数据显示,在考察长时间编程能力的 CursorBench 4.0 测试中,Grok 4.7 取得 46.3% 的成绩;在软件工程测试 DeepSWE v1.1 中达到 71%;在电气工程 EEBench 测试中得分 64%;在法律、医疗及办公综合任务等专业领域的基准测试中,也普遍较前代有所增长。

另一个显著的变化是 Grok 4.7 原生对齐了自家 Grok Bot 及 Grok Build 运行框架。这种“模型+私有脚手架”的设计,让模型能够更自然地调用终端、浏览器、文件系统并保持持久状态。然而,这也带来了实际表现的分化:当配合官方提供的特定框架使用时,Grok 4.7 在编程智能体榜单上成绩表现亮眼;但在脱离该框架的统一标准基准(如 Terminal-Bench 4.0)或某些第三方评测中,其通过率则出现明显下滑。这表明新模型的能力大幅依赖于特定交互逻辑与配套工具体系。

Grok 4.7重磅升级:主打长流程编程,核心亮点与实测评估

在价格与调用速率方面,Grok 4.7 沿用了上一代的价格策略,标准版 API 输入每百万 Token 价格为 2 美元,输出为 6 美元,同时提供了速度与价格均翻倍的快速版本(Fast Mode)。官方强调其综合单价远低于市场上部分前沿旗舰模型。不过从开发者实测和综合评测反馈来看,实际使用成本却并非单纯由 Token 单价决定。由于 Grok 4.7 在推理和回答时表现出更为冗长的特点,完成单个任务平均消耗的输出 Token 数量往往远多于前代及部分竞品,这在一定程度上稀释了其单价便宜带来的成本优势。

从实际体验与市场评价来看,Grok 4.7 展现出了“偏科”与“适用场景明确”的特点。在长时间连续运行的代码调试、数据梳理、复杂项目分析以及结合 Blender 等工具生成 3D 脚本的任务中,它展现出了更强的前后一致性与耐心。但在前端UI渲染、SVG矢量图绘制(如经典的“鹈鹕骑自行车”测试)以及某些不依赖框架的短任务表现上,其交出的答卷依然存在生成不精准、出现低级 bug 等翻车情况。此外,在同一时间窗口发布的开源模型如小米 MiMo-V2.6 等,也在综合跑分和极低综合成本上对其形成了强有力的竞争压力。

Grok 4.7重磅升级:主打长流程编程,核心亮点与实测评估

综合而言,Grok 4.7 并不是一款追求全方位绝对碾压的通用 AGI 模型,而是马斯克阵营将其推向“ Agent 智能体工具”的重要尝试。它通过增大模型基座、注入工程数据、强化自检能力与绑定私有开发框架,卡住了高性价比、高速度的长任务编程与办公场景。尽管其存在生成内容过于冗长、高度依赖配套生态等争议,但对于需要在具体框架下进行长链路工程开发与数据处理的团队来说,Grok 4.7 依然提供了一个高效且具有成本竞争力的选择。

内容由AI生成

精选参考来源

1. 🚨预警:Grok 4.7或将于24小时内上线

🚨预警:Grok 4.7或将于24小时内上线 Elon Musk 9月2日亲口预告“Grok 4.7 comes out in 10 days” 10天期限即将到期,9月12日前后上线窗口已到,甚至可

2. xAI发布Grok 4.7:专攻编程与知识工作 价格降至竞品一半

xAI发布Grok 4.7:专攻编程与知识工作 价格降至竞品一半 xAI发布Grok 4.7:专攻编程与知识工作 价格降至竞品一半cnBeta1790024782 马斯克旗下人工智能公司xAI正式发布

3. Grok 4.7上线,全球第三,马斯克:4.8也训完了

Grok 4.7上线,全球第三,马斯克:4.8也训完了 Grok 4.7上线,全球第三,马斯克:4.8也训完了36氪1790060366 就在刚刚,马斯克SpaceXAI正式发布,全新主力模型Grok

4. Grok 4.7 刚刚泄露,看起来非常牛来

Grok 4.7 刚刚泄露,看起来非常牛来 - 可能击败 Fable 5 且成本便宜 10 倍 - 规模提升 40% - 计划达到 2.1T 参数 - xAI 现在正用 SpaceX 数据大量灌入。

5. 马斯克又发模型了|Grok 4.7 今天发布

马斯克又发模型了|Grok 4.7 今天发布 马斯克的 Grok 4.7 今天(9/22)正式发布了。官方定的调子就一句话: "Same price and speed, notably bett

6. #SpaceXAI发布Grok4.7模型#近日,SpaceXAI最新推出Grok 4.7模型,一出场就亮出了很有冲击力的...

#SpaceXAI发布Grok4.7模型#近日,SpaceXAI最新推出Grok 4.7模型,一出场就亮出了很有冲击力的... 近日,SpaceXAI最新推出Grok 4.7模型,一出场就亮出了很有冲

7. 🚨 Grok 4.7 泄露:即将发布

🚨 Grok 4.7 泄露:即将发布 > Grok 4.7 可能击败 Fable 5 且成本便宜 10 倍 > 规模大幅跃升约 40% > 初始训练已完成 > xAI 现正在补充训练中加入大量 Spa

8. 🚨 GROK 4.7 今日发布 > “grok-4.7”短暂出现在 OpenCode Zen 模型列表中 > 它上线...

🚨 GROK 4.7 今日发布 > “grok-4.7”短暂出现在 OpenCode Zen 模型列表中 > 它上线... 🚨 GROK 4.7 今日发布 > “grok-4.7”短暂出现在

9. 马斯克交卷Grok 4.7,这次吹牛吹大了!

马斯克交卷Grok 4.7,这次吹牛吹大了! 官方说参数量提到2.1万亿,长周期知识工作测试1657分,编程智能体指数56分,价格还是每百万输入2美元、输出6美元。看着确实能打。 但问题出在“原生

10. 马斯克预告 Grok 4.7 十天后上线

马斯克预告 Grok 4.7 十天后上线 马斯克预告 Grok 4.7 十天后上线:2.1 万亿参数,号称「超越所有模型」 马斯克预告 Grok 4.7 发布号称超越所有模型 刚刚,马斯克又在 X

11. #SpaceXAI发布Grok4.7模型#马斯克这边又更新大模型了,SpaceXAI推出Grok 4.7,定位是编码、知...

#SpaceXAI发布Grok4.7模型#马斯克这边又更新大模型了,SpaceXAI推出Grok 4.7,定位是编码、知... 对比上一代Grok4.6,它做了不少升级。长上下文能力变强,能扛住耗

12. 如何评价Grok 4.7 ,有哪些亮点?

如何评价Grok 4.7 ,有哪些亮点? 有点抽象,测试的 4.6 纸面分数和隔壁 小米 MIMO V2.6 发布 一样,但是这个效果,还不如 44 分的 Kimi K3····难怪老马在 Gork

13. Grok 4.7 来了,主要升级编程能力、长任务和专业知识工作。#SpaceXAI发布Grok4.7模型#Grok 4....

Grok 4.7 来了,主要升级编程能力、长任务和专业知识工作。#SpaceXAI发布Grok4.7模型#Grok 4.... Grok 4.7 来了,主要升级编程能力、长任务和专业知识工作。Grok

14. Grok4.7 发布!马斯克:编程第三?

Grok4.7 发布!马斯克:编程第三? 马斯克交卷了。吹得响,也给自己留了台阶。 他自己发帖说:Grok 4.7 做「会自己干活写代码」排第三,前面是 Anthropic 和 OpenAI;但又

15. 实测马斯克的最新Grok 4.7:只能说拉完了

实测马斯克的最新Grok 4.7:只能说拉完了 Grok 4.7发布了。 xAI说,这是他们目前最强的编程模型。和4.6比,价格和速度没变;和同级模型比,还能做到两倍速度、只要一半价格。 看完

16. 刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望

刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望 刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望机器之心Pro1790042597 机器之心编辑部今天一早

17. 不负众望,grok4.7 接近 fable5.1 水平!

不负众望,grok4.7 接近 fable5.1 水平! 这次升级的重点很明确:Coding + 长时间 Agent 任务 + 专业知识工作。 相比 Grok 4.6,4.7 换上了一个全新、更大

18. Grok 4.7 测评报告!真的能打吗?

Grok 4.7 测评报告!真的能打吗? 测评 Pi 拉满 xhigh 思考档位实测 Grok4.7,句子生成全部满足结尾数字要求,仅一句书面表达别扭;鹈鹕骑车 SVG 存在画面衔接、车轮、土星环绘制

19. 三模型实测! Grok 4.7 vs MiMo V2.6

三模型实测! Grok 4.7 vs MiMo V2.6 三模型实测! Grok 4.7 vs MiMo V2.6 Grok 4.7 没有达到我的预期,MiMo V2.6-Flash 却在部分任务中比

20. Grok 4.6还没捂热,4.7就来了。同一价格同一速度,官方叫notable improvement。重点优化三项:更...

Grok 4.6还没捂热,4.7就来了。同一价格同一速度,官方叫notable improvement。重点优化三项:更... Grok 4.6还没捂热,4.7就来了。同一价格同一速度,官方叫nota

21. 马斯克SpaceXAI发布旗下最强大编码和知识处理模型Grok 4.7

马斯克SpaceXAI发布旗下最强大编码和知识处理模型Grok 4.7 马斯克SpaceXAI发布旗下最强大编码和知识处理模型Grok 4.7IT之家1790032012 IT之家 9 月 22 日消

22. #SpaceXAI发布Grok4.7模型# SpaceXAI正式推出Grok 4.7,这款旗舰模型面向编程与知识工作场景...

#SpaceXAI发布Grok4.7模型# SpaceXAI正式推出Grok 4.7,这款旗舰模型面向编程与知识工作场景... SpaceXAI正式推出Grok 4.7,这款旗舰模型面向编程与知识工

23. 马斯克预告Grok 4.7:参数量增40%,性能表现将超越所有AI竞品

马斯克预告Grok 4.7:参数量增40%,性能表现将超越所有AI竞品 马斯克预告Grok 4.7:参数量增40%,性能表现将超越所有AI竞品IT之家1788328177 IT之家 9 月 2 日消息

24. SpaceXAI 今天正式发布 Grok 4.7,价格和速度和上一代 4.6 完全一样。这个模型跳票了好几次。马斯克 9...

SpaceXAI 今天正式发布 Grok 4.7,价格和速度和上一代 4.6 完全一样。这个模型跳票了好几次。马斯克 9... SpaceXAI 今天正式发布 Grok 4.7,价格和速度和上一代 4

25. #SpaceXAI发布Grok4.7模型#Grok 4.7这波,重点不是“更强”,而是“两倍速、一半价”。模型发布看麻了...

#SpaceXAI发布Grok4.7模型#Grok 4.7这波,重点不是“更强”,而是“两倍速、一半价”。模型发布看麻了... Grok 4.7这波,重点不是“更强”,而是“两倍速、一半价”。模型发布

26. #SpaceXAI发布Grok4.7模型# 不太行,凌晨发布后,风头接着被稍后发布的小米MiMo模型抢走了。。跑分两者...

#SpaceXAI发布Grok4.7模型# 不太行,凌晨发布后,风头接着被稍后发布的小米MiMo模型抢走了。。跑分两者... 不太行,凌晨发布后,风头接着被稍后发布的小米MiMo模型抢走了。。跑

27. 看技术细节,Grok 4.7 最核心的改动其实是它的“心理活动”——能长时间死磕难题,还能自己检查工作。以前的 AI 就...

看技术细节,Grok 4.7 最核心的改动其实是它的“心理活动”——能长时间死磕难题,还能自己检查工作。以前的 AI 就... 看技术细节,Grok 4.7 最核心的改动其实是它的“心理活动”——能长

28. 炸了!Grok4.7发布,马斯克:已跻身前三

炸了!Grok4.7发布,马斯克:已跻身前三 【Grok 4.7来了,这次进步有点猛】 SpaceXAI正式发布 Grok 4.7,主攻编程、Agent和知识工作。 几个值得关注的数据: 🚀 Ar

29. #SpaceXAI发布Grok4.7模型#关注AI编码和知识处理的朋友,可以留意SpaceXAI刚发布的Grok 4.7...

#SpaceXAI发布Grok4.7模型#关注AI编码和知识处理的朋友,可以留意SpaceXAI刚发布的Grok 4.7... 关注AI编码和知识处理的朋友,可以留意SpaceXAI刚发布的Grok

30. 马斯克放大招,新模型Grok 4.7上线!

马斯克放大招,新模型Grok 4.7上线! 马斯克放大招,新模型Grok 4.7上线!人人都是产品经理1790042365 SpaceXAI 刚刚发布 Grok 4.7——用于编码和知识工作的最强大模

31. Grok 4.7要来了!这次真的有点猛!

Grok 4.7要来了!这次真的有点猛! Grok 4.7 的消息来了🔥据爆料,新版本可能会在未来几周发布,参数规模或达到 2.1 万亿,初始训练据称已经完成,目前还在补充训练阶段。 更值得关注的

32. Grok 4.7疑似将再次延期!

Grok 4.7疑似将再次延期! 爆料!Grok 4.7疑似将再次延期!目前性能难以对标Opus 5.0! 看图说话:左 Grok 4.7,右 Opus 5.0。 同一道设计手柄题,一边画出了

33. SpaceXAI 发布 Grok 4.5,和 Cursor 一起联合开发的 AI 模型有什么特别的?

SpaceXAI 发布 Grok 4.5,和 Cursor 一起联合开发的 AI 模型有什么特别的? 短的结论:大鹏一日同风起 基本情况: 对于拥有巨额算力与人才储备的北美团队而言,从相对落后位置发

34. Grok 4.7和Opus 5对比测试

Grok 4.7和Opus 5对比测试 Grok 4.7和Opus 5对比测试 搬运一个X平台上的测试。AI/ML API用three.js生成4个太空场景,Grok 4.7和Claude Opus

35. 马斯克自曝 Grok 4.7 延迟:AI“太早放弃”了

马斯克自曝 Grok 4.7 延迟:AI“太早放弃”了 马斯克发推文称:Grok 4.7 还需要几天时间再“酝酿”。 简单说,问题可能出在 RL(强化学习)阶段:训练时对“回答太长”的惩罚设得太重

36. Grok-4.7 准确的 benchmark 对比表

Grok-4.7 准确的 benchmark 对比表 价格和 4.6 一样,还是 $2 / $6。 图 2️⃣ 鹈鹕长这样🥲 图 3️⃣ 官方表上,4.7 在长程 agent / 终端 / 工程跳得最

37. #SpaceXAI发布Grok4.7模型#SpaceXAI推出Grok4.7,AA榜单46分,重点强化长任务Agent与...

#SpaceXAI发布Grok4.7模型#SpaceXAI推出Grok4.7,AA榜单46分,重点强化长任务Agent与... SpaceXAI推出Grok4.7,AA榜单46分,重点强化长任务Age

38. Grok 4.7感觉不太妙啊……

Grok 4.7感觉不太妙啊…… 哎,老马啊老马🐴 怎么感觉从「延期」开始到给「4.8画饼」再到和「opus5对标」,给我的预感是grok 4.7的训练不太妙呀[皱眉R] 这画饼都画到grok

39. 罗福莉和马斯克同日正面交锋:相同跑分,成本却差 29 倍

罗福莉和马斯克同日正面交锋:相同跑分,成本却差 29 倍 罗福莉和马斯克同日正面交锋:相同跑分,成本却差 29 倍Tech星球1790078192 来源 | Tech星球文 | 华卫今早,小米和Sp
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章