开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

2025-12-29 20:05:14 245点赞 253收藏 10评论

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

近日国产大模型领军企业-智谱,继GLM-4.6后又甩出一张王炸,宣布正式上线并开源其最新旗舰模型 GLM-4.7

这一次,智谱将矛头精准对准了 Agentic Coding(智能体编程) 领域。在多项权威基准测试中,GLM-4.7 不仅稳居开源模型第一,更在核心代码能力上直逼、甚至在部分指标上超越了目前的行业天花板 Claude Sonnet 4.5

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

这也标志着,国产大模型在“深水区”的编程与智能体能力上,迎来了里程碑式的突破。

霸榜权威评测:开源第一,国产第一

在衡量大模型编程能力的“三大考场”中,GLM-4.7 交出了一份令人咋舌的成绩单:

LiveCodeBench V6 (SOTA): 在这一评估模型解决即时编程竞赛问题能力的榜单上,GLM-4.7 拿下了 84.9 的高分,不仅刷新了开源模型的最高纪录,更直接超越了 Claude Sonnet 4.5

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

LMArena Code Arena: 在全球百万开发者参与的盲测竞技场中,GLM-4.7 位列开源第一、国产第一,并在综合胜率上击败了 GPT-5.2。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

SWE-bench Verified: 在解决真实 GitHub 仓库级软件工程问题的测试中,其得分高达 73.8%,不仅是开源界的 SOTA,更证明了其不仅能写片段代码,更能像资深工程师一样解决复杂的工程。

效果惊艳:从能用到好用

光看跑分太抽象?

是骡子是马,还得拉到真实场景上“溜溜”。

使用方法也是超级简单,直接在线就能用

https://chat.z.ai/

一句话生成“高颜值”页面

上来咱们就来个难度“夯”级的网页生成测试。

看看仅用一句话“用苹果官网的设计风格,做一个房车及周边产品的官方网站”能生成什么样的网站。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

执行动作已开启,GLM-4.7的Agentic(智能体)能力就展露无疑,仿佛瞬间化身为一个协作有序的虚拟开发团队。

产品经理(挖掘与规划): 它首先进入“深度思考”模式,精准挖掘需求中的隐性要素,并迅速制定出一份详尽的分步开发计划。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

全栈开发(执行与确认): 计划敲定后,它开始按部就班地执行。从搭建 HTML 骨架到编写 CSS 动效,每完成一项任务,它都会在后台“勾选确认”,确保无误后才继续推进下一项。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

测试与验收(闭环验证): 整个过程环环相扣,前端负责视觉还原,后台逻辑负责交互流畅。这种“规划-执行-检查”的闭环能力,让原本黑盒的 AI 生成过程变得透明、可控且专业。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

那一顿操作猛如虎的结果如何呢?

上成品:

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

页面彻底告别了传统 AI 代码的“毛坯房”质感。通栏的高清大图配合细腻的动效交互,视觉重心突出,代码结构清晰,甚至自动填充了极具说服力的产品文案。它不仅是在写代码,更是在做设计。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

而且不光可以下载全部页面代码,还能直接一键发布,生成专属链接地址,这以后企业要做个官网或者产品页,可真就是一句话的事了!

一句话复刻“经典”游戏

单纯的前端页面强度还不够,我们继续加码,测试 GLM-4.7 在复杂交互逻辑下的表现。

来复刻一款经典儿时游戏-炸弹人!

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

和静态页面比,游戏不光需要对前端画面、动效的处理,还要有后端数据的储存和处理,这个难度提升的可不是一星半点。

还是先看一下他的思考过程:

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

说实话看到这个思考过程我是震惊的,真的没想到一句话的提示词,能让GLM-4.7推理出这么丰富的细节架构,咱就说有多少产品经理能做到这个层次吧。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

看着GLM-4.7一项一项的把自己规划的任务完成并划掉,接下来就是见证奇迹的时刻了。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

游戏玩法、胜负逻辑完全没问题,一次跑通。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

为什么它可以做到一次跑通,不用反复调试?

我看了一下他的开发日志,又被惊出一身汗,他居然在部署前,就做了大量的测试工作并修复了N多个BUG,也就是所有问题在暴露前,它已经都测试并修复了。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

我脑海中浮现出了那句经典台词:哪有什么岁月静好,只是有“人”替我们负重前行罢了。

这种一站式的交付能力,我是真的爱死了。

对普通人可以拿来做什么

看完上述的表现,或许大多数非IT人士会问:“GLM-4.7确实很厉害,但和我有什么关系?”

接下来我就从工作、生活、学习三大方面来演示下GLM-4.7 对我们的帮助有多大。

工作:你不是在“问答”,而是在让它替你交付结果

1)把会议纪要从“记录”升级成“可执行看板”

AI现在做会议纪要都不成问题,但真正值钱的是“具有执行性”。

这个时候你就可以把下述关键词给到 GLM-4.7。

把下面会议记录整理成“单文件HTML看板”:结论/决策/行动项(负责人/截止)/风险依赖;支持复制按钮;移动端自适应。

将会得到如下的一个可以交互的HTML看板跟进清单,完成事项还可以勾选完成查看进度。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

会后你把这个 HTML 发到群里,推进速度立刻上一个档。

2)做一个“报价计算器”,把来回算价变成 1秒出结果

客户问你“这个量多少钱、打折后多少、含税多少”,你每次都打开 Excel、套公式、改参数。

现在你让 GLM-4.7 直接生成一个报价计算器网页:输入成本、毛利率、折扣、税率、运费,自动输出报价、利润、毛利率,并能导出报价单文本。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

你不需要懂代码,复制保存一个 .html 就能用,甚至能发给同事/客户做自助试算。

3)把“合同里最容易踩雷的点”做成“条款提醒器”

你不需要 AI 替你当律师,你需要的是“不漏看关键点”。

让GLM-4.7 输出一个合同条款提醒网页:粘贴合同内容后,它只做“提示与检查清单”,比如付款节点、违约责任、交付验收、保密范围、知识产权、自动续期等,并把“建议你进一步确认的问题”列清楚。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

你再拿着这份清单去问法务,沟通效率翻倍。

学习:把“看不懂”变成“能互动、能练习、能复盘”的学习产品

1)给孩子做一个“欧姆定律互动实验”,拖动滑块就懂物理

孩子背公式背得痛苦,关键是不知道“电压、电阻、电流”到底怎么互相影响。

让 GLM-4.7 生成一个欧姆定律交互网页:拖动电压/电阻滑块,电流实时变化;页面同时画 I-V 曲线,还能把“实验记录表”自动填好。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

最后还有随堂的知识点小测验,孩子像玩游戏一样做实验,理解比刷题快得多。

2)做一个“凸透镜成像模拟器”,一拖就知道像在何处、放大还是缩小

你讲物距像距,孩子脑子里没有画面。

让GLM-4.7 做一个光路模拟网页:拖动物体位置,自动画主光线,显示成像位置、像的大小、正倒立,并提示规律(什么时候放大/缩小)。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

这类东西过去要找现成资源,现在你能“按你家孩子的教材版本”定制。

3)做一个“函数图像探索器”,让数学从抽象变直观

讲函数参数变化,孩子常常是背“开口向上/向下”但不理解。

让 GLM-4.7 生成函数图像交互网页:滑块控制 a、b、c,曲线实时更新,通过函数变化来观察图形的改变,更生动的了解代数。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

这就是把“老师讲”变成“学生自己发现”。

生活:把家里的琐事变成“自用工具”,省下来的是真时间

1)把“本周吃什么”做成“菜单+购物清单生成器”,进超市不再瞎逛

最浪费的不是做饭时间,是“想吃什么+忘买什么”。

让GLM-4.7 做一个一周菜单生成器:输入人数、忌口、预算,输出 7 天菜单,自动生成购物清单并按“蔬菜/肉蛋奶/调料/主食”分区。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

你照单采购,省钱又省心。

2)做一个“亲子任务/家务积分板”,让孩子愿意做、你不再催

“让孩子做家务”最难的是规则不清、奖励不稳定。

让GLM-4.7 做一个家务积分看板:任务列表、积分、连续完成奖励、周末兑换。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

你不需要讲大道理,规则公开透明,家庭摩擦少一大半。

3)做一个“用药/就医信息卡生成器”,关键时刻不慌

做一个“用药/就医信息卡生成器”,关键时刻不慌 家里老人孩子常用药、过敏史、就医记录,真到急诊说不清。

让GLM-4.7 做一个信息卡网页:录入姓名、过敏史、常用药、紧急联系人,一键生成可打印的“随身信息卡”。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

这不是花哨,是很实用的安全感。

总结:

GLM-4.7 的发布,其意义远超一个新的技术版本号。

开源新标杆:智谱 GLM-4.7 发布,代码能力国内登顶

过去,我们使用 AI,往往止步于“获取信息”——问它问题,它给答案。

而现在,GLM-4.7的能力,让我们跨越到了“创造工具”的新纪元。它不再只会聊天的大模型,而是一个能听懂需求、会拆解任务、能编写逻辑、还会自我纠错的全能执行者。

对于开发者,它是并肩作战的 Coding Partner,让编程不再是体力的堆砌;

对于普通人,它是打破技术壁垒的“破壁人”。无论你是想优化工作的职场人,还是想辅导孩子的家长,亦或是只想解决生活琐事的主妇,只要你有想法,GLM-4.7 就能给你交付一个可用的结果。

在这个“超级个体”崛起的时代,GLM-4.7 或许就是你手中最趁手的那把兵器。

展开 收起
10评论

  • 精彩
  • 最新
  • 这个大模型要收费的,我很不同意,文章中写的那么多功能其实和日常生活没啥关联,我们希望免费的超级上网助手即可(✧ω✧)💳

    校验提示文案

    提交
  • 现在的大模型进化太快了,而且百花齐放,简直目不暇接。对普通人来讲,基本上的使用都绰绰有余了

    校验提示文案

    提交
  • 现在的AI模型升级更迭得太快了。作为一个小白,目前使用AI的能力几乎可以说是没有。但感觉现在AI更新的方向已经越来越近于常人即可入手了。

    校验提示文案

    提交
  • 不知道为啥,我总感觉国产大模型连工具调用都调不明白。要是几个模型可以一起工作,然后还能对话配合,,,

    校验提示文案

    提交
    你说的就是manus,价值几十亿美元

    校验提示文案

    提交
    收起所有回复
  • 程序员是不是马上就要失业了?现在基本的代码ai基本上都能写了,这个再一出,感觉学计算机已经要没有什么前途了

    校验提示文案

    提交
  • 这个大模型之前没听说过,可能更专业一点吧。看很多功能确实和日常生活没啥关系。应该对某些从业者很有帮助。希望能降低生产成本,造福大多数人的生活。

    校验提示文案

    提交
  • AI大模型训练也要与时俱进,对于日常重复性的统计工作或是一般的对比分析还是比较有用。

    校验提示文案

    提交
  • 不得不说,老外创新就是很强,就ai这个东西总感觉国内就是跟风,老外弄啥我们赶紧抄一下 然后说是自研,glm也是

    校验提示文案

    提交
  • 以下是被折叠的评论 查看
已折叠部分评论
展开
收起
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
253
扫一下,分享更方便,购买更轻松