智谱GLM-5.3编程性能提升50%超Opus4.8

源自258位全网作者

15:01

内容由AI生成

精选参考来源

1. 刚刚,DeepSeek Harness震撼开源:一切皆插件

2. 一份网传的报告透露了deepseek v4pro性能水平,说编程能力仅落后claude旗舰0.3%。这个claude旗舰应该就是fable5,要知道这是目前很多程序员吃饭的东西,而v4pro的目标价格是它的十分之一到百分之一。

3. #DeepSeekHarness发布#这次DeepSeek Harness的上线,标志品牌不再只专注大模型研发,正式布局智能体工程基础设施。产品采用“一切皆插件”设计思路,内测阶段开发者就产出数百款自定义插件,支持多Agent协同编排、联网检索、自定义Skill拓展,适配编程开发、项目管理等复杂长周期任务,本地工作台模式兼顾隐私与灵活拓展能力,对比同类Codex类产品拥有更强自定义空间。

4. 小扎拼了,刚遭 1.4 万亿索赔,连夜开源 AI 小钢炮刷好感

5. 我们用 Qwen 3.8-Max 做了一个 AI 大模型宇宙:效果竟然胜过 GPT5.6?

6. 2026年7月中文大模型基准测评结果发布!Qwen3.8、Kimi-K3并列第一,DeepSeek轻量版并列第二

7. 「Github一周热点126期」MiniMax全模态视频模型、PDF解析、团队Agent记忆、低显存跑大模型、逆向工程Skill

8. #DeepSeek发布V4Pro正式版#这次V4Pro正式版升级真的诚意满满,重点强化Agent智能体能力,原生适配Responses API和Codex,写代码、自动调用工具完成复杂任务表现远超不少开源模型。数学推导、全栈开发、长文档分析全场景无短板,极限推理模式下逻辑严谨度比肩顶级闭源大模型

9. #DeepSeek发布V4Pro正式版# 终于等到了!DeepSeek V4-Pro 正式版来了,给大家划几个硬核看点:· 1.6万亿总参数,激活490亿,支持100万Token超长上下文· Agent编码能力开源模型最强,数学/STEM比肩GPT-5.4、Claude Opus 4.6· 混合注意力架构让长文本推理成本暴降,百万Token场景下计算量仅为前代V3.2的27%· 原生适配华为昇腾等国产算力,训练推理全流程不依赖CUDA更关键的是——Flash正式版已经公测,Pro正式版也官宣“尽快发布”。再加上DeepSeek最近预告API要涨价,业内普遍解读是为Pro正式版上线做准备。国产大模型这波,从参数到生态都在卷出新高度。你会第一时间接入V4-Pro吗?#DeepSeek#

10. 从DeepSeek、Kimi到“黄仁勋联盟”:AI模型开源,到底“开”了什么?【硅谷101】

11. 压力转到智谱。近一个月时间国产模型动作密集,其中K3、Qwen-3.8、V4正式版连发三支重箭。智谱跳过5.3近期直接发布GLM-5.5才可能hold住场面。5.5大概率以小打大,不过估计还是可以守住国产Coding最强模型宝座,与ZCode协同,特色主打自主规划自我修正的Agent长程工作流。但是智谱在应对斩杀线掏底、工作台反切方面的进展可能相对有限,原本一枝独秀的ARR曲线也会受些影响。1GW智算中心、收购中科加禾、推理与算力系统优化等解决卡不足带来的慢且贵问题的措施,效果有时延。体量放大的Hy4也可能提前发布,腾讯的力度是自由现金流转负级别的,字节的力度是投资规模最大且利润暴跌级别的,现在的局面是不仅AI基础设施这一关绕不过去,而且接下来的竞争是谁卡多谁云大谁全栈谁占优。火力的背后是资金,小虎与大厂赛跑的尽头也是资金,如果不能持续来几波融资上市潮会撑不开场面,所以托举还需要继续......现在能拖国模后腿的主要就是算力了,适合今年以来2T以上多模态长上下文大模型(主流)高效训练各项需要的,是可能最快明年下半年才会上市的xxx,能满足明年几T需要的是什么?

12. MiniMax开源一周,视频模型正在重演DeepSeek的故事

13. 【#中美大模型价差正在收窄#】#DeepSeekV4Pro与Grok4.6对比#8月12日,DeepSeek与马斯克旗下SpaceXAI同日发布新模型DeepSeek-V4-Pro和Grok 4.6,新一轮大模型竞争再次升温。从最新评测来看,两款模型均进一步逼近全球头部水平。其中,DeepSeek-V4-Pro在多项智能体相关测试中超过Anthropic的Claude Opus 4.8;Grok 4.6则在Artificial Analysis智能指数中追平OpenAI旗舰模型GPT-5.6 Sol。能力差距缩小的同时,中美大模型之间悬殊的价格差距也在发生变化。摩根士丹利最新研报显示,中国大模型API平均价格过去一年明显上涨,而美国闭源模型价格近期持续下降,中美大模型价格差距正在收窄。摩根士丹利指出,中国大模型市场的竞争重点正在从“价格战”转向“智力战”。(每经)

14. Together AI的评测结果,@月之暗面Kimi K3在真实法律工作上的能力非常强,在LAB-AA评测上的跑分甚至快到Fable模型的2倍了。这个评测是给模型一批案件/交易相关文件,再给一个类似律所合伙人下达的工作指令,让模型自己阅读资料、分析并最终产出可以交付的法律文件。

15. DeepSeek正式推出其首款Agent产品DeepSeek Harness开发者预览版,并同步在GitHub以MIT协议开源。这不仅是DeepSeek从“模型供应商”向“应用框架层”延伸的标志性动作,更意味着代码智能体(Code Agent)的竞争从单一模型能力比拼,升级为“模型+工程化工作台”的全栈生态角逐 #DeepSeekHarness发布# DeepSeek Harness发布:代码智能体赛道迎来“全栈工作台”范式革命

16. 智谱GLM-5.3即将发布:万亿参数+视觉能力,唐杰称史诗级Plus升级

17. 智谱憋出个大的!GLM-5.3即将发布,万亿参数史诗级升级,国产大模型要洗牌了

18. 从7400亿到万亿:智谱GLM-5.3凭什么让张鹏说史诗级Plus?

19. 智谱AI下一代旗舰模型前瞻解析与竞品全景对比GLM-5.3

20. 行业深度合集|国产大模型最新测评、智谱GLM5.3重磅升级、普通人游戏副业逆袭纪实 - 哔哩哔哩

21. 一、国产大模型重磅升级,GLM-5.3开启万亿参数对决

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章