阿里云Qwen3.7-Max登顶国产模型,编程能力全球第五

源自61位全网作者

05-26 16:10

内容由AI生成

精选参考来源

1. 「双线实测」Qwen 3.6-Plus,Agentic Coding 已经这么能“扛活儿”了?

2. Qwen3.7-Max效果如何?在哪些方面有提升?

3. Qwen3.6-Plus 太猛了!免费+百万上下文+Agent,多模态能力直接拉满!| 零度解说

4. 太猛了,这次程序员,要被打下来了。阿里刚发布的Qwen3.6-Plus(图一),我第一时间去试了下,得出一个结论:[强]【普通人,也能自己搞系统了】[强]有3个点我觉得非常诱人:(图二)编程能力国产第一,直接对标Claude,国产第一次在“写代码”这件事上,打到全球一线。(图三)价格打到2元/百万tokens,试错成本直线下降。以前做个功能要几十块钱,现在几块钱就能试。(图四)支持100万token的长文了,我让他读了松松云的后台功能,基本一口气能读完。(图五)然后我立马干了件事:在阿里百炼后台用Qwen3.6-Plus重做了公司官网首页,从设计 → 到代码 → 到修改,全程没写一行代码!真的,只要规矩给他定好,Qwen3.6-Plus不到3分钟,页面直接跑出来,这应该是体会过最快的编程模型了。对阿里来说:我感觉他不想只卖API了,估计以后也要搞什么编程工具。随着Qwen3.6-Plus发布,阿里好像已经成了生态闭环了。从大模型、到百炼、到千问APP,开发者一旦用顺手,迁移成本极高。对创业者来说:既然价格这么便宜了,我肯定要把公司的后台系统从3.2升级到8.0了。还有一些老程序、老网站,能升的全都升级一遍。比如就官网首页,全是用Qwen3.6-Plus做的。以前搞个系统升级得求爷爷告奶奶找技术,现在不用了。在这个时代,不怕你会写代码,就怕你只会写代码。如果AI能干完程序员80%的活,你觉得剩下的20%价值在哪里?

5. 【AI前沿】Google IO 与 Qwen 3.7 Max:模型战争没有结束,只是战场变成了 Agent 基础设施

6. 国产编程模型迎来新王?阿里Qwen3.6-Plus让我重新思考AI写代码这件事

7. 阿里今天发了Qwen3.6-Max-Preview,跑分确实挺好看。📮编程上SciCode 47分、SWE-bench Pro 57.3分,已经咬住Claude 4.5 Opus了,部分benchmark还反超。Agent工具调用、知识问答这些可量化的能力,国产模型追赶速度真的快——一个月前大家还说差距半年,现在再说已经是几周。(Claude 最新是 4.7 Opus📮但我自己用下来最在意的那个维度——语言能力,跑分图上看不出来。我写文案、改稿子、做创意性表达这些场景,Qwen系列的输出跟Claude比还是有差距。不是错字不是语病,是那种说不出哪里不对但读起来就是没那味儿的感觉——比喻生硬、节奏一板一眼、该留白的地方填满了、该收束的地方又散掉了。这种「味儿」,不会在任何一张benchmark表格里出现。📮文科生的分数其实比理科生难评价多了。数学98分和93分,98确实就是比93强,这个差别是客观的。但文学创作不一样。有时候98分的作文反而读起来不如93分的,因为那5分可能是在「规范性」上加的,而减掉的是「个性」。现在AI的跑分体系,本质上在奖励前者——可检测、可复现、可量化。所以当一个模型在跑分上全面超越对手,但你读它写的东西总觉得少点什么——这不一定是你的错觉。📮还有一个角度是应用层。我最近在用的是智谱GLM 5.1,跑分上也挺猛,编程能力已经跟Claude一个档。但我用下来最大的问题是会话长度——聊着聊着就得开新窗口,Claude里一个项目能滚十几天不断,GLM里一两天就顶到头了。这不一定是模型架构的问题,更像是产品工程层面的取舍——上下文窗口、长会话稳定性、工具调用时的记忆保持,这些不是benchmark分数能解决的。国产模型在「底座」上已经追得很近,但在「产品打磨」这一层,跟Claude、ChatGPT这种迭代三四年的老产品比,还有6到12个月的差距。📮所以我的判断是——理科生的分数我信了,文科生的分数我再观望,工程师的活还没做完。Qwen3.6-Max正式版和GLM下一代出来再试试。现在这个阶段,跑分看着热闹,但你真的把它放进日常工作流里用一个月🌚还得是 Gemini 和 Claude 香

8. 谁才是最强王者?ChatGPT5.5、Claude 4.7、Deepseek V4、Qwen 3.6 编程实测见真章!| 零度解说

9. 【Qwen3.7-Max登场,智能体时代核心基座模型来了】快速阅读:Qwen3.7-Max 正式发布,旨在成为智能体时代的基座模型。它在编程、通用智能体及高难度推理任务上表现出色,甚至在长达 35 小时的自主内核优化实验中,实现了 10 倍的性能提升。Qwen3.7-Max 来了。它不再只是个聊天窗口,更像是一个能接手复杂工程的数字员工。在编程智能体测试中,它在 SWE-Pro 等多个维度拿到了领先分数,甚至能像资深工程师一样处理多文件工程。有意思的是它在“长程任务”上的表现。很多人担心模型跑久了会“断片”或者逻辑漂移,但它在长达 35 小时的自主内核优化实验里,通过上千次工具调用,硬是把一个从未见过的硬件平台算子优化了 10 倍。这种在未知环境里的泛化能力,大概是它最硬核的地方。有网友提到,现在的模型如果只会“一本正经胡说八道”那是没用的,能说“我不知道”才叫靠谱。Qwen3.7-Max 在设计上更强调这种稳定性,通过强化学习监控奖励作弊,确保它在长周期任务中不会为了完成任务而“投机取巧”。不过,这种能力也带来了一个现实问题:随着模型越来越像“人”,它对算力的胃口也越来越大。对于想要在本地跑起这种级别的智能体的开发者来说,内存和带宽可能很快会成为新的瓶颈。它现在通过阿里云百炼提供 API,支持保留思维链,这对于构建复杂的智能体工作流非常关键。qwen.ai/blog?id=qwen3.7

10. 国产AI新王登基!Qwen3.6-Max-Preview亮相

11. 刚在大会上阿里云发布了Qwen3.7了,还是Max版本。我现在用的还是3.6 plus呢,Max版没舍得用[抠鼻]据说这次3.7是国内最强模型,推理速度提升了10倍,这次升级性能和gpt、claude、gemini差不多了。#阿里云#千问 杭州·浙江西子宾馆

12. 阿里云通云哥炸场:Qwen3.7登顶国产第一,35小时AI自主编程提速10倍

13. 阿里千问3.7-Max让AI给国产芯片自己写驱动,跑出10倍提速

14. Qwen3.7-Max 炸场:56.6分杀入全球前五,编程/推理/智能体三项碾压 Claude,阿里悄悄投下一颗核弹

15. 阿里发布新一代千问旗舰模型Qwen3.7-Max 登顶最佳国产模型

16. 千问 3.7:一个 AI 连续自主编程 35 小时之后

17. 国产第一全球第五,阿里千问发布Qwen3.7-Max,编程推理智能体全面领先竞品

18. 阿里Qwen 3.7 Max登顶全球编程大模型榜单

19. Qwen3.7-Max,我觉得应该叫Ultra,很强

20. Qwen3.7-Max 发布:国产大模型开始进入“长程 Agent”主战场

21. 千问3.7不声不响干了件大事

22. 与 Claude4.7 掰手腕!阿里旗舰大模型 Qwen3.7-Max 来了,7个实测,很丝滑

23. 硬刚GPT5.5、Claude4.6!千问3.7-Max,国产AI代理能力弯道超车

24. 智能体编程新突破!千问3.7旗舰模型全新亮相

25. 阿里新模型 - Qwen3.7:面向智能体时代的新一代旗舰大模型

26. Qwen3.7-Max和Claude我各测了10小时,这个差距让我意外

27. 阿里发布千问旗舰模型Qwen3.7-Max

28. 国产AI迎重磅突破,千问3.7Max上线,35小时自主攻坚硬核技术任务

29. 35小时智能体自主进化!千问旗舰模型Qwen3.7-Max发布

30. Artificial Analysis放榜:千问3.7问鼎国产模型冠军,全球前五

31. 推理提速10倍编程反超Claude 3 Opus:阿里千问3.7模型评测

32. Qwen3.7-Max正式上线:Agent能力登顶国产第一

33. 千问正式接入Qwen3.7-Max 免费开放体验

34. 千问3.7登顶国产第一 自主优化芯片性能提10倍

35. 阿里刚刚发布了一个国产AI,拿了国产第一,我让TA干了35小时的活

36. 阿里千问3.7:位列权威大模型榜单全球第五、国产第一

37. 阿里Qwen3.7-Max实测

38. 阿里Qwen3.7-Max模型发布,在盲测总榜中,位列国产模型第一!

39. 阿里千问发布Qwen3.7-Max:35小时自主编程,Arena国产第一

40. 阿里通义大模型负责人周靖人:Qwen3.7核心能力突破,解锁实用新场景

41. Arena AI 排名第13 Qwen3.7 离顶尖还差什么?

42. 阿里Qwen3.7 Max Preview全球排名第13位,数学推理第7代码生成第10,中文能力统治级优势

43. 通义千问Qwen3.7杀进全球前十五 国产大模型再创新高

44. 通义千问Qwen3.7有多强?Arena全球第13!preserve_thinking让AI Agent不再失忆

45. Qwen3.7 编程实测!打得过Gemini 3.5吗?

46. Qwen3.7 Max实测!256K上下文+智能体碾压级表现,手撕阿里千问大模型核心能力

47. Qwen3.7-Max零代码帮我写了个LLM手撕APP

48. Qwen3.7-Max发布:35小时不睡觉干活,这模型有点东西

49. 阿里发布新一代千问旗舰模型Qwen3.7-Max

50. 国产大模型杀疯了!通义千问 Qwen3.7 预览版上线!数学/编程杀入全球前10

51. 千问接入全新一代大模型Qwen3.7-Max

52. 千问3.7:智能体时代的编码利器

53. Qwen3.7 Preview 这波有点猛

54. 阿里千问大模型Qwen3.7-Max-Preview登陆Arena AI,多项能力跻身全球前列

55. 阿里Qwen3.7新模型发布:编程、工具调用能力全面领先,国内第一

56. 阿里千问登顶国产第一,AI编程进入35小时自主时代

57. Qwen3.7 Max实测!256K上下文+智能体真能打?DeepSeek学长手撕阿里千问大模型

58. 就在今天!Qwen3.7出现了:ArenaAI 排第13

59. 【历史性时刻】阿里王炸qwen3.7,国产第一模型诞生,,推理超越 Claude-Opus4.6!

60. Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview 首发亮相

61. Qwen3.7-Max-Preview 首发亮相 Arena AI

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章