实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

2026-07-23 14:16:23 0点赞 0收藏 0评论

Kimi K3的发布引起了海内外网友的高度关注,2.8T的万亿大参数模型,直接在某些测试项目上,把国外闭源模型给击败了。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

紧跟在Kimi K3之后,定位千问新一代旗舰基座模型的预览版Qwen3.8-Max-Preview也正式发布,开放给所有用户使用,接替5月发布的Qwen3.7-Max。两个月的时间,Qwen3.8-Max的参数量从3.7时代的「超万亿的千问模型」到现在的2.4T,千问团队表示Qwen3.8-Max是目前最强大的模型之一,兼容领先的前沿AI模型,仅次于Fable 5。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

虽然正式版还没上,Qwen3.8-Max-Preview在X上的热度也并不比Kimi K3要低,将近600万次的浏览,但网友们讨论的内容都集中在「能聊 ≠ 能用,承诺 ≠ 交付」。大家都在等正式版/满血版的Qwen3.8-Max,以及模型的benchmark表、激活参数量,和Hugging Face上带许可证的真实权重文件。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

对比之前Hy3的预览版和正式版,三个月的时间简直是两个模型。这次Qwen3.8-Max正式版估计不会要等三个月,所以我们还是简单测试了一下Qwen3.8-Max的预览版,看看是不是值得期待。

实测Qwen3.8-Max-Preview,速度很快但效果

几乎所有的大模型公司都开始有自己的「Codex」应用,Qwen用于编程和效率工作场景的应用是Qoder/QoderWork,我们这次使用Qoder来对Qwen3.8-Max-Preview进行测试。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

在Qoder内可以看到Qwen3.8-Max-Preview的定位是最新一代基座模型,深度推理办公的首选,而模型上下文窗口在模型设置中,最多可以拉到1M,即支持百万字上下文。我们先是让它设计一个个人作品集网站首页,这类工作对大模型来说基本上都是「洒洒水」,关键点在于怎么做得高级又好看,有创新点。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

生成过程中,Qoder会弹出问题要我们选择网页的样式和内容,但也可以直接让AI自行决定。最终的生成的网页效果确实不赖,并且还添加了适当的缓入缓出的渐变效果,让网页的阅读体验更高级。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

在Qoder应用内,我们发现它提供了161种风格参考,包括Aribnb、Apple、Figma、GOV.UK等不同网站,我们可以直接应用对应风格,来创作网页。此外,Qoder非常好的一点是,我们可以直接对网页进行修改。通过应用内的「画布」功能,我们可以直接选择网页上的元素,进行排版、颜色、间距、文本内容、视觉编辑,以及描边等参数的修改。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

接着测试「真才实学」的代码能力,自从Fable 5出来之后,有网友用它制作各式各样的3D网页,模拟真实的地理环境,创作不同的游戏场景,3D测试也成了这段时间以来新发布大模型必测的项目之一。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

我们从之前的3D测试提示词项目中随便找了一个,这次是在Qoder,即代码场景下的应用内让它完成,完整的提示词是:创建一款明亮的Three.js屋顶跑酷游戏,场景位于风格化的纽约街谷上方。玩家开局时已经在奔跑,朝着第一个发光的屋顶边缘冲去。不要创建标题画面、菜单、关卡选择、新手引导浮层或按键开始状态。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

核心玩法只有一个:在计时结束前,从一个屋顶边缘跳到另一个屋顶边缘,穿过屋顶检查点,最终抵达终点广告牌。打造一条充满活力但范围集中的天际线路,加入水塔、消防梯、屋顶通风口、广告牌、晾衣绳、远处车流、窗格阵列和清晰的落点标记。加入计时器、检查点计数、重置功能、紧凑的操作提示和近距离第三人称镜头。整体要明亮、有动感、清晰易读,并且打开后即可游玩。

Qoder的整个任务界面也很像Codex,主页面显示当前任务的对话窗口,侧边栏显示项目概要,包括项目进展、产物和文件或Skill的引用,以及终端和文件信息等。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

Qwen3.8-Max-Preview的运行时间非常快,深度思考29s、深度思考1s、深度思考1s,没用几分钟就把这个3D网页给做出来了。游戏确实是能玩的,而且整体的风格和Fable 5也确实类似,但是这是第二版的结果。第一版Qwen3.8-Max-Preview给的网页没有控制好玩家前进的速度,导致游戏体验极差,几乎每次都要掉下去重来。

我们在Qoder Work和网页版内输入同样的提示词,只有Qoder交付的结果是比较乐观的,其他的平台应该是没有针对编程项目做过专门的优化,以及单独的 HTML 文件没有顺利加载Three.js库文件等问题。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

接着我们又让它生成一些3D的艺术世界,在莫奈位于吉维尼的睡莲世界中,打造一个极限Three.js体验:一片辽阔的池塘,同时也是一幅画,整个水面与花园都由漂浮的纯色笔触构成,乘船穿行其中。光是听着就很有难度,这次Qwen3.8-Max-Preview的执行时间也比纽约屋顶跑酷任务更久,但整体上依旧很快,尤其是侧边栏显示的进展,经常是一瞬间就全部Checked完成。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

最后的结果就相当抽象了,完全不知道这个网页是什么。虽然它在结果里写着118,500个独立色彩笔触,有睡莲叶、花朵、日本桥等等元素,但是交付的网页就是一些碎片在旋转。二次修改让它重新检查之后,新的结果依旧是有点一言难尽,但至少是比第一次能明显地看到这个桥的形状了。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

而如果是复刻App,我们也输入「帮我复刻一个flighty的app,给我可以分享的网页预览链接先。」,看看它能否学到 Flighty 精美的交互和动效,以及简洁大方的UI。结果也是相当简陋,而且几乎没有任何功能,只是找了几个航班放在这里展示。甚至授权了Vercel(网页部署平台)给它,但是这个交付的网页很明显是不够格的。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

除了在Qoder内能体验到Qwen3.8-Max-Preview,我们在千问官网也测试了一下模型的深度研究能力。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

最后的结果,基本上和我们用Qwen3.7-Max测试是类似的,从核心摘要到市场格局,以及未来行业发展趋势,都没有太大的差别。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

目前预览版的能力或许无法代表最终Qwen3.8-Max的能力,但国产开源模型进击的势头确实让人招架不住。

国产开源大模型首次超过闭源模型

国外的网友说,现在的开源模型几乎都是来自中国。已经发布的GLM-5.2和Kimi K3,一个是接近Anthropic的Opus水平,一个来到了可以跟Fable 5一桌的等级。而本月还将迎来Qwen3.8-Max、DeepSeek V4正式版、GLM-5.5,以及MiniMax-M3-Pro,几乎都把「对标Fable 5」当成了模型的评价基准。

OpenAI的战略未来主管Dean W. Ball在X上发文,提到Kimi是一个非常优秀的模型,它不认为Kimi的性能可以用蒸馏之类的技术来解释。而在Agent Coding测试里,Kimi K3的表现几乎可以与今年一季度最好的公开模型相媲美。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

今年以来,主要公司的大模型发布情况显示累计有39次模型发布,其中国产模型有21个,而美国的大模型18个。39个大模型中开源模型有17个,其中13个来自国产开源模型,4个美国模型分别是Mira Murati的Thinking Machine Lab最新发布的Inkling模型、英伟达发布的Nemotron 3 Ultra、Google的Gemma 4以及英伟达的Nemotron 3 Super。

或许现在谈要超过Fable 5为时尚早,但是当看到X上的网友一本正经的分析:Mythos Preview是 10T参数模型;GPT-6、Fable 5.1已经完成训练但尚未发布;美国实验室因为安全风险主动压低或隐藏能力;以及国产模型近期的进步有一部分仍然来自蒸馏等判断……

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

这就很让人忍俊不禁,照他们的逻辑,中国模型成绩追上来,可以归因于蒸馏和刷榜;尚未追上的部分,又可以解释成美国把真正的强模型藏起来了;无论出现什么结果,都不会输。

今天的榜单上,Kimi K3可能超过了某个国外模型;明天Qwen3.8-Max可能又在另一个项目里拿到第一;再过几天,DeepSeek、智谱还会继续把新的模型推上来。模型之间的差距,开源和闭源,国产和海外模型,都正在变得越来越短。

实测千问Qwen3.8预览版,兼容性强,国产AI模型开始围攻Fable5

以前想要最强的模型,可能只能选择少数几家海外闭源模型。现在同样的能力开始出现在更多模型、更多产品,以及更多本地部署的方案里。模型能力越接近,我们的选择就越多。最后决定我们能不能用上更强AI的,大概会是这些模型,谁先把价格打下来。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松