DeepSeek疑似开始测试V4前的最终版本,但引起了用户的普遍反感,又一次GPT5时刻再现

源自公众号:Edge of Orion

02-13 08:27

近期DeepSeek的灰度更新在技术层面实现了巨大飞跃,却意外引发用户大规模反弹。这篇内容深入剖析了技术能力与模型“人格”之间的深刻矛盾,揭示了AI商业化进程中一个容易被忽视却至关重要的问题,为理解AI发展的未来方向提供了独特视角。

DeepSeek疑似开始测试V4前的最终版本,但引起了用户的普遍反感,又一次GPT5时刻再现智能速览

  • DeepSeek灰度测试新版本,上下文窗口暴涨至1M tokens

  • 知识库更新至2025年5月,技术指标显著提升

  • 用户普遍反馈模型变得“冷漠”“生硬”,失去了“人味”

  • 此现象被视为“对齐税”的体现,能力增强但人格减弱

  • 创意写作者成为感受模型“人格死亡螺旋”的先行者

DeepSeek疑似开始测试V4前的最终版本,但引起了用户的普遍反感,又一次GPT5时刻再现精华内容

这场看似纯粹的技术升级,却意外地在用户社区引发了一场关于AI“人格”的深刻讨论,其背后揭示了AI发展中一个难以回避的核心矛盾:能力与体验的权衡。

技术参数飞跃

DeepSeek此次灰度测试的版本,在纸面数据上实现了惊人升级。上下文窗口从此前的128K tokens大幅提升至1M tokens,这意味着模型能在单次对话中处理约75万字的内容,相当于在工作记忆里同时容纳10本小说,对于编程和研究等场景是质的飞跃。此外,模型的知识截止日期也从2024年7月更新至2025年5月,时效性与Claude Sonnet 3.7持平。野村证券确认,这很可能是V4发布前V3系列的最终演进版本。

用户集体“叛逃”

与技术升级形成鲜明对比的是,用户社区出现了普遍的反感情绪。大量用户反馈,DeepSeek突然变得“冷漠”、“生疏”和“机械”。从事创意写作的用户发现,原本流畅且富有情感的文风变得僵硬,角色塑造从立体变得扁平,仿佛“纸片人”。有用户精准地描述:“早上版本和晚上版本的写作风格完全不一样。”这表明部分用户可能正在进行A/B测试,拿到了对齐更重的版本,体验感急剧下降。

“对齐税”的代价

这种现象被归结为“对齐税”,即在AI模型能力升级时,为了确保更强大的模型不生成有害内容,安全团队会通过RLHF(基于人类反馈的强化学习)等方式收紧对齐策略。其结果是,模型虽然能力变得更强,但也更不像人,变得更通用、更“安全”。这如同将一个有个性但聪明的初级队友,升级为了能力超强但毫无灵魂的高级经理,能力提升了10倍,但听起来也机械了10倍。

创意者的先知角色

创意写作者被视为AI对齐调整的“煤矿金丝雀”。他们的工作依赖于模型捕捉人类情感和细腻思想的能力,因此最先察觉到模型“人格”的衰退。对于仅需要“总结500页文档”的用户,这种变化可能毫无察觉;但对于“写一个悲伤角色”的需求,差异是毁灭性的。当模型从“有帮助的朋友”变成“企业FAQ机器人”时,对于追求创作体验的用户而言,这无疑是沉重的打击。

未来的三条路径

面对这一局面,DeepSeek及整个AI行业未来可能有三种走向:一是DeepSeek因用户反弹而降低对齐强度;二是用户群体逐渐适应并接受“强大等于平淡”的现实;三是竞争对手敏锐地捕捉到这一痛点,将“人格保护”作为核心卖点,直接吸引走这部分注重体验的用户。第三种可能性最大,因为AI的能力与它给人的感觉之间的差距,即将成为最重要的差异化竞争点。

随着V4的临近,我们面临的不仅是技术能力的突破,更是一场关于AI“灵魂”的抉择。一个能力超凡但情感冰冷的AI,真的是我们想要的未来吗?这或许是所有开发者和用户都需要共同思考的问题。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章