OpenAI 指 DeepSeek 通过对美模型进行“蒸馏”来训练 AI,内部备忘录披露

源自今日头条:钛媒体APP

02-15 11:19

OpenAI 一份内部备忘录将中美 AI 竞争推向新焦点,指控中国公司 DeepSeek 通过“模型蒸馏”技术,低成本复制其先进模型能力。这不仅是一场商业指控,更触及了 AI 发展的核心——技术护城河、成本效益与国家安全,为理解当前全球 AI 格局的激烈博弈提供了关键视角。

OpenAI 指 DeepSeek 通过对美模型进行“蒸馏”来训练 AI,内部备忘录披露智能速览

  • OpenAI 指控 DeepSeek 绕过安全防护,利用“蒸馏”技术从其模型中提取智能。

  • 模型蒸馏是一种用先进模型训练小模型的方法,能显著降低研发成本。

  • DeepSeek 以低成本推出高性能模型,其效率优势现被质疑源于未授权使用美国技术。

  • OpenAI 认为此举构成国家安全风险,可能转移敏感领域的先进能力。

  • 该争议对 AI 公司依赖数据和算力的传统“护城河”构成根本性挑战。

OpenAI 指 DeepSeek 通过对美模型进行“蒸馏”来训练 AI,内部备忘录披露精华内容

这场围绕“蒸馏”技术的争议,不仅关乎两家公司的商业竞争,更深层次地揭示了人工智能领域正面临的结构性挑战:技术领先优势的保护、创新成本的控制以及全球科技博弈的未来走向。

指控核心:模型蒸馏

根据 OpenAI 提交给美国国会众议院中国问题特别委员会的备忘录,DeepSeek 被指利用“模型蒸馏”技术,通过向 GPT-4o 等先进模型提问,并利用其高质量的输出结果来训练自身的 R1 模型。

备忘录称,DeepSeek 员工相关的账户使用了复杂的手段来掩盖数据提取行为,包括通过第三方路由器和程序化工具。

这种做法能让竞争对手以远低于原始研发的成本,有效复制复杂模型的逻辑和知识,从而对原创者的投资构成直接威胁。

商业冲击与成本优势

DeepSeek 此前凭借以明显低于美国同行的计算预算推出高性能模型 V3 和 R1 而获得国际赞誉,曾一度引发市场对美国公司高成本基础设施模式的可持续性质疑。

然而,OpenAI 的调查结果显示,这种惊人的效率可能是由未授权使用美国知识产权所补贴的。备忘录指出,“非法转售商”和第三方中介在帮助中国公司规避地理限制中扮演了关键角色,预示着美国下一阶段的政策可能将针对 AI 访问的全球供应链进行管控。

国家安全与政策走向

OpenAI 在备忘录中将此事定性为国家安全风险,认为蒸馏过程可能在绕过原始系统的严格安全过滤和对齐协议的情况下,转移生物学和化学等敏感领域的先进能力。

众议院特别委员会主席约翰·穆伦纳尔将此描述为长期技术窃取模式的延续,暗示立法者可能很快引入更严格的外国实体 API 访问和数据外流监管。这一冲突预计将加速“水印”技术发展和对 API 流量的更严密监控,推动 AI 生态系统走向更加封闭。

OpenAI 与 DeepSeek 的纷争,已超越单一商业事件,成为全球 AI 竞争范式转变的缩影。它迫使行业重新思考技术壁垒的本质与创新激励的未来。当模型的输出能复制其智能时,算力和数据的护城河还剩多少?这场争论或将深刻重塑未来十年的科技版图。

OpenAI 指 DeepSeek 通过对美模型进行“蒸馏”来训练 AI,内部备忘录披露关键评论

  • 有评论用“60分学渣抄95分学霸”的比喻,来形容这场技术争议中的指控。

  • 部分网友指出,OpenAI自身也面临数据版权争议,认为其对DeepSeek的指责有双重标准之嫌。

  • 有观点反问,如果蒸馏技术真如此有效,为何拥有海量算力的美国巨头没有率先做到?

  • 也有声音认为,这是技术追赶的常见路径,从模仿学习到自主创新是发展的必然阶段。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章