张大妈

还好意思说别人蒸馏?马斯克抨击Anthropic大规模盗用训练数据

源自今日头条:IT之家

02-25 22:06

AI 公司 Anthropic 指控中国企业通过大规模交互“蒸馏”其 Claude 模型,但此举却引发了行业对其自身“原罪”的讨论。这一事件揭示了 AI 发展中数据来源的复杂伦理困境,以及巨头之间在竞争策略上的互相攻讦,为观察当前 AI 战局提供了新的视角。

还好意思说别人蒸馏?马斯克抨击Anthropic大规模盗用训练数据智能速览

  • Anthropic 指控三家中国 AI 公司利用超 1600 万次交互来“蒸馏”其 Claude 模型。

  • 批评者指出 Anthropic 的双重标准,其自身也曾未经许可使用受版权保护的材料进行训练。

  • 埃隆·马斯克对此事发表讽刺评论,称 Anthropic 的数据是“从人类程序员那里偷来的”。

  • 马斯克承认 Grok 的训练数据也非原创,但批评 Anthropic 在此问题上“极度自鸣得意和虚伪”。

  • Anthropic 呼吁采取更严厉措施,包括加强美国高端芯片对华的出口管制。

还好意思说别人蒸馏?马斯克抨击Anthropic大规模盗用训练数据精华内容

AI 领域的数据争夺战日趋激烈,但当一方指责另一方“偷窃”时,往往需要审视自身的行为。这场风波的核心,并非简单的技术抄袭,而是关于行业规则、伦理底线与竞争策略的复杂博弈。

指控与规模

Anthropic 指控 DeepSeek、月之暗面和 MiniMax 这三家中国 AI 公司实施了“工业级别的蒸馏攻击”。

据称,这些公司创建了超过 2.4 万个虚假账户,与 Claude 产生了超过 1600 万次交互,目的是提取模型的内部推理逻辑,用以训练和优化自家的 AI 模型。

Anthropic 通过分析请求元数据,声称已将行为追溯至相关公司的员工,并警告这类威胁正在升级,需要全球协同应对。

双重标准争议

然而,Anthropic 的指控并未获得普遍同情,反而引发了关于其自身行为的广泛批评。

程序员 Gergely Orosz 指出,Anthropic 此前曾未经许可使用大量受版权保护的书籍训练 Claude 模型,直到被起诉后才向版权方付费,因此不能“两头占便宜”。

这一观点揭示了 AI 行业普遍存在的灰色地带:巨头们在训练模型时大量“借用”互联网数据,却在面对竞争时高举知识产权大旗。

马斯克的介入

埃隆·马斯克以极具讽刺意味的方式介入了这场争论。

他发推文称:“他们(中国)怎么敢偷 Anthropic 从人类程序员那里偷来的东西?”,并直言 Anthropic 犯有大规模窃取训练数据的罪行,已支付数十亿美元和解金。

当有网友指出其 Grok 模型的训练数据同样存在问题,马斯克回应称:“是啊,但我们不会像 Anthropic 那样表现得极度自鸣得意、伪善又虚伪。”

后续应对策略

面对指控和争议,Anthropic 计划采取更严厉的防御措施。

除了切断被指控公司的访问权限外,该公司还公开呼吁美国政府加强高端芯片的出口管制,以防止其技术流向中国。

这一举措表明,技术竞争已迅速演变为地缘政治博弈,企业间的商业纠纷正在被提升到国家层面的技术封锁层面。

这场风波不仅是一场商业纠纷,更是 AI 时代数据伦理和竞争规则的缩影。当“原罪”成为普遍现象,指责与反指责便充满了戏剧性。未来,AI 的发展将走向更透明的合作,还是更激烈的技术封锁?这场争论或许只是个开始。

还好意思说别人蒸馏?马斯克抨击Anthropic大规模盗用训练数据关键评论

  • 马斯克承认 Grok 训练数据也来源可疑,但批评 Anthropic 在此问题上更加虚伪和自鸣得意。

  • 有观点认为,Anthropic 的高调指责,背后是对中国 AI 发展速度的焦虑和警惕。

  • 网友指出关键区别在于 Anthropic 抄袭后因诉讼支付了和解金,而此次事件涉及的是付费服务的再利用。

  • 也有评论认为,AI 模型间的相互学习和训练是行业常态,不必大惊小怪。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章