张大妈

1500万!这可能是中国互联网最贵的一次Ctrl+C和Ctrl+V

源自知乎:卢松松

02-12 08:37

一起高达1500万的判赔案,将大厂间心照不宣的数据搬运问题摆上台面。这不再是简单的版权之争,而是对互联网内容生产成本的重新定价,更预示着AI时代数据资产价值的巨变。

1500万!这可能是中国互联网最贵的一次Ctrl+C和Ctrl+V智能速览

  • 法院判罚字X与3X公司向百度赔偿1500万元。

  • 百度以“防伪水印”等铁证证实对方全盘照搬。

  • 赔偿额按“词条单价×数量”计算,获法院认可。

  • 此案性质为“不正当竞争”,绕过Robots协议是关键。

  • 高质量百科内容已成为训练大模型的珍贵“燃料”。

1500万!这可能是中国互联网最贵的一次Ctrl+C和Ctrl+V精华内容

这次天价索赔案的判决,远不止于一家公司的胜诉,其背后的证据链条、赔偿逻辑以及对行业未来的警示,都值得深入解读。

铁证如山

百度在法庭上展示的证据极具说服力。对方百科不仅大量复制了词条正文,甚至连百度百科特有的内部识别代码、编辑时产生的防伪水印,以及一些无意中录入的错别字都一并“继承”。

更具讽刺意味的是,许多早已失效的政策链接和过时参考资料也被原封不动地抓取。这些细节构成了完整的证据链,清晰地指向一个结论:对方内容并非人工编辑,而是机器大规模、无差别爬取的产物,几乎无人审核。

天价算法

此案最大的突破在于赔偿额的计算方式。以往类似案件判赔额常在数十万级别,但百度这次采用了“成本法”:将单个词条从创建、编辑、审核到服务器维护的人力与技术成本进行核算,再乘以被抓取的词条总数,最终得出1500万元的索赔额。

法院支持了这一思路,明确认定百科词条背后凝聚着长期且真实的编辑成本。这标志着法律层面开始正视并量化互联网内容生产的真实投入,而非简单地将其视为“用户生成内容”而忽略其商业价值。

AI命门

百度此次下重手,深层原因是AI时代的战略布局。高质量、结构化的百科数据是训练大语言模型最理想的“养料”之一。当字节的豆包、360的AI都在争抢这类数据时,百度百科的价值已从支撑搜索业务,转向成就自家的文心一言。

对于百度而言,放任对手抓取数据,不仅是用户流失,更是动摇未来AI根基的致命行为。因此,这场官司不仅是维护过去的资产,更是为未来的AI战争划定数据资产的红线。

这1500万的判罚,无疑为互联网内容创作者注入了强心剂,也让“数据资产”的概念变得前所未有的清晰。当AI成为新的焦点,数据的所有权和使用边界将如何被重新定义?这或许是整个行业都需要思考的下一个问题。

1500万!这可能是中国互联网最贵的一次Ctrl+C和Ctrl+V关键评论

  • 有网友算了一笔账,认为搬运内容为抖音带来的流量收益远超1500万赔偿金。

  • 有评论犀利地指出,这看似买卖,实则更接近于“强买”行为。

  • 部分网友认为,尽管百度自身存在争议,但这次被搬运确实“欺负人”。

内容由AI生成
1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章