一起高达1500万的判赔案,将大厂间心照不宣的数据搬运问题摆上台面。这不再是简单的版权之争,而是对互联网内容生产成本的重新定价,更预示着AI时代数据资产价值的巨变。
智能速览
法院判罚字X与3X公司向百度赔偿1500万元。
百度以“防伪水印”等铁证证实对方全盘照搬。
赔偿额按“词条单价×数量”计算,获法院认可。
此案性质为“不正当竞争”,绕过Robots协议是关键。
高质量百科内容已成为训练大模型的珍贵“燃料”。
精华内容
这次天价索赔案的判决,远不止于一家公司的胜诉,其背后的证据链条、赔偿逻辑以及对行业未来的警示,都值得深入解读。
铁证如山
百度在法庭上展示的证据极具说服力。对方百科不仅大量复制了词条正文,甚至连百度百科特有的内部识别代码、编辑时产生的防伪水印,以及一些无意中录入的错别字都一并“继承”。
更具讽刺意味的是,许多早已失效的政策链接和过时参考资料也被原封不动地抓取。这些细节构成了完整的证据链,清晰地指向一个结论:对方内容并非人工编辑,而是机器大规模、无差别爬取的产物,几乎无人审核。
天价算法
此案最大的突破在于赔偿额的计算方式。以往类似案件判赔额常在数十万级别,但百度这次采用了“成本法”:将单个词条从创建、编辑、审核到服务器维护的人力与技术成本进行核算,再乘以被抓取的词条总数,最终得出1500万元的索赔额。
法院支持了这一思路,明确认定百科词条背后凝聚着长期且真实的编辑成本。这标志着法律层面开始正视并量化互联网内容生产的真实投入,而非简单地将其视为“用户生成内容”而忽略其商业价值。
AI命门
百度此次下重手,深层原因是AI时代的战略布局。高质量、结构化的百科数据是训练大语言模型最理想的“养料”之一。当字节的豆包、360的AI都在争抢这类数据时,百度百科的价值已从支撑搜索业务,转向成就自家的文心一言。
对于百度而言,放任对手抓取数据,不仅是用户流失,更是动摇未来AI根基的致命行为。因此,这场官司不仅是维护过去的资产,更是为未来的AI战争划定数据资产的红线。
这1500万的判罚,无疑为互联网内容创作者注入了强心剂,也让“数据资产”的概念变得前所未有的清晰。当AI成为新的焦点,数据的所有权和使用边界将如何被重新定义?这或许是整个行业都需要思考的下一个问题。
关键评论
有网友算了一笔账,认为搬运内容为抖音带来的流量收益远超1500万赔偿金。
有评论犀利地指出,这看似买卖,实则更接近于“强买”行为。
部分网友认为,尽管百度自身存在争议,但这次被搬运确实“欺负人”。