孤本网
/ 0 阅读
0

《今日美国》起诉 OpenAI 侵权索赔逾 2.5 亿美元

一句话结论

《今日美国》母公司索赔逾 2.5 亿美元,指控 OpenAI 擅自复制其海量文章用于模型训练。

关键要点

  • 《今日美国》公司及其旗下多家地方报纸向 OpenAI 提起诉讼,索赔金额超过 2.5 亿美元。
  • 原告指控 OpenAI 复制了“数十万篇”文章用于训练人工智能模型,属于未经授权的滥用行为。
  • 该诉讼发生在 OpenAI 面临的一系列版权诉讼之列,此前已有《纽约时报》、《观察报》、Ziff Davis、CBC 加拿大广播公司等提起诉讼。
  • 原告主张 OpenAI 的内容使用对其媒体机构造成了“真实且持续”的损害。

背景与事实

作为美国主要的新闻媒体之一,《今日美国》公司(USA Today Co.)于周四提交了法律文件,正式启动针对 OpenAI 的版权侵权诉讼。在此次诉讼中,《今日美国》不仅代表自身品牌,还联合了其旗下的多家地方报纸共同行动,旨在维护整个媒体集团的版权利益。原告在文件中明确指出,OpenAI 在其人工智能模型训练过程中,未经授权复制了高达“数十万篇”的受版权保护的文章。

这一诉讼并非孤立事件,而是 OpenAI 遭遇版权风暴的最新表现。此前,OpenAI 已陷入多起类似的版权纠纷中。其中最引人注目的是《纽约时报》对 OpenAI 提起的诉讼,该案引发了全球媒体行业对人工智能训练数据合规性的广泛关注。此外,专门报道监督性新闻的《观察报》(The Intercept)、科技媒体 CNET 的所有者 Ziff Davis、加拿大广播公司 CBC/Radio-Canada 以及著名的百科类网站 Encyclopaedia Britannica 均对 OpenAI 提起了法律诉讼或采取了相关行动。这些案件共同构成了针对 OpenAI 的版权诉讼链,显示出版业正在通过法律途径集中应对人工智能公司使用其内容的问题。

根据《今日美国》在周四提交的文件,OpenAI 的这种行为已被定性为“未经授权的滥用”,并且原告强调,这种滥用行为对其旗下的各个媒体渠道造成了“真实且持续”(real and continuing)的伤害。为了弥补这些损失并惩罚被告,原告向法院提出的赔偿请求金额超过了 2.5 亿美元。这一高额索赔反映了出版商对 OpenAI 使用其内容规模的评估,也表明媒体巨头正在通过高额赔偿诉求来彰显版权保护的重要性。此次诉讼的提交,进一步加剧了人工智能行业与内容创作行业之间的法律紧张关系,使得 OpenAI 在面临技术监管压力的同时,也陷入了复杂的民事法律纠纷之中。

影响分析

对于中文开发者、从业者以及国内媒体机构而言,《今日美国》的这起诉讼具有重要的警示意义和分析价值。首先,这明确表明针对大语言模型训练数据合法性的诉讼已从个案演变为行业性的普遍风险。对于正在构建或依赖大型语言模型的中国开发者来说,虽然中国法律环境与美国不同,但全球范围内对“版权数据清洗”和“授权训练”的严格要求正在形成趋势。开发者在构建模型时,不能假设互联网上的公开爬取数据可以无限且免费地用于商业模型的训练,尤其是当这些数据来自高价值的新闻媒体时。

其次,高额索赔(超过 2.5 亿美元)揭示了版权纠纷的巨大经济杠杆作用。对于初创公司或中型 AI 实验室而言,如此规模的诉讼可能导致资金链断裂或迫使公司重新评估数据策略。国内 AI 从业者在出海或进行全球化布局时,必须提前梳理数据来源的合规性,避免因使用未授权的新闻、图书或专业文献而面临类似的跨国诉讼风险。

此外,这一事件也促使国内开发者重新审视“合成数据”或“人工标注数据”的替代方案。当爬取公开新闻数据的风险激增时,通过付费授权、购买数据库服务或利用公开领域(Public Domain)数据进行训练可能成为更稳妥的合规路径。对于媒体从业者而言,这一判决(若胜诉)或和解条款可能会确立新的行业标准,即 AI 公司必须为使用新闻内容支付明确的版税或授权费,这将改变“免费流量”支撑 AI 技术的现有商业模式。

适用边界

本文所涉及的诉讼主要基于美国法律体系,特别是《版权法》及相关判例,其结论和法律推理过程主要适用于美国法域。因此,该诉讼结果不直接等同于中国法院的判例,中国开发者不能直接援引此案作为国内诉讼的胜诉依据。

此外,OpenAI 面临的诉讼大多集中在其模型训练阶段使用已发布的受版权保护作品。这一结论不适用于那些主要依赖用户生成内容(UGC)、开源代码、政府公开数据或明确允许爬取的公开领域内容进行训练的场景。对于使用严格合规的授权数据集或完全由人类从零开始创作内容的模型,其版权风险结构与本案不同,不能简单套用本案的赔偿标准或法律判定。同时,本文提及的赔偿金额是原告提出的诉求,并非法院最终认定的判决金额,实际损失赔偿可能低于或高于此数字。

孤本观察

从编辑视角分析,媒体集团纷纷选择诉讼而非仅仅依赖技术反爬措施,表明内容提供商正试图将版权从一种防御性权利转化为一种对 AI 公司具有强制约束力的经济权利。这一转变若得到法律支持,将确立“数据即资产”的明确估值标准。

来源:The Verge AI(https://www.theverge.com/ai-artificial-intelligence/1008198/usa-today-openai-copyright-lawsuit)

《今日美国》起诉 OpenAI 侵权索赔逾 2.5 亿美元

常见问题

《今日美国》及其联合诉讼方对 OpenAI 提出的具体索赔金额是多少?

索赔金额超过 2.5 亿美元。

《今日美国》诉讼中指控 OpenAI 用于模型训练的文章数量约为多少?

指控 OpenAI 未经授权复制了“数十万篇”受版权保护的文章。

在《今日美国》起诉 OpenAI 之前,还有哪些知名机构或媒体对 OpenAI 提起了版权诉讼或采取行动?

包括《纽约时报》、《观察报》、Ziff Davis、CBC 加拿大广播公司及 Encyclopaedia Britannica。

《今日美国》公司及其联合诉讼方主张 OpenAI 的行为对其造成了何种性质的损害?

原告主张 OpenAI 的滥用行为对其媒体机构造成了“真实且持续”的损害。

该诉讼确定的赔偿金额是否为法院最终判决的结果?

不是,这是原告提出的诉求,实际损失赔偿可能低于或高于此数字。

来源:The Verge AI