《今日美国》及13家关联实体在纽约曼哈顿联邦法院起诉OpenAI,指控其未经许可抓取19家报纸数十万篇报道用于模型训练与输出,索赔逾2.5亿美元,并要求法院下令销毁侵权模型及训练数据集。
《今日美国》(USA Today)及其13家关联实体已在纽约曼哈顿联邦法院起诉OpenAI。起诉书指控这家人工智能公司抄袭了旗下19家报纸数十万篇报道,用于训练并运行AI模型,随后将这些经过重组的新闻内容直接呈现给ChatGPT用户。
该案在纽约南区联邦地区法院立案,原告方代理律师为来自Rothwell Figg Ernst & Manbeck律所的Steven Lieberman。原告正寻求超过2.5亿美元的损害赔偿,其中包括对每起故意侵权作品索赔最高15万美元,以及指控OpenAI每次删除作品版权管理信息索赔最高2.5万美元。

涉案出版物包括《今日美国》《田纳西人报》《底特律自由新闻》《印第安纳波利斯星报》《亚利桑那共和报》《密尔沃基哨兵报》和《哥伦布快报》等。起诉书指出,在OpenAI用于训练GPT-2的数据集WebText中,原告内容占了16万余条,其中仅usatoday.com的条目就达83266条;此外,这些报纸内容在Common Crawl的2019年镜像C4中占了超过1.22亿个Token。
诉状还列举了GPT模型直接调取相关媒体报道并生成详细摘要的案例。原告指出,OpenAI对模型进行了后训练,使其能够总结文章而非引导读者访问原文,实质上构成了对原报道的替代。原告要求陪审团审判,并申请法院发布禁令,销毁包含相关报纸内容的GPT模型及训练数据集。
诉状写道:
“OpenAI蓄意选择在未经许可的情况下使用受版权保护的作品,完全漠视了赖以创作成果维生的作者与出版商的权益。”
诉状还援引了OpenAI的内部沟通记录。ChatGPT负责人Nick Turley曾写道,公司的产品“在很大程度上具有替代性,事实就是如此”;另一名工程师则表示,“无论我们把链接放得多显眼,用户都不会去点”。原告认为,OpenAI与其他新闻机构签署的付费授权协议,恰恰证明其清楚模型训练需要获得授权。
原告在提交诉状同日申请将此案并入该法院已有的OpenAI合并版权诉讼案中审理,目前该综合诉讼已进入简易判决阶段。本案提出的三项指控分别为直接侵权、替代侵权以及删除版权信息,这与《纽约时报》2023年起诉OpenAI和微软一案中的核心诉求一致。
去年9月,美国司法部曾在一份陈述中倾向于支持OpenAI和微软,主张应允许AI公司使用受版权保护的材料训练模型。OpenAI和微软并不否认使用了相关新闻内容进行训练,但坚称这种使用方式属于合法合理使用。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断