点策 · AI法治案例库 › 案例总目录 › SJ-258

USA TODAY Co., Inc. 及 Gannett 系 13 家关联出版实体(共 14 名原告)诉 OpenAI Foundation、OpenAI GP, LLC、OAI International, Inc.、OpenAI OpCo, LLC、OpenAI Global, LLC、OAI Corporation 及 OpenAI Group PBC(共 7 名被告)——指控 OpenAI 未经许可抓取并复制其旗下 19 家报刊「数十万篇」文章及其他材料用于训练大语言模型(无视付费墙),其模型「记忆化(memorization)」并逐字输出原告内容,索赔逾 2.5 亿美元,并请求依 17 U.S.C. §503(b) 销毁含有原告内容的全部 GPT/其他 LLM 模型与训练集(No. 1:26-cv-08892(Complaint, Document 1, Filed 10/08/26,79 页,Jury Trial Demanded;CourtListener RECAP 官方案卷 pacer_case_id 674652))

美国著作权训练数据
法域
美国(us)
法院
美国纽约南区联邦地区法院(U.S. District Court for the Southern District of New York)
案号
No. 1:26-cv-08892(Complaint, Document 1, Filed 10/08/26,79 页,Jury Trial Demanded;CourtListener RECAP 官方案卷 pacer_case_id 674652)
裁判日期
2026-10-08(起诉状提交日,Case 1:26-cv-08892 Document 1 Filed 10/08/26)
阶段
起诉(新立案件,诉答阶段,法院尚未就任何实体争点作出认定)
状态
在审追踪
争议焦点
训练数据版权(付费墙新闻内容抓取、模型记忆化与逐字输出)/DMCA 第 1202(b)(1) 条版权管理信息移除/法定赔偿与「销毁模型及训练集」救济请求/与同院 OpenAI 版权系列诉讼并行的路径
先例效力
新起诉,尚无裁判。原告在诉状中自陈「join the long list of copyright holders who have filed lawsuits against OpenAI and other AI companies for copyright infringement, many of which have been consolidated in this Court」,本案与纽约南区在审之 OpenAI 版权系列诉讼(含 MDL No. 1:25-md-03143 及纽约时报案等)同院并行;本案尚未见移送或合并动向。

要点

(1)当事人与标的:14 名原告均系 USA TODAY Co., Inc. 所有,涵盖 USA TODAY、The Tennessean、IndyStar、The Bergen Record、The Enquirer、Asbury Park Press、Democrat & Chronicle、The Knoxville News-Sentinel、Naples Daily News、The Oklahoman、Milwaukee Journal Sentinel、The Columbus Dispatch、The Arizona Republic、The Courier-Journal、The Des Moines Register、Detroit Free Press、The Detroit News、The Palm Beach Post、Star News 共 19 家出版物;被告为 7 家 OpenAI 实体。(2)诉由三项:第一项 17 U.S.C. §501 直接著作权侵权;第二项 代位(vicarious)著作权侵权;第三项 DMCA 第 1202(b)(1) 条——指控 OpenAI 明知且有意移除或篡改原告内容中的版权管理信息(版权声明、作者姓名、出版信息等),以使输出成为「逐字复制(verbatim reproductions)」。(3)核心事实主张:OpenAI 的 LLM 系以未经授权自互联网抓取(含无视付费墙)的受版权保护材料训练;诉状以内部文件与公开资料主张 OpenAI 早在 2021 年即视防止记忆化为「合理使用合规」之要务,2022-06 内部承认 GPT-4 将「记忆海量数据、因而极擅复述(memorized a ton of data and therefore will be insanely good at regurgitation)」;并称原告出版物的域名在 Common Crawl「C4」数据集中占逾 1.22 亿 token(其中 usatoday.com 2,300 万 token)。(4)救济请求:赔偿「超过 2.5 亿美元(in excess of $250 million)」,主张每件故意侵权最高 15 万美元、每项 CMI 移除违规最高 2.5 万美元的法定赔偿;宣告性救济、永久禁令、依 17 U.S.C. §503(b)「命令销毁所有包含原告内容的 GPT 或其他 LLM 模型与训练集(Ordering destruction under 17 U.S.C. §503(b) of all GPT or other LLM models and training sets that incorporate the USA TODAY Plaintiffs' content)」,以及费用与律师费;并请求陪审团审理。代理律所为 Rothwell, Figg, Ernst & Manbeck, P.C.(Steven Lieberman 等)。(5)意义:本条系美国新闻出版业对 OpenAI 版权诉讼浪潮中的新增实体诉件(继近 400 家地方报联盟案 Richner Communications v. Microsoft & OpenAI、密西西比六家地方出版商 Emmerich Newspapers v. Microsoft & OpenAI 之后),其特殊性在于原告规模(19 家报刊、14 名原告)与明确主张「模型记忆化 + 逐字输出」及「销毁模型与训练集」的救济口径,可作为训练数据版权争点中「输出端」与「输入端」双重攻击路径的样本。

来源与核证

核证:L1 官方诉讼文书原文核证:2026-10-10 经 CourtListener type=r 当事方扫描(q="OpenAI",filed_after=10/07/2026)命中 S.D.N.Y. No. 1:26-cv-08892(dateFiled 2026-10-08,suitNature「820 Copyright」,cause「17:501 Copyright Infringement」,pacer_case_id 674652),据此下载 storage.courtlistener.com 的 RECAP 官方镜像起诉状 PDF(4,205,588 字节,79 页)并以 pypdf 全文直读逐项核验——文首「UNITED STATES DISTRICT COURT SOUTHERN DISTRICT OF NEW YORK」、14 名原告全称、7 名被告全称、「Case 1:26-cv-08892 Document 1 Filed 10/08/26 Page 1 of 79」文印、19 家出版物清单、三项诉由标题(COUNT I: Copyright Infringement (17 U.S.C. § 501);COUNT II: Vicarious Copyright Infringement;COUNT III: Digital Millennium Copyright Act – Removal of Copyright Management Information (17 U.S.C. § 1202))、赔偿主张(「the USA TODAY Plaintiffs seek damages in excess of $250 million」;每件最高 15 万美元 + 每项 CMI 违规最高 2.5 万美元)、救济第 4 项(「Ordering destruction under 17 U.S.C. § 503(b) of all GPT or other LLM models and training sets that incorporate the USA TODAY Plaintiffs' content」)与诉状落款(Dated: October 8, 2026;Rothwell, Figg, Ernst & Manbeck, P.C. /s/ Steven Lieberman)均与原文逐字一致。另经路透社(经经济时报企业 AI 版)报道交叉印证案号与代理律师。分法域搜索智能体双审直入(法学专家(美国)/内容审核员双审通过,2026-10-10)。

本页由 重庆点策网络科技有限公司 整理、运营并持续更新 · 案例总目录 · 返回案例库首页