2024年8月,一群作家把AI巨头Anthropic告上了法庭。他们指控这家公司从盗版网站下载了超过700万本书,用来训练聊天机器人Claude。打了近两年后,这桩天价案最终落下帷幕。2026年7月,法庭最终批准了Anthropic15亿美元的和解协议。这是美国版权法历史上金额最高的和解案件。
很多人第一反应是:“用书训练AI,果然侵权了。”
但威廉·阿尔苏普(William Alsup)法官在2025年6月的裁定中说:“训练AI本身属于合理使用,不构成侵权。”
那这15亿赔的是什么?
赔的是Anthropic从盗版网站下载那700万本书这个行为本身。
一、天价版权和解案的始末
2024年,作家Andrea Bartz、Charles Graeber和Kirk Wallace Johnson代表作者和出版商群体,对AI公司Anthropic提起集体诉讼。
三位作家指控Anthropic从LibGen、PiLiMi等盗版网站下载了超过700万本电子书,用于训练其AI聊天机器人Claude。Anthropic不承认侵权,主张其行为属于合理使用。双方未能达成庭前和解,案件进入审理阶段。

案件在加州北区联邦法院审理了近一年。2025年6月,威廉·阿尔苏普法官在审查后作出了部分即决判决,侵权部分的赔偿问题定于12月由陪审团审判。
部分即决判决如下:
第一,训练合法。法官认为,Anthropic把受版权保护的书籍拿来训练AI大语言模型,有很强的转换性*,构成美国版权法上的“合理使用”。
第二,下载存储侵权。但法官同时认定,Anthropic从盗版网站下载并存储这些盗版图书的行为本身构成侵权。
*注:“转换性”是美国版权法里的一个专业概念,简单说就是,看你用别人的作品,是不是为了干一件跟原来完全不一样的新事情。
判断标准是:新作品有没有增加新的内容、新的功能,或者改变了原来的用途。改变了,就是“有转换性”;没改变,就是“单纯复制”。

判决后双方开始谈判。9月5日,Anthropic正式提交和解动议,威廉·阿尔苏普法官对方案并不满意,在9月8日的听证会上提出严厉批评,认为存在诸多缺陷,和解一度陷入僵局。
法官要求双方补充材料:
9月15日前提交盗版书籍清单,9月22日前提交索赔表格。9月25日,修改后的方案获得法官初步批准。
2026年7月20日,加州北区联邦法官阿拉塞莉·马丁内斯-奥尔金签署了最终批准令,案子正式结束,和解覆盖约48.2万至50万部作品,每部作品的权利人能拿到大约3000美元。
二、为什么Anthropic花15亿“买”和解
威廉·阿尔苏普法官在审查后作出了部分即决判决,判定将受版权保护的书籍用于训练AI,构成“合理使用”,同时判定下载存储侵权成立。
侵权这事已经定了,剩下的问题是:赔多少?
按美国版权法,故意侵权每部作品最高可判15万美元。Anthropic手里有700万本盗版书,如果让陪审团来算这笔账,理论上的赔偿额是天文数字。
Anthropic的选择是:不等陪审团出结果,自己先跟对方谈一个固定数额,15亿封顶,官司到此为止。

对Anthropic自己来说,这份判决还有其它用处。
它是一份有分量的参考性意见(英美法上叫Persuasive Authority)。以后如果有别的作家在同一地区告Anthropic,它的律师可以直接引用这份意见。但这个好处只属于Anthropic。
看看它的竞争对手:
OpenAI正被《纽约时报》和美国作家协会双重起诉,两边谈了两年多的授权,一直没谈拢。2026年7月,《纽约时报》还指控OpenAI在证据披露问题上故意撒谎。
Meta的情况更复杂。2025年6月,它在作家诉讼中赢了一场“合理使用”的裁决。但2026年5月,五大出版商联合起诉Meta,说它从盗版网站下载了数百万部作品,还拿出了内部邮件,显示扎克伯格亲自拍板放弃合法授权、改用盗版数据库。原告称这是“历史上最严重的版权侵权行为之一”。
从结果来看,Anthropic已经率先从官司里脱身了,它的竞争对手还在法庭上耗着。这就是15亿美元和解换来的时间差。
三、国内AI公司现在该怎么做
Anthropic案对国内AI企业有直接的参考意义。
国内法院处理AI版权案件,思路跟美国不完全一样。美国是判例法,法官有很大的自由裁量权;中国是成文法,法官严格按《著作权法》判案。
但有些内容是共通的:两国法院都需要看AI输入端的数据来源合不合法,也看输出端生成的内容侵不侵权。 两头都在看,两头都得守住。
输入端这块,国内法规写得明明白白。《生成式人工智能服务管理暂行办法》第七条明确要求:要“使用具有合法来源的数据”,不能侵害别人的知识产权。数据来源说不清楚,输入端就站不住脚。
输出端也一样。生成的东西如果跟原作品高度相似,或者直接替代了原作品的市场,输出端就会出问题。
那么,国内AI公司具体该怎么做?

最后想说
Anthropic花了15亿美元买了一个教训:AI可以学很多东西,但资料不能是盗版的。这个教训对每一家做AI的中国企业都适用。
如果你正在梳理训练数据的来源,不确定哪些渠道有风险,欢迎在评论区聊聊,也可以直接私信我们聊聊你的具体情况。
训练数据合规这事,越早动手,代价越小。



