美国史上最大版权和解落槌:联邦法院最终批准Anthropic 15亿美元AI训练数据和解——Bartz v. Anthropic案对中国AI企业的深远启示
2026年7月20日,美国加州北区联邦地区法院法官Araceli Martínez-Olguín签署命令,最终批准人工智能公司Anthropic与作家集体达成的15亿美元版权和解协议(Bartz v. Anthropic PBC,案号3:24-cv-05417,加州北区联邦地区法院)。这是美国版权法历史上金额最大的和解,约50万部图书的权利人将获得每部约3,000美元的赔偿。该案向全球AI行业发出清晰信号:训练大模型的数据,其「来源合法性」将受到与「使用方式」同样严格的审查。
案件背景
2024年8月,作家Andrea Bartz、Charles Graeber和Kirk Wallace Johnson对Anthropic提起集体诉讼,指控该公司从Library Genesis、Pirate Library Mirror等盗版「影子图书馆」下载了超过700万部书籍,用于训练其大语言模型Claude。案件由资深法官William Alsup审理。
关键裁决:训练是合理使用,盗版下载不是
2025年6月,Alsup法官作出美国AI版权诉讼中里程碑式的简易判决,将两个问题明确切割:其一,使用合法购买并扫描的书籍训练AI模型,属于「极具转换性」(exceedingly transformative)的合理使用(fair use),不构成侵权——这是美国法院首次正面认可AI训练行为本身可受合理使用保护;其二,从盗版网站下载并永久留存盗版书籍以建立「中央图书馆」的行为本身构成侵权,不受合理使用庇护,须交陪审团审理。
依据美国《版权法》第504条,故意侵权的法定赔偿最高可达每部作品15万美元。面对数十万部作品可能累积的天文数字赔偿,Anthropic于2025年9月选择和解,Alsup法官同月作出初步批准。
最终批准的核心内容
Alsup法官退休后,案件由Martínez-Olguín法官接手完成最终审查。除设立15亿美元赔偿基金外,和解协议还要求Anthropic销毁所有从已知盗版书库获取的原始文件及副本。值得注意的是,法官将集体律师申请的1.875亿美元律师费大幅削减至约1.016亿美元,认定3.75倍(而非请求的6.92倍)的lodestar乘数方属合理。
和解不等于先例:行业不确定性仍在
由于案件以和解告终,Alsup法官关于合理使用的认定未经上诉审查,不构成对其他法院的约束性先例。目前针对Google、Meta、Midjourney、OpenAI等公司的数十起AI训练版权诉讼仍在推进;就在2026年7月14日,Hachette、Cengage、Elsevier及作家Scott Turow等又对Google的Gemini模型提起了新的集体诉讼。不同法院完全可能基于不同事实得出不同结论。
对中国企业的启示
第一,数据的获取方式与使用方式将被分开审查。即使AI训练本身可能构成合理使用,也无法「洗白」通过盗版渠道获取数据的侵权责任。中国AI企业出海美国,应确保训练语料经购买、许可或其他合法渠道获得。
第二,美国法定赔偿制度威慑巨大。每部作品750至15万美元的法定赔偿乘以海量作品数量,足以构成生存级风险,而集体诉讼机制使权利人维权成本极低。
第三,建立训练数据来源台账。对语料来源做尽职调查并保留采购与许可记录,此类文件在诉讼中是关键抗辩证据。
第四,关注数据销毁义务。本案和解要求销毁盗版文件;若企业历史上曾使用来源存疑的数据,应及早评估、隔离并在法律指导下处置。
第五,持续跟踪判例演变。合理使用问题尚无终局答案,Google、OpenAI等案的走向将直接影响在美AI业务的合规边界。
结语
Bartz v. Anthropic案以创纪录的15亿美元落幕,其最重要的遗产并非金额本身,而是「训练可以合理使用、盗版必须付出代价」的清晰规则信号。对计划在美国开展AI业务的中国企业而言,训练数据合规已不再是单纯的技术问题,而是关乎企业存亡的法律风险管理问题。格知律师事务所将持续关注美国AI版权诉讼的最新动态。