美国联邦法院已最终批准 Anthropic 与一批作者和图书出版商达成的 15 亿美元版权和解。这起案件围绕 AI 训练数据来源展开,也让“模型训练是否属于合理使用”与“训练材料如何取得”这两个问题被进一步拆开处理。
法院批准 15 亿美元和解
据路透社报道,加州北区联邦地区法院法官已在周一签署最终批准令。这意味着 Anthropic 可以开始向起诉其版权侵权的作者和出版商支付和解款项。
这起集体诉讼此前已在去年获得初步批准。案件早期审理中,时任法官 William Alsup 认定,Anthropic 曾非法下载并保存数百万本受版权保护的图书。
训练可算合理使用
不过,法院对案件核心法律问题的判断并未完全倒向原告。Alsup 此前支持 Anthropic 的一项关键主张,即使用受版权保护文本训练 AI 模型,可以被认定为合理使用。
这一判断被视为 AI 行业的重要节点,因为它把“模型训练行为”与“训练数据获取方式”区分开来。也就是说,训练本身未必违法,但取得材料的过程仍可能单独构成侵权或违法。
盗版来源成为和解关键
法院文件显示,Anthropic 的训练图书库主要来自两类来源:一类是购买后再扫描的图书,另一类则是从 Library Genesis 和 Pirate Library Mirror 等盗版网站下载的图书。
法官认为,前一种做法可以成立,后一种做法本身就存在法律问题。关于盗版获取图书的部分原本可能进入审判程序。Anthropic 随后选择和解,避免案件继续进入陪审团裁决阶段,以及可能出现的更高赔偿。
不会形成全行业先例
虽然这起案件已经结案,但它并没有为整个 AI 行业给出最终答案。原因在于,这一“合理使用”判断来自地区法院,而 Anthropic 选择和解后,案件不会进入上诉程序,也就难以形成具有普遍约束力的先例。
目前,Google、Meta、Midjourney 和 OpenAI 等公司仍面临类似版权诉讼。就在上周,包括 Hachette、Cengage、Elsevier 以及作家 Scott Turow 在内的一批出版商和作者,也对 Google 提起集体诉讼,指控其使用受版权保护作品训练 Gemini。
