美国联邦法院近日正式裁定,批准人工智能公司Anthropic与作家、出版商达成的高达15亿美元的集体诉讼和解协议。这一和解旨在解决Anthropic在训练其AI模型过程中涉嫌侵犯版权的问题,公司随后将启动向相关版权方的赔偿支付流程。
该和解方案由美国加州北区地方法院法官阿拉塞利·马丁内斯-奥尔金签署最终批准文件。此前,已退休法官威廉·阿尔苏普曾对该方案作出初步批准,并明确指出Anthropic存在非法下载并存储数百万本受版权保护书籍的行为。
根据赔偿细则,每部涉案作品预计可获得3000美元赔偿,涉及作品数量约50万部。赔偿金将由版权所有者,即作者与出版商共同分配。这一赔偿规模被视为美国版权法领域迄今为止规模最大的和解案例之一。
尽管和解协议已达成,但围绕AI训练数据合法性的争议并未完全平息。阿尔苏普法官在案件核心争议中曾支持Anthropic的部分主张,认为利用受版权保护的文本训练AI模型可能构成“合理使用”,这一观点被业界视为AI版权领域的重要判例参考。然而,法官同时指出,Anthropic获取部分训练数据的途径存在违法性。
Anthropic获取训练数据的方式主要分为两类:一类是通过合法渠道购买并扫描的书籍,另一类则是从Library Genesis、Pirate Library Mirror等盗版网站下载的内容。法院认定,后者涉及非法获取受版权保护的材料。为规避进一步审判及可能面临的高额赔偿,Anthropic最终选择通过和解解决纠纷。
业内分析人士指出,此次和解虽终结了该案件,但并未为整个AI行业确立统一的法律标准。由于Anthropic选择和解而非上诉,阿尔苏普此前关于AI训练“合理使用”的判断未形成具有约束力的司法先例。
目前,围绕AI模型训练数据版权的诉讼仍在持续发酵。谷歌、meta、Midjourney和OpenAI等科技公司均面临类似指控。近期,Hachette、Cengage、Elsevier等出版机构,以及作家斯科特·图罗和SCRIBE等联合对谷歌提起诉讼,指控其未经授权使用版权作品训练Gemini人工智能平台。
随着生成式AI技术的迅猛发展,如何在满足模型训练需求与保护版权之间找到平衡点,已成为全球AI产业亟待解决的法律与商业难题。Anthropic的和解案例虽提供了一种争议解决路径,但行业关于AI数据合规的长期规则仍需进一步明确。









