OpenAI等六大AI巨头被作家群体起诉,涉及“盗版获取-模型训练-商业变现”非法闭环
当地时间12月22日,美国加州北区地方法院受理了一起重要的集体诉讼案件,作家约翰·卡雷鲁牵头的作家群体以“蓄意侵权”为主诉,将OpenAI、谷歌、Meta、Anthropic、xAI及Perplexity AI六家AI巨头列为共同被告,诉状显示,这些公司通过从“非法影子图书馆”如LibGen、Z-Library等处批量下载数百万册小说、纪实作品等盗版书籍,用于训练大语言模型和产品优化,形成了一条“盗版获取-模型训练-商业变现”的非法闭环,作家方强调,自己的智力成果支撑起“价值数十亿美元的AI生态”,却未获分文补偿。
此次诉讼不仅揭露了AI公司对盗版数据的依赖,也引发了围绕AI训练数据合法性的重大争议,据悉,每部侵权作品若被认定为蓄意侵权,最高可获赔15万美元。

值得注意的是,这并非AI公司首次陷入版权纠纷,OpenAI已至少面临14起版权诉讼,早在2023年底,《纽约时报》曾起诉微软和OpenAI,指控其使用其版权材料训练智能聊天机器人(如微软Copilot和ChatGPT)。《纽约时报》要求被告承担数十亿美元的损失,并销毁相关AI模型和训练数据,OpenAI对此提出上诉,称这与其对用户隐私的承诺相违背。
去年10月,《纽约时报》还向生成式AI初创公司Perplexity AI发出“停止并终止”通知,谷歌因“未经授权复制海量版权作品用于AI开发”被迪士尼等好莱坞大厂发出停止侵权函,而Meta也因模型训练数据问题多次收到侵权警告,Anthropic更是因使用盗版书籍训练Claude模型被告,2025年6月一家美国加州法院最终裁定其“盗版数据不适用合理使用”,迫使其支付15亿美元和解并销毁侵权数据。
加州北区法院目前已受理25起AI版权案件,占全美同类案件半数以上,此案的判决结果或将成为界定AI训练数据合法性的关键标尺。
这场集体诉讼不仅凸显了AI行业在知识产权保护方面的挑战,也引发了对“合理使用”概念的深入思考:在AI技术迅猛发展的今天,如何平衡技术创新与知识产权保护,成为整个行业亟需解决的难题。