近日,一场持续近两年的AI版权集体诉讼案终于尘埃落定。法院最终批准了人工智能公司Anthropic向原告支付15亿美元的和解金。根据报道,Anthropic在2023年至2025年间的实际营收约为50亿美元,这笔和解金几乎接近其两年收入的三分之一,成为AI领域迄今为止最大规模的侵权赔偿案之一。案件的起因源于Anthropic公开论文中提及的训练数据来源,进而引发了数十万版权人的集体诉讼。

希鸥网观察到,这起案件的核心争议在于AI公司使用未授权作品进行模型训练是否构成侵权。Anthropic曾在2021年发表论文,详细介绍了其早期模型训练数据来自Common Crawl和网络书籍,其中包含一个名为The Pile的数据集,其子集Books3包含近20万本无版权电子书。尽管Books3后来被下架,但媒体在2024年调查中发现,Anthropic商业模型Claude确实使用了该数据集,导致版权方正式提起诉讼。

在案件审理过程中,原告通过深入调查发现,Anthropic使用的盗版书籍远不止Books3,还包括LibGen和PiLiMi等非法下载的素材,总计超过七百万本书。同时,Anthropic为规避法律风险,曾耗费数百万美元购买纸质书籍,进行破坏性扫描后销毁原书,以符合美国版权法“首次销售原则”。这一做法虽然合法,却引发了公众对其行为动机的强烈质疑,因为Google Books曾通过完整扫描并保留原书的方式被法院认定为合理使用。

最终,法院认为Anthropic明知版权风险却依旧使用盗版数据,属于明知故犯,迅速作出判决。值得注意的是,在被侵权的作品中,已有91.3%完成申领,若判决成功执行,每本书可获得约3000美元的和解金。而原告律师团队最初要求的和解金分成高达3亿美元,后经法院削减至1亿美元。尽管案件告一段落,但仍有部分版权方选择单独诉讼,AI与版权的争议远未结束。

希鸥网认为,这一判决为所有AI版权案树立了重要标杆:在技术飞速发展的同时,尊重原创者权益是不可逾越的红线。法院的果断裁决避免了对科技巨头的过度偏袒,体现了法治对创新与公平的平衡。未来,AI公司必须在数据合规上投入更多成本,从源头建立透明的版权核查机制,否则将面临更严厉的法律后果。只有兼顾技术进步与创作者利益,行业才能实现可持续发展。

从创业视角看,Anthropic的案例印证了精益创业中“经证实的认知”的重要性。语料指出,创业的核心目标不是高效交付功能,而是快速验证关键业务假设。Anthropic早期依赖盗版数据训练模型,本质上是假设版权风险可以忽略,却未用真实客户行为数据去验证这一假设。当媒体调查和诉讼爆发后,其商业路径的脆弱性暴露无遗。创业者应意识到,任何未经验证的低成本捷径都可能在未来引发毁灭性代价。

此外,创业维艰案例强调,成功企业往往通过快速识别客户真实痛点并果断行动来建立信任。Anthropic在发现盗版风险后,选择了购买纸质书破坏性扫描的“合法”方案,却忽视了这一做法对公共信任和行业声誉的损害。真正能持续发展的企业,应在危机中优先考虑护住客户、护住信誉,而非仅追求法律上的最低安全线。AI创业者更需平衡商业效率与社会责任,将合规视为长期竞争力的核心要素。

2026人工智能+实战应用及产业创新论坛将于7月31日在南京举办,欢迎全国各地人工智能创业者报名。本文内容整理自网络,将同步发布在希鸥网创投联盟网站(希鸥网、AI联播网、斯贝瑞品牌资讯、华商资讯网、金鸥财经、锐CEO网、AEXNEWS美讯社、创新日报)。欢迎媒体合作、会议咨询、纳斯达克大屏等业务对接~ 如需修改或发布文章,请加微信号:sheisceo