多家出版商在美起诉 Meta:指控 Llama 训练使用盗版书籍与期刊

106次阅读
没有评论

共计 1099 个字符,预计需要花费 3 分钟才能阅读完成。

Analysis

AI 训练侵犯版权, 爱思唯尔、圣智等多家出版商起诉 Meta

围绕 AI 训练数据的版权争议,正在进一步升级 当地时间 5 月 5 日, 多家国际出版商在曼哈顿联邦法院对 Meta Platforms 提起诉讼, 焦点直指其人工智能模型 Llama 的训练数据来源。

📌 出版商集体起诉 Meta, 矛头指向 Llama

此次参与起诉的出版机构包括爱思唯尔、圣智、阿歇特、麦克米伦和麦格劳 - 希尔。根据起诉内容, 这些出版商认为 Meta 在训练大语言模型时, 使用了未经授权的书籍和期刊文章, 涉嫌侵犯版权。

起诉方还包括作家斯科特·图罗。相关诉讼被设计为拟议集体诉讼, 出版商希望法院允许其代表更大范围的版权所有者群体提出索赔。至于具体赔偿金额, 目前尚未确定。

🔍 争议核心:AI 训练能否使用受版权保护材料

出版商方面的主要指控是,Meta 为了提升 AI 模型对人类提示的响应能力, 获取并使用了数百万部作品。这些作品类型覆盖较广, 从教科书、科学论文到小说均被提及。

起诉材料中列举的作品包括 N.K. Jemisin 的《第五季》以及 Peter Brown 的《荒野机器人》等。出版商认为, 若相关作品确实未经授权被用于模型训练, 就不仅是单一作品纠纷, 而是涉及整个出版业与生成式 AI 行业之间的数据边界问题。

💡 Meta 回应: 将以合理使用抗辩

面对指控,Meta 方面表示,AI 正在推动个人和企业层面的创新、生产力与创造力提升。Meta 同时强调, 已有法院裁定在特定情况下使用受版权保护材料训练 AI 可能构成合理使用, 公司将积极应对此案。

这也显示出双方分歧的核心: 出版商强调授权、补偿和内容创作者权益;AI 公司则倾向于将训练行为纳入合理使用框架。由于不同案件的事实细节、数据来源与使用方式可能存在差异, 最终走向仍需等待法院审理。

📊 几个值得关注的影响

  • 对 Meta:若诉讼推进,Llama 相关训练数据来源和使用方式可能面临更严格审查。
  • 对出版商:案件可能影响未来出版内容与 AI 公司之间的授权谈判。
  • 对 AI 行业:“合理使用”边界若被进一步明确, 将直接影响模型训练成本和数据合规路径。
  • 对作者群体:集体诉讼若获法院认可, 可能扩大版权人索赔范围。

此前, 由亚马逊和谷歌支持的 Anthropic 已就类似作家集体诉讼达成和解, 同意支付至少 15 亿美元, 并按每部作品约 3000 美元及利息进行补偿。这一案例也让外界更加关注大型 AI 公司在版权争议中的潜在财务风险。

🚀 版权规则进入 AI 时代的压力测试

美国出版商协会负责人玛丽亚·帕兰特批评称,Meta 所涉行为并非社会进步, 并强调如果科技公司将盗版网站置于学术研究和想象力之上,AI 难以真正实现其价值。

以上为阶段性观察。
本文基于公开信息整理, 如有侵权请联系删除。
正文完
 0