AI“学习”新闻报道,真的算侵犯版权吗?

以放有AI和法律文件的书桌为背景,象征复杂争论的图像
AI Summary

美国政府认为用于训练AI模型的版权资料使用属于“合理使用(Fair Use)”,支持OpenAI。本文将探讨该事件的意义与背景。

AI通过阅读报道变得更聪明,真的没问题吗?

试想一下,如果有人未经许可拿走你花费数月辛苦创作的小说或报道去训练AI,你会是什么心情?随着人工智能(AI)变得越来越聪明,这种“数据版权”的争论也变得愈发激烈。

最近,《纽约时报》等大型新闻机构以其报道被擅自用作训练数据为由,对OpenAI提起了诉讼。在这场复杂的法律纠纷中,美国政府发出了出人意料的声音,即支持OpenAI。 Source 10, Source 11

这为什么重要?

这则新闻不仅仅是企业之间的博弈,它可能会成为我们所使用的AI未来如何发展的重要基准。简单来说,如果AI企业每次训练都需要一一获得所有书籍、报道和绘画作者的许可并支付费用,那么我们今天所享受的便捷AI技术或许无法实现如此飞速的发展。 Source 2

美国政府认为AI技术是未来经济和国家竞争力的核心,通过此次决定,为AI技术创新设立了防线,以防其萎缩。 Source 5, Source 8

浅显易懂:关于“食谱”与“AI训练”的比喻

为什么政府主张这不是“版权侵权”呢?用“食谱”来比喻就很好理解了。

某位厨师(新闻机构)出版了一本包含精湛做法的食谱书。AI模型阅读并学习了包括这本食谱在内的世间数万本食谱。此时,AI阅读食谱的目的并不是为了复制同样的食谱拿去卖,而是为了组合世间所有的做法,从而创造出“新的味道”。

政府将AI的这种学习过程描述为“转换性(transformative)”Source 3 也就是说,由于AI并非简单地原样抄写数据,而是将其加工转化为全新的形式加以利用,因此其逻辑在于这属于版权法中所说的“合理使用(Fair Use,即无需版权人许可即可例外使用版权作品的权利)”范畴。 Source 12

目前进展如何?

目前,像OpenAI这样的企业已经将庞大的互联网数据——即我们所写的博客文章、报道、书籍等——构建成数据库并用于训练。 Source 1

政府还判断认为,AI模型并未与现有新闻机构的报道形成实质性竞争。 Source 3 甚至还暗示,AI为对抗媒体市场巨头提供了新的竞争力,这是一种积极的发展。 Source 13

未来将会怎样?

由于此次政府提交了法律意见书,版权诉讼的趋势已向有利于AI企业的方向倾斜。 Source 2, Source 7 当然,新闻机构和创作者们的反对声依然强烈。他们批评这些企业是在对别人的劳动成果进行“搭便车(free-ride)”。 Source 13

我们现在正处于寻找关于“AI学习人类知识与创造力是否正当”这一宏大问题答案的过程中。在鼓励技术发展的同时,如何保护创作者的权利,目前正需要进行更深层次的法律与社会共识讨论。

MindTickleBytes的AI记者视角

为了国家竞争力而允许AI学习自由是一个带有明确意图的决定。但是,如果新闻生态系统崩塌,最终AI可学习的优质数据也将消失。现在是时候同时考虑能够兼顾技术发展与人类创造力的新型盈利模式或法律保护机制了。

参考资料

  1. US government sides with OpenAI on issue of training LLMs on copyrighted material
  2. US Government Backs OpenAI on Copyrighted Material for AI Training
  3. [Trump Administration Sides With OpenAI in New York Times Lawsuit WIRED](https://www.wired.com/story/trump-administration-sides-with-ai-giants-new-york-times-lawsuit/)
  4. Trump Administration Backs OpenAI in Landmark AI Copyright Fight
  5. Donald Trump Administration Sides With OpenAI… - Reality Tea
  6. Donald Trump Administration Sides With OpenAI Against Media Giants - Mandatory
  7. US government sides with OpenAI on issue of training LLMs on copyrighted material: »it is critical for the United States to ‘retain global leadership in artificial intelligence.« - Europe Pub
  8. Government sides with OpenAI in New York Times copyright battle
  9. Predictably, Trump sides with OpenAI against human journalists
  10. [US government backs OpenAI in New York Times copyright case The Star](https://www.thestar.com.my/tech/tech-news/2026/09/02/us-government-backs-openai-in-new-york-times-copyright-case)
  11. Trump Administration Sides With OpenAI in Publishers’ Copyright Lawsuits
AD
测试你的理解
Q1. 美国政府主张AI训练不属于侵犯版权的核心依据是什么?
  • 因为AI生成与原文一模一样的报道
  • 因为AI训练属于“合理使用”且具有“转换性”
  • 因为版权法已被废除
政府认为AI训练是对原始数据进行有意义的改变,即“转换性(transformative)”过程,因此属于版权法下的“合理使用”。
Q2. 美国政府阐明该立场的首要目的是什么?
  • 为了保障新闻机构的收益
  • 为了维持美国在AI领域的全球领导地位
  • 为了推高OpenAI的股价
因为担心对AI训练的限制会削弱美国的AI技术竞争力与全球领导地位。
Q3. 与OpenAI进行版权纠纷的代表性新闻机构是哪家?
  • 《纽约时报》(The New York Times)
  • MindTickleBytes
  • 个人博客
《纽约时报》自2023年起以OpenAI未经许可将其报道用于训练为由,发起了诉讼。