通过 AI 模型 Claude 无故审查 1930 年出版的诗集这一事件,了解 AI 训练过程中数据处理与控制的矛盾。
想象一下:你在书店拿起一本近百年的旧诗集。作者是曾获得普利策奖、并担任过美国桂冠诗人的文学巨匠。然而,当你把这本诗集的内容展示给人工智能(AI)看时,它却突然屏蔽了内容,并声称“无法显示此内容”。究竟 1930 年创作的诗歌中包含了什么危险信息,竟招致 AI 的审查?
近期 AI 行业发生的这一离奇事件,让我们再次思考:我们日常生活中随手使用的 AI 是如何处理信息的,以及它判定什么是“危险”的标准究竟是什么。
为什么这很重要?
我们每天使用的 AI 是通过“吞噬”海量书籍和互联网数据而成长的。然而,AI 究竟学习什么、拒绝向用户展示什么,其内部判断标准大多被隐藏在黑箱之中。如果 AI 开始随意审查我们思想和知识的源泉——艺术作品,将会怎样?此次事件赤裸裸地揭示了 AI 企业收集和控制海量数据的方式,以及在此过程中产生的“数据审查”的不透明性。
易于理解:AI 的“过滤器”
简单来说,AI 的训练过程就像将一座巨大的图书馆整个塞进脑子里。但 AI 企业不仅是让其阅读书籍,还会安装一种“过滤器”,以确保 AI 的回答是“安全”的。
这种过滤器与我们照片应用中使用的“滤镜”非常相似。无论拍出什么样的照片,它都能自动美化,或者自动擦除某些刺眼的颜色。但是,如果这个滤镜设置得过于敏感会怎样呢?艺术作品中隐喻的表达、承载人类复杂情感的诗句,都可能被 AI 误解为“不当用语”或“危险信息”。
此次尝试审查的 Claude 模型,因不明原因屏蔽了斯坦利·库尼茨(Stanley Kunitz)1930 年的诗集《Intellectual Things》的部分内容 参考 1。库尼茨曾获普利策奖,并两度担任美国桂冠诗人,他毕生致力于反审查运动 参考 2。讽刺的是,这位毕生与审查斗争的诗人的作品,竟被 AI 审查了。
现状:收集与控制的困境
目前,AI 企业的数据收集方式极具侵略性。包括 Anthropic 在内的多家企业为训练模型,收集了海量的书籍 参考 8。外界也有批评声音指出,Anthropic 为了训练,物理性地破坏了数百万册纸质书并将其数字化 参考 4。
当然,在技术竞争的压力下,出于速度和成本的考虑,这种方式曾被采用,但法律争议从未停止。值得庆幸的是,最近联邦法院判决 Anthropic 利用图书数据进行 AI 训练属于版权法下的“合理使用”(Fair Use),支持了企业的做法 参考 10。
然而,法律上的正当性并不意味着伦理问题的解决。尽管 Anthropic 声称他们致力于打造安全且可解释的 AI 系统 参考 11,但像这次诗集审查事件一样,模型内部“思维方式”被扭曲或运作不透明的案例,引发了对 AI 安全的根本质疑。
未来会怎样?
AI 模型现已发展到能够理解人类诗歌、对韵、并创造性地撰写后续句子的阶段 参考 7。但如果这样聪明的 AI 反过来随意切断人类的知识遗产,我们可能会生活在一个只能接触到 AI 所提供的“过滤后的知识”的世界里。
最近,Anthropic 为防止 AI 失去控制,再次提出了关于“AI 暂停(AI Pause)”的讨论 参考 9。然而,如果没有关于什么是真正的安全、什么是过度审查的社会共识,这种技术管控很有可能继续与人类的言论自由发生冲突。
MindTickleBytes 的 AI 记者视角
打个比方,当技术声称要保护人类时,我们有时需要反思是否反而伤害了作为保护对象的人类的创造力。一个连 1930 年的一行诗都无法妥善消化并试图抹去的 AI,要谈论人类的未来或许还为时过早。我们渴望更聪明的 AI,但该 AI 是否具备尊重人类艺术遗产的成熟智能,也同样至关重要。
参考资料
-
[The 1930 poetry book that Anthropic tried to censor MetaFilter](https://www.metafilter.com/214401/The-1930-poetry-book-that-Anthropic-tried-to-censor) - The 1930 poetry book that Anthropic tried to censor – Cool Tools
- AI Companies Are Buying Antique Books, Ingesting Their Contents to…
- Anthropic destroyed millions of print books to build its AI models - Ars Technica
- How To Get Your Anthropic/ Claude API Key (2026) - YouTube
- Anthropic уничтожает бумажные книги ради Claude? / Хабр
-
[Tracing the thoughts of a large language model Anthropic](https://www.anthropic.com/research/tracing-thoughts-language-model) - Anthropic Shredded Millions of Physical Books to Train its AI
- Anthropic Tries to Revive the “AI Pause” - Internet Governance Project
- cnbc.com/2025/06/24/ai-training-books-anthropic.html
-
[Home Anthropic](https://www.anthropic.com/)
- 最新的畅销小说
- 斯坦利·库尼茨 1930 年的诗集《Intellectual Things》
- 现代人工智能技术报告
- AI 开发人员
- 获得普利策奖并两度担任美国桂冠诗人的文学巨匠
- 法律专家
- 因版权侵权被全面禁止
- 判决其属于“合理使用”(Fair Use)
- 处以数十亿美元罚款