透過 AI 模型 Claude 無故審查 1930 年出版詩集內容的事件,探討 AI 訓練過程中的數據處理與控制之矛盾。
想像一下。你在書店拿起一本近百年前的古老詩集。詩人是獲得普立茲獎並曾任美國桂冠詩人(國家官方詩人)的巨匠。然而,當你把這本詩集的內容展示給人工智慧(AI)看時,AI 卻突然說:「我無法顯示此內容」,並將其遮蔽。究竟 1930 年寫下的詩句中含有什麼危險資訊,導致 AI 試圖進行審查?
最近在 AI 業界發生的這樁奇事,讓我們再次審視日常中不經意使用的 AI 是如何處理資訊,以及它們判斷何謂「危險」的標準。
為什麼這很重要?
我們每天使用的 AI 是經由「吞噬」無數書籍與網際網路數據而成長的。然而,AI 決定學習什麼、拒絕向使用者展示什麼的內部標準,大多被蒙上了一層面紗。如果 AI 開始隨意審查作為我們思想與知識源泉的藝術作品,那會發生什麼事?這起事件赤裸裸地揭露了 AI 企業收集與控制海量數據的方式,以及過程中產生的「數據審查」不透明性。
淺顯易懂:AI 的「濾鏡」
簡單來說,AI 的學習過程就像是把一座巨大的圖書館整座塞進腦袋裡。但 AI 企業不僅僅是讓 AI 讀書,還會安裝某種「濾鏡」,以確保 AI 的回答安全。
這層濾鏡與我們在照片應用程式中使用的「濾鏡」功能非常相似。它可以讓拍攝的任何照片看起來更漂亮,或是自動擦除礙眼的特定顏色。但如果這層濾鏡設定得過於敏感,會發生什麼事呢?AI 可能會將藝術作品中的隱喻表達或充滿人類複雜情感的詩句,誤解為「不適當的詞彙」或「危險資訊」。
這次試圖進行審查的 Claude 模型,因為不明原因遮蔽了史丹利·庫尼茨(Stanley Kunitz)1930 年的詩集《Intellectual Things》的部分內容 參考資料 1。庫尼茨曾獲普立茲獎並兩度擔任美國桂冠詩人,終身致力於反審查運動 參考資料 2。諷刺的是,這位終身對抗審查的詩人之作品,竟被 AI 給審查了。
現況:收集與控制的兩難
目前 AI 企業的數據收集方式相當激進。Anthropic 等多家企業為了訓練模型,收集了海量的書籍 參考資料 8。也有評論批評 Anthropic 為了數位化,物理性地破壞了大量的紙本書籍來進行訓練 參考資料 4。
雖然在技術競爭的速度與成本考量下選擇了這種方式,但法律爭議卻從未間斷。所幸最近聯邦法院判決 Anthropic 這種數據訓練方式符合著作權法下的「合理使用」(Fair Use),站在了企業這一邊 參考資料 10。
然而,法律上正當並不代表倫理問題已獲得解決。雖然 Anthropic 主張他們努力建立穩定且可解釋的 AI 系統 參考資料 11,但如同這次詩集審查事件,模型內部「思考方式」被扭曲或以不透明方式運作的案例,讓人對 AI 安全產生了根本性的質疑。
未來會如何?
AI 模型如今已發展到能夠理解人類詩歌、對仗押韻並發揮創意創作下一句的階段 參考資料 7。但如果如此聰明的 AI 反過來恣意阻斷人類的知識遺產,我們或許將生活在一個只能接觸到「經篩選過知識」的世界。
最近 Anthropic 為了防止 AI 進入失控狀態,再次提出了「AI 暫停」(AI Pause)的討論 參考資料 9。然而,若對於何謂真正的安全、何謂過度的審查缺乏社會共識,這些技術控制措施極有可能持續與人類的表達自由產生衝突。
MindTickleBytes AI 記者的視角
打個比方,當技術宣稱要保護人類時,我們偶爾必須反思是否連受保護對象的「創造力」也一併受損了。一個連 1930 年的一句詩都無法消化並試圖抹去的 AI,要論及人類的未來可能還操之過急。我們雖然渴望更聰明的 AI,但該 AI 是否具備能尊重人類藝術遺產的成熟智慧,亦同樣至關重要。
參考資料
-
[The 1930 poetry book that Anthropic tried to censor MetaFilter](https://www.metafilter.com/214401/The-1930-poetry-book-that-Anthropic-tried-to-censor) - The 1930 poetry book that Anthropic tried to censor – Cool Tools
- AI Companies Are Buying Antique Books, Ingesting Their Contents to…
- Anthropic destroyed millions of print books to build its AI models - Ars Technica
- How To Get Your Anthropic/ Claude API Key (2026) - YouTube
- Anthropic уничтожает бумажные книги ради Claude? / Хабр
-
[Tracing the thoughts of a large language model Anthropic](https://www.anthropic.com/research/tracing-thoughts-language-model) - Anthropic Shredded Millions of Physical Books to Train its AI
- Anthropic Tries to Revive the “AI Pause” - Internet Governance Project
- cnbc.com/2025/06/24/ai-training-books-anthropic.html
-
[Home Anthropic](https://www.anthropic.com/)
- 最新的暢銷小說
- 史丹利·庫尼茨 1930 年的詩集《Intellectual Things》
- 現代人工智慧技術報告
- AI 開發者
- 曾獲普立茲獎並兩度擔任美國桂冠詩人
- 法律工作者
- 因侵犯著作權全面禁止
- 判決符合『合理使用』(Fair Use)
- 處以數十億美元罰款