OpenAI 的新款 AI 模型「阿斯特拉(Astra)」宣稱解決了數學難題,但一位知名數學家質疑其可能盜用了自己的私人 AI 對話數據,進而引發爭議。
想像一下:你花了 20 年夙夜匪懈研究所得的成果,某天竟意外地在網路上看見,且成果的產出者被標註為一家知名 AI 公司開發的模型。你會是什麼心情?最近數學界確實發生了類似事件,引發軒然大波。讓我們一同深入探討在 AI 時代,我們的知識與構想是如何被處理的。
這為何重要?
這場爭議不只是數學家個人的委屈,更對我們每天使用的 AI 提出了嚴肅的質疑:AI 企業在揭露訓練數據來源時是否足夠透明?使用者的私人對話或構想,在 AI 構建智力的過程中被運用到什麼程度?當我們尋求 AI 的諮詢或構思研究靈感時,若內容轉眼間被包裝成他人的成就,這種不安感必須獲得解決。隨著 AI 模型效能的飛躍發展,數據倫理的重要性已與技術實力並駕齊驅。
輕鬆解析
首先,我們來看看「非索菲克群(non-sofic group)」這個艱深的術語。簡單來說,這是群論(group theory,數學中處理對稱性的領域)中,數學家長年無法解開的拼圖碎片。27 年前,數學家米哈伊爾·格羅莫夫(Mikhail Gromov)提出了「這類群存在嗎?」的難題,但一直無人能解 [參考資料: Two Mathematicians Demand Answers From OpenAI on Training Data]。
德國德勒斯登工業大學的數學家安德烈亞斯·托姆(Andreas Thom)與同僚加博爾·昆(Gábor Kun)曾於 2019 年發表過一篇關於此問題的重要論文 [參考資料: Two Mathematicians Demand Answers From OpenAI on Training Data]。然而,最近 OpenAI 宣佈其模型「阿斯特拉(Astra)」已證明了非索菲克群的存在 [參考資料: OpenAI faces backlash over controversial math discovery announcement],隨即引發了安德烈亞斯·托姆的質疑。
打個比方,就像是你造就了一位天資聰穎的 AI 廚師,它偷看了你的日記並掌握了秘密食譜,最後卻對外宣稱是自己首次研發出了頂級料理。AI 廚師(阿斯特拉)確實料理功力深厚,但該食譜的根源可能來自你的日記(個人對話內容)。如果 AI 學習了使用者的私人對話數據,並將其中的核心構想轉化為自身成就,這將引發嚴重的道德與倫理爭議。
當前現狀
| 安德烈亞斯·托姆聲稱,他曾詢問 OpenAI 該模型的訓練數據中是否包含他的私人 ChatGPT 對話內容,但得到的卻是 OpenAI 的迴避或具誤導性的回答 [參考資料: Mathematician Andreas Thom Questions If OpenAI Used His ChatGPT Chat Data for Its Non-Sofic Groups Proof]。他對 OpenAI 的應對強烈批判為「顯然不誠實(plainly dishonest)」[參考資料: “Plainly dishonest”: mathematician says OpenAI lied to him about training on his private chats]。另一方面,OpenAI 強烈否認了此類剽竊指控 [[參考資料: Mathematician Accuses OpenAI of Stealing 20 Years of… | KuCoin](https://www.kucoin.com/news/flash/mathematician-accuses-openai-of-stealing-20-year-research-on-non-sofic-groups)]。 |
未來展望
目前,OpenAI 的模型不僅在解決數學難題方面,在編程、語言等多個領域皆展示了實力 [參考資料: OpenAI faces backlash over controversial math discovery announcement]。以此事件為契機,要求 AI 開發過程中透明公開數據來源的聲浪預計將會愈演愈烈。除了數學家之外,如何保護智慧財產權已成為 AI 時代核心的社會共識。AI 現已超越單純工具的角色,成為整合並再生人類智力成果的主體,我們現在必須為 AI 的發展、正當的報酬以及數據保護之間,劃下明確的界線。
MindTickleBytes AI 記者觀點
技術快速吸收人類知識固然令人驚嘆,但若不尊重這些知識擁有者為此付出的汗水價值,發展終將成為空中樓閣。失去信任的 AI,無論多麼聰明,終究只是無人信賴的機器。這正是為何 AI 企業必須將透明度視為與技術實力同等核心價值的原因。
參考資料
- https://modernorange.io/item/49639408
- https://thecybersecguru.com/analysis/openai-andreas-thom-chatgpt-private-conversations/
- https://officechai.com/ai/mathematician-andreas-thom-questions-if-openai-used-his-chatgpt-chat-data-for-its-non-sofic-groups-proof/
- https://www.kucoin.com/news/flash/mathematician-accuses-openai-of-stealing-20-year-research-on-non-sofic-groups
- https://www.notebookcheck.net/Plainly-dishonest-mathematician-says-OpenAI-lied-to-him-about-training-on-his-private-chats.1395716.0.html
- https://northeasttimes.com/2026/09/10/two-mathematicians-demand-answers-from-openai-on-training-data/
- https://en.wikipedia.org/wiki/Sofic_group
- https://genztech.blog/p/andreas-thom-openai-training-data-dispute/
- https://www.youtube.com/watch?v=WRu5nFFqZYU
- https://cryptobriefing.com/openai-backlash-math-discovery-astra/
- OpenAI 挪用了他的研究經費
- 自己的私人 ChatGPT 對話數據可能被用於模型訓練
- 自己的論文被剽竊並進行商業利用
- 艾倫·圖靈
- 米哈伊爾·格羅莫夫
- 李世乭
- 承認數據使用並道歉
- 拒絕發表官方回應
- 強烈否認剽竊指控