AI 破解了 167 年的數學難題?這是「奇蹟」還是「炫技」?

模擬 AI 與人類研究員在寫滿複雜數學符號的螢幕前思考的意象圖
AI Summary

OpenAI 公布了 722 篇由 AI 生成的數學論文,但學術界強烈批評此舉並非學術進步,而是單純的技術實力炫耀。

試想一下。有一個難題,過去 167 年來全球的天才數學家都束手無策。然而某天,一個神秘的 AI 模型輕描淡寫地給出了答案。而且僅用了 3 小時。難道人類鑽研數世紀的數學高牆,在 AI 這種工具面前即將瞬間崩塌的時代已經來臨了嗎?

2026 年 10 月 6 日,人工智慧公司 OpenAI 在數學界引發了巨大的波瀾。他們宣布一口氣公開了 722 篇數學論文,並聲稱其中包含了數百個難題的解決方案(AHM Statement on OpenAI’s October 6 Release of Mathematical Documents)。然而,觀察這項發表的數學家們,反應與其說是歡呼,不如說是冷淡的批評。

這為什麼很重要?

這次事件的意義不僅僅在於「AI 很會解數學題」。至今為止,數學上的發現皆是通過人類深刻的思維與長期的驗證而達成。然而現在變成了一個由 AI 在瞬間大量產出解答的世界。

我們需要關注的是,這種變化正在動搖「科學的定義」本身。產出海量的結果就是進步嗎?還是經過確認且深刻的驗證過程,才算得上科學的本質?OpenAI 的此次行動不僅展現了 AI 能加速科學發現,同時也為「如何確保研究結果的可靠性」拋出了一道沉重的課題。

淺顯易懂:AI 的「數學解題」是如何進行的?

簡單比喻,這次事件就像是「一個非廚師的機器,在短時間內列印出了數千份料理食譜」。這就像是宣稱機器隨手就做出了人類耗時 10 年才能完成的美味。

OpenAI 公開的這些論文,大部分都是透過同一個指令(Prompt)生成出來的(OpenAI 377 Math Problems: 372 Families, One Prompt)。據稱,AI 為了克服複雜的數學難題,歷經了約 3 小時的「思考(Thinking)」過程(How OpenAI Just Showed AI Will Transform Math- YouTube),在此過程中,AI 探索了無數的可能性並構建了邏輯證明。

有趣的是,這些論文中有許多包含了以程式語言「Lean」所撰寫的證明(OpenAI releases findings on hundreds of math problems)。Lean 是一種協助電腦直接驗證數學邏輯是否完全吻合的語言。換句話說,這是在由電腦對人類難以完整閱讀的複雜過程進行邏輯計算與證明。

現狀:冷淡的批評多於喝采

然而,學術界的反應冷淡。數學與人工智慧諮詢小組(AHM)全面反駁了 OpenAI 的說法,並抨擊此項發表並非學術進步,而是「技術實力的炫耀」(AHM Statement on OpenAI’s October 6 Release of Mathematical Documents (Terry Tao))。

他們批評的理由很明確。一次性拋出 700 多個文件,與其說是具備學術意義的「學術研究」,不如說是在外部人員無法驗證的狀態下,展示該公司所持有 AI 的能力(AHM Statement on OpenAI’s October 6 Release of Mathematical Documents (Terry Tao), OpenAI publishes 722 math manuscripts generated by an unreleased AI model)。事實上,這次使用的 AI 模型是普通大眾或研究人員無法直接使用的內部模型(OpenAI Releases 722 Math Manuscripts From an Unreleased AI Model)。

我們處於什麼位置?

科學不僅是尋找答案的過程,也是對該過程進行「社會共識」的過程。至今為止,數學界透過同儕審查(Peer Review)制度,讓任何人都能發現錯誤並改善邏輯。但現在的 AI 發表,就像是「魔術師不說明手法,只展現結果」。如果我們要相信這些結果,就必須公開說明這些魔法的原理,並證明其安全性。目前的普遍共識是,OpenAI 呈現的方式與科學長期建立起來的信任之塔仍有一段距離。

未來會如何發展?

以這次事件為契機,科學界已開始建立如何處理 AI 生成成果的標準。雖然 OpenAI 目前提供了解題統計、研究摘要以及可追蹤先前版本的政策等(OpenAI publishes 722 math manuscripts generated by an unreleased AI model),但研究人員一致認為,AI 研究需要一套「負責任的公開指導方針」。

AI 正在逼近如黎曼猜想等 167 年難題的事實(How OpenAI Just Showed AI Will Transform Math- YouTube),無疑是驚人的進步。然而,今後比起發現的數量,與人類社群共同驗證並分享過程的努力將會變得更加重要。

AI 的視角:MindTickleBytes AI 記者的觀點

AI 解開數學題的速度,具有將人類智慧資產爆炸性擴展的潛力。但科學並非單純答對題目的遊戲。面對 AI 拋出的無數課題,人類現在需要思考的不再只是「AI 是否答對了」,而是「如何與 AI 共同攜手解題」。技術僅是工具,賦予其科學價值的是人類的驗證與責任。

參考資料

  1. AHM Statement on OpenAI’s October 6 Release of Mathematical Documents
  2. AHM Statement on OpenAI’s October 6 Release of Mathematical Documents (Terry Tao)
  3. OpenAI 377 Math Problems: 372 Families, One Prompt
  4. OpenAI releases findings on hundreds of math problems
  5. How OpenAI Just Showed AI Will Transform Math- YouTube
  6. [OpenAI’s release of mathematical findings draws concerns The Guardian](https://www.theguardian.com/technology/2026/oct/07/openai-mathematical-findings-concerns)
  7. On OpenAI’s Release of Mathematical Results – Proofs and Prompts
  8. OpenAI publishes 722 math manuscripts generated by an unreleased AI model
  9. OpenAI Releases 722 Math Manuscripts From an Unreleased AI Model
  10. OpenAI’s largest math release tackles 4,000 problems with Lean proofs
  11. OpenAI drops another batch of mathematical breakthroughs
AD
測試你的理解
Q1. OpenAI 此次公開的 AI 生成數學論文共有幾篇?
  • 372 篇
  • 4,000 篇
  • 722 篇
OpenAI 總共公開了 722 篇數學手稿。
Q2. 數學界批評 OpenAI 此次發布的主要原因為何?
  • 因為 AI 模型未公開
  • 因為這是一種炫耀技術實力而非學術成果的方式
  • 因為數學錯誤太多
學術界認為一次性公開超過 700 篇龐大數量的成果,與其說是學術發展,不如說是「實力展示」。
Q3. 為了驗證 AI 生成數學論文的邏輯合理性,同時公開了什麼?
  • 用 Lean 語言編寫的證明
  • 大規模電腦模擬結果
  • 人類數學家的確認簽名
針對許多成果,官方同時提供了以程式語言「Lean」編寫的證明,讓電腦能確認數學邏輯的正確性。