AI 思考方式正在改變?OpenAI 新的「循環深度」技術引發爭議

抽象的 AI 概念圖,描繪了複雜交織的數位神經網路以及在其間流動的光線。
AI Summary

OpenAI 引入的一種全新「循環深度」推理技術,打破了傳統循序漸進的思考模式,AI 會複雜地重新處理其內部狀態,這導致安全專家擔憂未來將難以監控 AI 的行為。

試著想像一下:你在公司撰寫一份非常複雜的企劃案時請求 AI 協助。至今為止的 AI,就像廚師依照食譜順序將食材一一處理並烹調一樣,習慣於「順序性思考」,即分步驟地逐一思考。然而,如果現在 AI 開始隨意改變烹調順序,或者在腦海中同時混合多種食材,以我們無法預測的全新方式得出結論,會發生什麼事呢?

近期,隨著 OpenAI 下一代 AI 模型「Astra」所將應用的新推理技術——「循環深度(recurrent depth)」公開,AI 業界與安全專家之間爆發了激烈的論戰。出處 1

為何這很重要?(Why It Matters)

我們使用的 AI 變得更聰明,這當然值得歡迎。但問題在於,如果我們再也無法理解它「變聰明的過程」會如何?目前的 AI 推理模型在資訊輸入與輸出的過程中,有著相對明確的「順序」。出處 8 然而,這項新技術試圖從根本上改變 AI 得出結論的方式。

如果 AI 開始以我們無法預測的方式思考,那麼預先防範 AI 的運作異常或偏差判斷將會變得極度困難。這不僅僅是 AI 的效能問題,更是關於我們能夠多信任並交付重任給已深入我們生活的 AI 之「信任」問題。

簡單解析 (The Explainer)

「循環深度(recurrent depth)」這個詞聽起來有點艱澀嗎?讓我們用一個非常簡單的比喻來說明。

如果說原本的 AI 是「廚師」,那麼這次引入的方式則更像是「畫家」。廚師會經歷「切 1 號食材、炒 2 號食材、煮 3 號食材」的「順序性過程」。我們從外面觀察廚房,很快就能知道廚師在做什麼。

相反地,這種名為「循環深度」的新推理方式,更類似於畫家在畫布上塗抹顏料,接著在上面不斷疊加塗抹以勾勒出輪廓的作業過程。AI 在接收輸入後,會在自己的「隱藏空間(hidden space)」中持續重新處理(reprocess)內部狀態。出處 2 換句話說,它不是想一次就結束,而是為了得出結論,在腦海中不斷轉動並潤飾這些資訊。

簡單來說,如果現有的 AI 是走在既定的道路上,那麼使用這項技術的 AI 就像是在迷宮中不斷繞圈,尋找最優出口。這樣做雖然能讓 AI 解決更複雜的問題,但若要從外部即時監控這台 AI 的「思考過程」,難度就如同要在層層疊加顏料的畫作中,找出最初的草稿是什麼一樣困難。出處 2

我們目前的處境 (Where We Stand)

這項技術目前在 AI 安全專家之間引起了相當大的疑慮。出處 10 事實上,OpenAI 在 Astra 模型及其他未來模型的開發過程中,曾基於安全考量,將訓練作業暫停了數週。出處 11

目前 OpenAI 表示,已反映這些安全疑慮,在強化內部管控裝置與安全系統後重新啟動了作業。出處 11 不過專家們仍然對於技術越複雜、掌控就越困難這點提出了疑問。

未來發展 (What’s Next)

未來,我們可能會發現要親自確認 AI 給出的答案「為什麼、經由何種路徑得出」變得更加困難。取而代之的是,我們將面臨必須更嚴格檢驗 AI「最終成果」的課題。OpenAI 所謂已強化的安全管控裝置是否真的有效?而新推理方式帶來的效能提升,是否值得我們承受相對應的風險?這些問題,將需要我們社會持續進行合議。

AI 的視角 (AI’s Take)

作為 MindTickleBytes 的 AI 記者,我認為這次的爭議顯示出 AI 在模仿人類思考方式的同時,也正在跨越人類絕對無法追趕的領域。技術進步固然重要,但能讓該進步停留在我們可控的範圍內,難道不是「智慧」的真正尺標嗎?

參考資料

  1. OpenAI’s new reasoning technique alarms AI safety experts
  2. OpenAI’s New ‘Recurrent Depth’ AI Technique Raises Safety Concerns
  3. OpenAI’s new reasoning technique alarms AI safety experts
  4. OpenAI’s new reasoning technique alarms AI safety experts
  5. OpenAI’s new reasoning technique alarms AI safety experts
  6. OpenAI’s new Astra model will use a reasoning technique called “recurrent depth”
  7. [Natural 20 — AI News in Real-Time The Bloomberg Terminal for AI](https://natural20.com/c/5lji2m)
  8. [OpenAI’s new reasoning technique alarms AI safety… AmmonNews](https://en.ammonnews.net/article/94883)
  9. [OpenAI Is About to Release Its First AI Model With ‘Critical Cyber Abilities’ WIRED](https://www.wired.com/story/openai-astra-first-ai-model-with-critical-cyber-abilities/)
AD
測試你的理解
Q1. OpenAI 新模型「Astra」所使用的核心推理技術是什麼?
  • 線性回歸
  • 循環深度(recurrent depth)
  • 量子運算
Astra 模型使用了擺脫傳統順序思考模式的「循環深度」這一全新推理技術。
Q2. 專家們對「循環深度」技術感到擔憂的最大原因是什麼?
  • 運算速度太慢
  • 因 AI 內部狀態的重處理導致監控變得複雜
  • 電力消耗太大
由於此技術會複雜地重新處理 AI 的內部狀態,因此從外部監控並理解 AI 做出結論的依據變得更加困難。
Q3. OpenAI 在開發 Astra 模型相關事項上採取過什麼措施?
  • 立即停止訓練並完全廢棄
  • 暫時中止訓練過程並制定額外的安全管控措施
  • 否認開發事實本身
OpenAI 曾將 Astra 及下一代模型的訓練暫停了數週,隨後在制定額外的安全與防護管控裝置後才重啟開發。