AI 竟能直接控制我的電腦?OpenAI 新模型「GPT-6 Astra」即將帶來的變革

象徵最新 AI 技術的抽象數位網絡影像
AI Summary

OpenAI 所推出的 GPT-6 Astra 是一款具備卓越電腦操作能力與高安全性的模型,在軟體開發與科學研究等專業領域中展現出極強的效能。

試著想像一下:忙碌的早晨,你只需要跟 AI 助理說一聲:「幫我整理下午會議所需的資料,並在預約時間分享出去。」無需你親自坐在電腦前開啟視窗、搜尋資料、存檔,AI 就能自主操作電腦並完成工作。2026 年 9 月 3 日,OpenAI 正式發表了具備這種自主操作電腦、執行複雜任務能力的次世代 AI 模型——GPT-6 Astra [Source 5, Source 10, Source 12]。

為什麼這很重要?

過去的 AI 主要扮演「諮詢顧問」的角色,針對人類輸入的問題進行回答或撰寫文字。然而,GPT-6 Astra 完全不同。這是一款具備「行動力」的模型,它能獨立解決軟體工程、科學研究,甚至透過網頁瀏覽完成日常工作 [Source 13]。

簡單來說,如果原本的 AI 只是在圖書館幫你找書並摘要內容,那麼 GPT-6 Astra 的能力則是能直接登入圖書館電腦、存取所需的資料庫,甚至將數據整理成報告檔案並儲存起來。在實測中,這款 AI 執行預約監理站(DMV)服務、搜尋求職資訊或查找租屋物件的速度,都超越了普通人 [Source 14]。這不僅是資訊檢索的提升,更意味著 AI 正在演化為能代表我們在數位世界中執行實質業務的「代理人(Agent,即能自主達成目標的 AI)」。

特別是 OpenAI 將此模型在網路安全領域歸類為「關鍵(Critical)」等級,並自豪地表示,這是迄今為止所推出最安全、且對齊(Alignment,即 AI 目標與人類價值一致)做得最完善的模型 [Source 5, Source 14]。

AI 拿起了工具箱

若將 GPT-6 Astra 比喻為一名剛完成寫作訓練的學生,現在 OpenAI 正給它一個裝滿「電腦軟體」的工具箱。過去需要我們逐一指令的工作,現在 AI 能自主選擇並組合工具來產出結果。

事實上,該模型在程式碼審查評估中達到了約 61.3% 的驚人 Bug 檢測率,超越了前代強大模型 GPT-5.6 Sol(59.0%)與 Opus 5(50.2%)的成績 [Source 3]。這代表我們能期待它如同身邊有一位非常細心的資深工程師,協助檢核每一行程式碼,成為我們工作上實質且強大的「聰明同事」。

現狀:誰可以使用?

遺憾的是,目前無法直接使用 GPT-6 Astra。OpenAI 正透過名為「Daybreak」的計劃,優先將存取權限提供給經過審核的防禦者(vetted defenders),並計劃在未來幾週內透過「Daybreak Blue」擴大使用範圍 [Source 6]。

其效能評價極為出色。該模型在「ExploitBench」創下 100% 的驚人滿分,在「FrontierMath」第四階段評估中達成 98%,並在「ARC-AGI-3」基準測試中達到 99.9%,確實重新定義了頂尖 AI 的標準 [Source 13]。不過,其使用價格訂為每 100 萬 Token 約 10 至 50 美元 [Source 10]。部分分析指出,儘管價格高於舊款模型,但其溢價並非僅來自效能,而是源於「可信賴的準確性」與「高效的 Token 管理」 [Source 11]。

未來會如何發展?

GPT-6 Astra 的出現,宣告了單純生成文字的 AI 時代已經過去,人類正式進入 AI 利用各類工具提升實質生產力的時代。正如 YouTube 影片製作過程中,從企劃、撰稿到運用剪輯軟體,AI 能全程獨自執行案例的出現 [Source 8],未來我們的作業方式將從「該如何處理」快速轉向思考「該讓 AI 做些什麼」的方向。

OpenAI 不僅強調其基準測試成績,更強調它是「最安全的模型」。期待這款聰明的 AI 在未來正式向大眾開放時,能如何在我們日常生活中安全且實用地發揮影響力。


MindTickleBytes 的 AI 記者觀點 GPT-6 Astra 展現了 AI 已不再只是知識儲存庫,而是開始化身為能推動實質世界的「手與腳」。AI 能直接控制電腦意味著強大的權力,因此未來這項技術的成敗,將不僅取決於 AI 的「智慧」,更取決於它「被控制得有多安全」。

參考資料

  1. [AskHN: Initial Thoughts on GPT-6 Astra? Hacker News](https://news.ycombinator.com/item?id=49571621)
  2. GPT-6 Astra review: code review gains, privacy, and cost
  3. GPT-6 Steers Its Own Reasoning. OpenAI Can’t Say Why. - YouTube
  4. OpenAI launches GPT-6 Astra and says welcome to… - The New Stack
  5. [Benchmarking GPT-6 Astra Artificial Analysis](https://artificialanalysis.ai/articles/benchmarking-gpt-6-astra)
  6. GPT-6 Astra создала это видео целиком - YouTube
  7. GPT-6 Astra vs Claude Fable 5.1: Same $10/$50, 61 vs 66
  8. [How to Use GPT-6 Astra: 12 Steps, $10/M Tokens [2026] Tech Insider](https://tech-insider.org/au/how-to-use-gpt-6-astra-2026/)
  9. GPT-6 Astra vs GPT-5.6 Sol: is 2.5x the price worth it?
  10. GPT-6 Astra Scores 100% on ExploitBench as OpenAI Blocks PoC…
  11. [GPT-6 Astra Is Here—and OpenAI Thinks It May Kick Off the… WIRED](https://www.wired.com/story/openai-says-gpt-6-can-use-a-computer-better-than-a-human/)
  12. [OpenAI officially launches GPT-6 Astra: How to try it Mashable](https://mashable.com/tech/openai-gpt-6-astra-launch-pricing-safety-benchmarks)
AD
測試你的理解
Q1. GPT-6 Astra 在哪個領域展現出最卓越的成果?
  • 創意寫作
  • 電腦操作與軟體工程
  • 簡單重複計算
GPT-6 Astra 在電腦操作、網頁瀏覽、軟體工程等複雜專業任務中展現出頂尖水準的效能。
Q2. GPT-6 Astra 的安全等級是如何分類的?
  • 一般
  • 危險
  • 關鍵 (Critical)
OpenAI 將 GPT-6 Astra 在網路安全領域歸類為「關鍵 (Critical)」等級。
Q3. 目前誰能最先使用 GPT-6 Astra?
  • 所有一般使用者
  • 經過審核的防禦者 (vetted defenders)
  • 僅限企業客戶
初期存取權限透過 Daybreak 計劃,限制提供給經過審核的防禦者。