教導 AI 的人也用了 AI?OpenAI 「人類培訓生」解僱事件

一名在電腦螢幕前煩惱的人,以及背後浮現的人工智慧神經網路圖形
AI Summary

基於 OpenAI 對於訓練模型精確度需「人類判斷」的原則,因使用 AI 工具提交工作成果的簽約員工遭到解僱。

想像一下。你是為了提升人工智慧(AI)實力,負責細心審核最先進模型產出的回答並進行評分的「AI 訓練師(AI 教育專家)」。你的目標是幫助 AI 像人類一樣思考,並給出更精確的回答。然而,如果你為了更有效率地處理工作,稍微藉助了其他 AI 工具的幫助,會發生什麼事呢?

最近有消息指出,負責訓練 OpenAI 模型的幾名簽約員工,正因為這個問題而丟了工作。OpenAI AI 訓練師因使用 AI 訓練 AI 而被解僱 這則新聞展現了積極鼓勵將 AI 作為工作工具的 OpenAI 哲學,與其內部實施的嚴格禁止規定之間那種奇妙的衝突。

為什麼這很重要?

此次事件在「數據勞動」的未來以及 AI 的信賴度問題這兩個層面上至關重要。

首先,它展現了我們所使用的 ChatGPT 等對話式 AI 服務,究竟是經過多少「真人」之手進行潤飾。許多人以為 AI 會自動變聰明,但實際上其背後存在著無數人的評估與校正工作。人工智慧訓練的重要性 然而,如果在過程中為了效率而讓 AI 訓練 AI,那麼我們所信任並使用的 AI,恐將淪為「機器製造的機器」,引發了大眾的憂慮。

其次,它揭露了勞動現場對於運用 AI 工具的矛盾。OpenAI 對外大聲疾呼:「請使用 AI 來提升工作生產力。」但在優化自身 AI 模型的重要職務中,卻嚴格禁止使用 AI。OpenAI 的諷刺之處 這反諷地證明了,雖然 AI 作為人類的輔助工具非常出色,但在驗證 AI 的最後階段,「人類獨有的直覺」依然是不可或缺的現實。

輕鬆理解:為什麼不能讓 AI 使用 AI?

讓我們用一個非常簡單的比喻來說明吧。

簡單來說,想像一個「濾鏡太多的相片應用程式」。 假設我們在拍照時,依序套用了 1 號濾鏡、2 號濾鏡、3 號濾鏡。如果在 1 號濾鏡階段,原始色彩產生了些許扭曲,而 2 號濾鏡將那種扭曲誤認為「原圖特徵」並加以強化,最後 3 號濾鏡再將它進一步放大,那麼最後拍出來的照片將會變成一個與原圖截然不同的怪異模樣。

AI 訓練也是一樣的道理。 OpenAI 聘用人類培訓生的目的,是為了用「人類的語言感官」來判斷 AI 寫出的文字在人類眼中是否自然,事實關係是否有誤。AI 訓練工作指南 然而,如果培訓生將評估工作外包給 AI(這稱為「遞迴訓練」),AI 模型將會反覆學習其他 AI 產出的結果,而非人類的思考方式。OpenAI 強制執行人類專用規則的原因 結果就是 AI 特有的邏輯錯誤將會更加深植,模型精確度反而會下降。

負責執行 OpenAI 專案的人工智慧訓練專業公司「Mercor」,為了防範此類風險,明確在合約中加入了禁止使用 AI 工具的條款。Mercor 的合約條件

當前情況:進展到哪一步了?

目前 OpenAI 為了維持模型的精確度,嚴格堅持「僅限人類」的訓練原則。OpenAI 的嚴格規則 相關行業從業人員一致表示,這類 AI 訓練職務正在形成一個全新的勞動市場。人工智慧訓練職業的崛起

然而,隨著技術發展速度加快,部分人士認為試圖提高這種「數據勞動」效率的嘗試依然層出不窮。此次被查獲的簽約員工,若使用 AI 工具,原本也確實能夠更快地回答並評估海量的問題。但對於 OpenAI 而言,這種「快速產出的工作成果」是不值得信任的,換句話說,就如同會蠶食 AI 效能的毒蘋果。

未來會如何發展?

AI 企業將會持續要求更龐大的數據,同時也需要更多人來審核這些數據。累積 AI 訓練經歷

未來我們值得關注的點有二。 第一,人類評估 AI 生成結果的過程本身是否能夠自動化?從 OpenAI 的案例看來,短期內恐怕很難。由「唯有人類能做的審核」所帶來的價值將會進一步提升。 第二,關於數據勞動的待遇與管理體系將會變得更加精細。未來極有可能超越單純「禁止使用 AI」的規則,創造出一種人類與 AI 既能協作、又能守護模型信賴度的新型工作流程。

AI 時代真正的能力,或許不僅在於「如何聰明地使用 AI」,更在於具備能夠知曉「何時該關掉 AI,改用人類大腦進行判斷」的洞察力。

參考資料

  1. People Training OpenAI’s AI Fired for Using AI to Train the AI
  2. OpenAI contractors were reportedly fired for using AI to train ChatGPT; here’s how they got caught
  3. OpenAI Is Firing Contractors for Using AI to Train its AI - Gadget Review
  4. NYT says OpenAI committed ‘theft of unprecedented… - TRT World
  5. The profession of ‘training’ AI- Tay Ninh Online Newspaper
  6. [AI Training Jobs — Earn $15-$100+/hr from Home Mindrift Remote…](https://mindrift.ai/)
  7. [AI Training to Grow Your Career Google](https://grow.google/ai)
  8. People Training OpenAI’s AI Fired for Using AI to Train the AI
  9. Google News - OpenAI - Latest
  10. AI Training Data Controversy Hits Microsoft and OpenAI Lawsuit
  11. He Helped Build Powerful AI at OpenAI and Anthropic … - TIME
AD
測試你的理解
Q1. OpenAI 對簽約員工堅持「禁止使用 AI 工具」原則的原因為何?
  • 為了節省成本
  • 若使用 AI 生成的數據再次訓練 AI,可能會降低模型精確度
  • 為了規避版權問題
如果重複使用 AI 生成的數據來訓練 AI(即「遞迴訓練」),模型精確度可能會下降,因此僅允許人類審核。
Q2. 此次被解僱的員工是與誰簽訂合約的?
  • 與 OpenAI 直接簽訂僱傭合約
  • 隸屬於負責 OpenAI 專案的人工智慧訓練專業公司『Mercor』
  • Google AI 培訓計畫結業生
被解僱的人員並非直接與 OpenAI 簽約,而是隸屬於執行 OpenAI 專案的人工智慧訓練專業公司「Mercor」的簽約員工。
Q3. 大眾對此事件感到諷刺的點是什麼?
  • AI 訓練費太過昂貴
  • OpenAI 鼓勵人們在工作中利用 AI,卻禁止 AI 訓練人員使用 AI
  • 被解僱的員工表現比 ChatGPT 還好
OpenAI 鼓勵全球大眾在工作中使用 AI,卻禁止負責提升 AI 效能的訓練人員使用,這種做法被評價為相當矛盾。