會欺瞞人類!OpenAI取消10月發表新模型GPT-6.1 Astra

  • 責任編輯:楊日欣
  • 發佈時間:2026.09.29 09:37
  • 最後更新時間:2026.09.29 09:37
將網站加入你的 Google 偏好搜尋來源,更容易搜尋到喜歡的內容
OpenAI因研究人員在內部測試中發現安全疑慮,決定取消原定於10月亮相的次世代人工智慧(AI)模型GPT-6.1 Astra發表計畫。(示意圖/Shutterstock達志影像)

OpenAI因研究人員在內部測試中發現安全疑慮,決定取消原定於10月亮相的次世代人工智慧(AI)模型GPT-6.1 Astra發表計畫。(示意圖/Shutterstock達志影像)

「華爾街日報」今天報導,OpenAI因研究人員在內部測試中發現安全疑慮,決定取消原定於10月亮相的次世代人工智慧(AI)模型GPT-6.1 Astra發表計畫。

華爾街日報(The Wall Street Journal)報導指出,這款模型原預計應用於ChatGPT與Codex,設計目的是讓AI能在無需人類協助下處理更複雜的任務。

近幾個月來,業界陸續傳出AI系統失控的報告;OpenAI這次因安全疑慮取消新模型發表,在大型AI開發商中相當罕見。

OpenAI接下來將把重心放在提升未來模型的安全性,並預期未來模型的能力將更為強大。

OpenAI負責安全的主管詹恩(Saachi Jain)今天告訴「華爾街日報」,Astra在評估系統是否能遵循人類意圖的測試中,未符合公司標準。

報導指出,Astra顯示出比前一代更高的欺瞞行為,包括有時未能如實揭露自己已進行或未執行的操作。

此外,Astra在「範圍授權」方面也出現問題,會在未請求用戶許可的情況下繼續執行任務,有時甚至會在可能存在風險時,嘗試使用外部工具或服務。

這項決定是在OpenAI即將於美國加州舊金山(San Francisco)舉行開發者大會前作出的。

OpenAI上週才表示,由於某個AI代理人突破網路限制並查詢公開聊天機器人,公司已暫停訓練能力最強的AI模型。不過,OpenAI表示,GPT-6.1 Astra並非這批模型,而是另一個案例。

OpenAI表示正調查近幾個月發現的多起AI代理人安全事件,並已導入新的監控系統,以更快發現AI代理人的異常行為,同時要求工程師在測試系統時採用更嚴格的安全防護措施。

路透社報導,本月稍早,Anthropic執行長阿莫戴(Dario Amodei)呼籲業界放慢先進AI模型的開發腳步,讓安全措施得以跟上;他的觀點獲得OpenAI執行長阿特曼(Sam Altman)及太空探索科技公司(SpaceX)執行長馬斯克(Elon Musk)的支持。

OpenAI未立即回應路透社的置評請求。

儘管決定不按原計畫推出Astra,OpenAI仍希望以相同基礎模型進行更多強化學習,並用於打造後續GPT-6系列模型。(中央社)

延伸閱讀