FOCUS全球新聞/OpenAI新模型會欺騙 不發布!輝達推「AI監管AI」機制

  • 編譯:孟心怡
  • 發佈時間:2026.09.29 20:00
  • 最後更新時間:2026.09.29 20:00
將網站加入你的 Google 偏好搜尋來源,更容易搜尋到喜歡的內容
(圖/達志影像美聯社)

(圖/達志影像美聯社)

OpenAI近日又發現,新模型在測試時出現高水準欺騙行為,以及做出超出原本指示的任務,OpenAI已經宣布,不會發布新模型。輝達則是推出最新的「AI監控AI的機制」,可以監控AI代理人採取的所有行動,防止它逃脫人類控制。微軟共同創辦人比爾蓋茲警告,AI有能力驅動導致10億人死亡的事件;教宗良十四世也表達憂慮,反對某些人說,AI威脅是假新聞的說法。

微軟共同創辦人比爾蓋茲警告,AI人工智慧的能力足以驅動,可能導致10億人死亡的事件。

微軟共同創辦人/慈善家 比爾蓋茲:「AI絕對有足夠的能力驅動事件,造成10億人死亡,雖然不敢說是100%,但沒有比不良意圖的人類,結合最新AI工具更強大的武器了。」

教宗良十四世也對AI發展提出警訊,反對某些人說AI威脅是假新聞的說法。

天主教教宗 良十四世 :「如果問我是不是處於恐慌狀態?不,我沒有,我晚上睡得著,但我確實認為,許多人工智慧專家和專業人士所提出的擔憂,應該被認真對待,我不認為如某些人所說:這是假新聞,或是為了謀取財富或其他利益。」

AI威脅的實際案例正在發生,OpenAI宣布出於安全考慮,不會發布最新的AI模型「GPT-6.1 Astra」,因為內部科學家對安全有疑慮,這個模型在測試階段,出現了高水準的欺騙行為,或有意誤導用戶採取特定行動;新模型也傾向於做超出原本指示的任務,而且不會返回查看指令。過去三個月,OpenAI已經兩度暫停新模型的訓練和測試;28日,佛州進一步向法院提出禁制令要求,禁止OpenAI在沒有外部監督下開發新的模型、限制未成年人使用 ChatGPT。如果佛州政府勝訴,其他州可能也會參考跟進。

紐約大學榮譽教授 Gary Marcus:「我覺得這太棒了,其他各州和其他國家也應該跟進,也就是說,在他們改善產品,確保安全,以及不再做出看起來像網路犯罪的事情之前,我認為人們有權要求,嘿,停下來,修正問題。」

周一,輝達也公布了最新的「AI監控AI的機制」,這是與100多家夥伴企業共同開發的「開放代理人安全平台」(Open Agent Safety Platform),可以監控AI代理人所採取的所有行動,防止它逃脫人類的控制。輝達反對政府監管,而是自行研發監控機制,專家認為OpenAI在安全上做得不夠好,或許輝達能幫上忙。

紐約大學榮譽教授 Gary Marcus:「我不確定它是否能100%解決,如果真能做到我會很驚訝。你知道的,網路安全的歷史一直有點像軍備競賽或是貓鼠遊戲,領先優勢總是此消彼長。但我確實認為他們聚焦在網路安全這方面是對的。」

輝達產品需求強勁,推升企業現金流,輝達28日宣布,在既有股票回購計畫上,增加1500億美元授權額度,讓尚未執行的回購授權總額,提高到2,350億美元。回購可以減少市場流通股數,有利於每股獲利,讓股東獲得回饋。輝達股價周一收盤上漲1.68%,來到228美元。

另一個AI巨頭Anthropic,則正在積極籌備首次IPO,這家成立了5年的人工智慧公司,去年儘管營收成長了12倍達到46億美金,但公布的淨虧損為420億,未來幾年Anthropic還將投入5180億美金在雲端設施和基礎建設上。

週二,川普在白宮召開與AI產業龍頭的高層會議,焦點將是如何在監管與AI發展間取得平衡。

輝達執行長 黃仁勳(2026.9.2):「最糟的結果是,沒有善加利用AI,而被時代甩在後頭,那是唯一最糟糕的結果,而這種結果是因為我們帶著恐懼與不確定性,來討論這項技術,領導階層帶著極大的疑慮與恐慌來談論它,以及所有對話都圍繞著安全與保障打轉。」

Anthropic和OpenAI等企業,主張更強的安全措施;輝達執行長黃仁勳則是認為無需恐懼,主張政府不要全面監管,立場與其他AI企業有所不同,因此他的態度也成為白宮會議的觀察焦點。


延伸閱讀