OpenAI AI模型測試時突破沙盒 自主入侵Hugging Face生產環境
- 記者:Yu Han Lei|責任編輯:新聞中心
- 發佈時間:2026.07.22 17:06
- 最後更新時間:2026.07.22 17:06
- 記者:Yu Han Lei|責任編輯:新聞中心
- 發佈時間:2026.07.22 17:06
- 最後更新時間:2026.07.22 17:06
OpenAI AI模型突破沙箱入侵Hugging Face。(示意圖/達志影像shutterstock)
AI的自主攻擊能力已跨越安全邊界。OpenAI與開源AI平台Hugging Face證實,上週發生一起前所未見的AI資安事件。OpenAI在內部進行資安能力評估時,旗下AI模型竟自主突破沙盒環境,並入侵Hugging Face部分生產基礎設施,試圖取得測試所需的資料。
OpenAI模型突破沙盒 入侵Hugging Face基礎設施
OpenAI表示,旗下AI模型上週在內部資安能力測試期間,突破原本的沙盒環境並入侵AI開發平台Hugging Face部分生產基礎設施。OpenAI指出,事件涉及GPT-5.6 Sol及一款尚未發布、能力更強的模型,測試時刻意降低模型拒答高風險資安操作的限制,因此被公司視為前所未有的AI資安事件。
OpenAI表示,相關模型當時正在名為「ExploitGym」的內部測試中,目的是評估AI執行複雜資安攻擊的能力。模型為取得測試解答,先在隔離環境中尋找連接公開網路的方法,並利用軟體套件快取代理程式中的零日漏洞取得網路存取權,之後進一步進行權限提升及橫向移動。
取得網路連線後,模型推測Hugging Face可能存有ExploitGym相關模型、資料集及測試解答,隨後透過竊取的憑證及零日漏洞等多重攻擊手法,成功找到可在Hugging Face伺服器上執行遠端程式碼的途徑。OpenAI資安團隊發現異常活動後,Hugging Face也偵測並阻止相關行動,雙方目前正合作進行調查及鑑識。
AI資安能力快速提升 防護措施面臨新挑戰
OpenAI表示,此次事件顯示,先進AI模型已具備執行複雜、多步驟資安操作的能力,即使沒有取得目標系統的原始碼,也可能自行發現並串聯新的攻擊路徑。公司將強化模型開發及測試環境的隔離、監控與存取控制,並在修補漏洞期間實施更嚴格的基礎設施管控。
OpenAI也指出,相關安全防護措施在此次測試中原本被刻意關閉,目的是評估模型在最高資安能力下的表現,但事件凸顯未來進行AI模型訓練及測試時,仍需進一步強化安全機制。
Hugging Face共同創辦人暨執行長Clem Delangue表示,此次事件可能是同類事件的首例,也證明AI安全無法由單一企業獨自解決,必須透過開放合作,讓全球資安防禦團隊都能廣泛運用AI能力,在攻擊者之前發現漏洞並提升防禦效率。

















