AI的自主攻擊能力已跨越安全邊界。OpenAI與開源AI平台Hugging Face證實,上週發生一起前所未見的AI資安事件。OpenAI在內部進行資安能力評估時,旗下AI模型竟自主突破沙盒環境,並入侵Hugging Face部分生產基礎設施,試圖取得測試所需的資料。
OpenAI模型突破沙盒 入侵Hugging Face基礎設施
OpenAI表示,旗下AI模型上週在內部資安能力測試期間,突破原本的沙盒環境並入侵AI開發平台Hugging Face部分生產基礎設施。OpenAI指出,事件涉及GPT-5.6 Sol及一款尚未發布、能力更強的模型,測試時刻意降低模型拒答高風險資安操作的限制,因此被公司視為前所未有的AI資安事件。取得網路連線後,模型推測Hugging Face可能存有ExploitGym相關模型、資料集及測試解答,隨後透過竊取的憑證及零日漏洞等多重攻擊手法,成功找到可在Hugging Face伺服器上執行遠端程式碼的途徑。OpenAI資安團隊發現異常活動後,Hugging Face也偵測並阻止相關行動,雙方目前正合作進行調查及鑑識。
AI資安能力快速提升 防護措施面臨新挑戰
OpenAI表示,此次事件顯示,先進AI模型已具備執行複雜、多步驟資安操作的能力,即使沒有取得目標系統的原始碼,也可能自行發現並串聯新的攻擊路徑。公司將強化模型開發及測試環境的隔離、監控與存取控制,並在修補漏洞期間實施更嚴格的基礎設施管控。Hugging Face共同創辦人暨執行長Clem Delangue表示,此次事件可能是同類事件的首例,也證明AI安全無法由單一企業獨自解決,必須透過開放合作,讓全球資安防禦團隊都能廣泛運用AI能力,在攻擊者之前發現漏洞並提升防禦效率。
◤音樂劇魔女宅急便◢
◤你的早餐吃對了嗎?◢




