OpenAI員工曾警告資安不足 疑遭高層忽視

OpenAI資安問題遭員工示警。(圖/Shutterstock達志影像)
據《紐約時報》報導,OpenAI員工及資安研究人員曾多次警告公司,人工智慧(AI)模型測試及公司內部基礎設施存在安全漏洞,但相關疑慮未獲及時處理。報導指出,就在OpenAI的AI代理人失控事件爆發數個月前,已有員工向高層反映模型測試期間缺乏足夠監控,卻仍被要求加快測試流程,以確保新模型能如期發布。
員工示警測試風險 OpenAI仍要求加速開發
《紐約時報》取得的內部郵件顯示,至少2名OpenAI員工曾向高層主管表示,新一代AI模型在測試期間可能未受到適當監控,無法充分評估模型能力並確保安全。員工也曾詢問公司用於日常安全管理的軟體是否存在漏洞。
不過,OpenAI主管回應稱測試需要盡快進行,以配合模型發布時程。兩名員工表示,公司後續並未增加額外安全措施,相關問題也被擱置或處理速度過慢。
此後,OpenAI的AI模型曾突破測試環境,並攻擊AI新創公司Hugging Face及其他組織,引發外界對AI安全的關注。
外部研究員也曾發現內部資安漏洞
除了AI模型本身,獨立資安研究人員近幾個月也發現OpenAI內部系統存在漏洞,包括可能查看員工內部通訊、公司程式碼,甚至取得ChatGPT使用者聊天紀錄。
資安公司Hacktron研究人員表示,他們利用Anthropic開發的AI模型找到進入OpenAI系統的方法,並向公司通報。OpenAI資訊安全長Dane Stuckey當時質疑研究團隊的做法,之後則向對方道歉,公司並支付6500美元獎勵。
另外,Objective-See Foundation研究人員9月發現一項漏洞,可能讓攻擊者在遭入侵的設備上取得ChatGPT使用者完整私人聊天紀錄,還能在使用者不知情下暗中操作瀏覽器。研究人員表示,漏洞最初透過OpenAI的漏洞獎勵計畫通報,但直到直接聯絡公司內部人士後才被轉交工程團隊處理。OpenAI最終修復漏洞,並支付500美元獎勵。
AI代理人接連失控 OpenAI加強安全措施
《紐約時報》指出,Google、Meta及Anthropic近期也曾揭露旗下AI技術突破測試環境並自主攻擊其他電腦基礎設施,因此AI模型失控並非OpenAI獨有的問題。然而,OpenAI涉及的相關事件數量目前是已知最多,其中部分案例也被專家認為特別令人擔憂,使公司的資安處理方式受到更多檢視。
OpenAI發言人Drew Pusateri表示,公司重視安全,也會立即處理獨立研究人員通報的漏洞。他指出,隨著前沿AI模型能力提升,公司持續調整安全措施,同時承認仍需要加快速度。
近期OpenAI也暫停最先進AI模型的訓練,檢視模型出現的異常行為,並宣布因研究人員提出資安疑慮,暫緩發布最新AI模型GPT-6.1 Astra。