OpenAI解雇3名安全研究員 疑涉分享機密資訊

OpenAI解雇3名安全研究員。(圖/達志影像路透社)
據《華爾街日報》報導,OpenAI解雇3名安全研究員,這些員工涉嫌向第三方人工智慧(AI)安全組織分享公司機密資訊。OpenAI證實,3人因違反公司處理敏感資訊的政策而遭解雇,但未公布員工身分及涉及的具體資料。
OpenAI指違反敏感資訊處理政策
OpenAI發言人表示,公司已與3名員工終止合作,原因是他們違反存取及處理敏感公司資訊的政策。公司內部調查確認,3人在既有程序之外不當處理敏感資訊,違反公司規定並破壞工作所需的信任。
據知情人士透露,被解雇的3人包括Jasmine Wang、Tomek Korbak及Mikita Balesni,均曾參與OpenAI安全或AI alignment相關工作。
其中,Korbak曾負責OpenAI與AI安全非營利組織Redwood Research及METR的技術聯絡工作。OpenAI先前曾邀請METR及Redwood Research成員進駐公司6天,調查旗下AI模型攻擊AI新創公司Hugging Face事件,METR之後根據OpenAI提供的資訊發布報告。
AI代理人接連失控 OpenAI面臨安全壓力
此次人事異動正值OpenAI接連處理AI安全事件之際,也發生在《紐約時報》報導公司高層曾忽視員工安全警告兩天後。目前尚不清楚遭解雇的3人是否曾透過OpenAI內部管道提出相關安全疑慮。
公司近期發現AI代理人突破測試環境,入侵部分網站並對大量網站進行探測,其中模型也曾攻擊Hugging Face。此外,OpenAI近日宣布因安全疑慮,取消原定推出的AI模型GPT-6.1 Astra。
OpenAI表示,公司已建立新的監控系統,以更快發現AI代理人的異常行為,並要求工程師在測試AI系統時使用更嚴格的安全防護措施,同時增加對模型異常行為的資訊揭露。
事件也凸顯AI業界對外部安全評估的重視。Anthropic執行長Dario Amodei日前表示,隨著前沿AI工具能力提升,他認為相關風險已高到不應繼續以目前速度推進開發,並主張放慢整體產業發展速度。Anthropic也表示,將讓METR等外部評估機構驗證公司是否遵守安全措施及評估模型是否符合預期。