Anthropic於6月30日宣布,旗下AI模型Claude Fable 5已恢復向全球用戶提供服務,結束因美國出口管制而暫停近三週的限制。公司同時公布新版AI安全機制,並宣布將與亞馬遜(Amazon)、谷歌(Google)、微軟(Microsoft)及美國政府合作,建立AI越獄評估框架,希望推動AI產業建立一致的安全評估機制。
 隨著美國政府於6月30日解除相關限制,Fable 5自7月1日起重新開放全球用戶使用,涵蓋Claude.ai、Claude Platform、Claude Code及Claude Cowork等平台;Mythos 5則先恢復部分美國組織使用,後續將視政府核准情況逐步擴大開放。

新版分類器可攔截逾99%的相關越獄手法,若系統判定請求涉及高風險資安內容,將拒絕回應,並改由備用的 Claude Opus 4.8 處理。不過,Anthropic也坦言,新機制可能增加正常程式開發工作的誤判率,後續將持續調整。
 
此外,公司也表示,未來將深化與美國政府合作,包括模型上市前測試、資訊共享及AI安全研究,希望建立更完善的先進AI治理機制。
出口管制解除,Fable 5重新開放
Anthropic表示,美國政府於6月12日對Claude Fable 5及較低安全限制版本Claude Mythos 5實施出口管制,要求禁止外籍人士使用兩款模型。由於當時無法即時驗證使用者國籍,公司因此暫停所有用戶對兩款模型的存取權限。
更新安全分類器,降低越獄風險
Anthropic指出,此次出口管制起因於Amazon研究人員發現Fable 5可透過特殊提示繞過部分安全限制,取得部分軟體漏洞資訊,甚至產生漏洞利用示範程式碼。公司表示,相關能力並非Fable 5獨有,多款主流AI模型皆具備類似能力,但仍與美國政府合作更新安全分類器(Safety Classifier)。新版分類器可攔截逾99%的相關越獄手法,若系統判定請求涉及高風險資安內容,將拒絕回應,並改由備用的 Claude Opus 4.8 處理。不過,Anthropic也坦言,新機制可能增加正常程式開發工作的誤判率,後續將持續調整。
推動AI越獄評估標準
Anthropic同時宣布,將與亞馬遜、Google、微軟及其他合作夥伴共同制定AI越獄評估框架,未來將依能力提升幅度、適用範圍、武器化難易度及技術取得門檻等四項指標,評估越獄漏洞風險,協助產業建立一致的安全標準。此外,公司也表示,未來將深化與美國政府合作,包括模型上市前測試、資訊共享及AI安全研究,希望建立更完善的先進AI治理機制。
◤音樂劇魔女宅急便◢
◤你的早餐吃對了嗎?◢



