Anthropic推出Claude Sonnet 5.5 速度提升逾30%並強化資安防護

Anthropic推出Claude Sonnet 5.5。(圖/達志影像美聯社)
Anthropic宣布推出Claude Sonnet 5.5,成為Claude 5.5系列第二款模型,主打程式設計、知識工作及文件製作等日常任務。Anthropic表示,Sonnet 5.5輸出速度比上一代Sonnet 5快逾30%,在多數工作上,每項任務的運行成本最多降低30%,並首次針對提升的資安能力採用與Opus 5.5相近的防護措施。

效能與速度全面提升
Anthropic指出,Sonnet 5.5在多項測試中的表現較Sonnet 5提升,其中Terminal-Bench 4.0代理式程式設計測試得分從10.3%升至70.6%。在GDPval-AA實際工作評測中,Sonnet 5.5的成績也接近Claude Opus 5.5。Anthropic表示,模型在長時間、多步驟任務及圖片理解方面也有所改善,甚至成為首款僅根據遊戲截圖操作並完成Pokémon Red的Sonnet模型。
在程式設計方面,Sonnet 5.5在FrontierCode高強度模式下的得分,比Sonnet 5高10分,但每項任務成本約只有後者的十五分之一;在CursorBench測試中,最高成績也與Opus 5.5相差約2分。Anthropic表示,早期測試者也發現Sonnet 5.5能更快理解大型程式碼庫,並透過批次執行工具操作減少工作步驟。
文件、簡報與知識工作
Anthropic表示,Sonnet 5.5在知識工作方面同樣有所提升。公司以上市公司的季度財報資料、電話會議逐字稿及簡報模板進行測試,要求模型製作10頁營運報告,兩名專家認為模型首版內容已可直接使用。
Sonnet 5.5每百萬輸入token收費2美元、輸出token為10美元,快取讀取則為0.20美元,價格與Sonnet 5相同;但由於完成相同工作所需token較少,Anthropic測試顯示每項任務成本最多可降低30%。模型也提供不同努力程度設定,讓使用者在速度、成本與回答品質之間調整。
首次加強資安與防蒸餾
Anthropic指出,Sonnet 5.5在約1850種模擬情境的自動化行為稽核中,多數對齊、安全防濫用及誠實度指標均優於或相當於Sonnet 5。由於其資安能力大幅提升,Sonnet 5.5成為首款採用與Opus 5.5相近資安防護的Sonnet模型,高風險資安請求會轉交Sonnet 5處理。
此外,Sonnet 5.5也加入防止模型推理能力遭擷取的安全分類器,並擴大preserved thinking機制,以降低透過大量帳號提取模型能力的「蒸餾」風險。Claude Sonnet 5.5目前已可在AWS、Google Cloud、Microsoft Azure及Claude Platform使用。