Anthropic公布AI發展量測框架 逾9成研發工作達「AI協作」程度

  • 記者黎怡涵責任編輯新聞中心
  • 發佈時間:2026.09.18 16:28
  • 最後更新時間:2026.09.18 16:28
將網站加入你的 Google 偏好搜尋來源,更容易搜尋到喜歡的內容
Anthropic揭露AI安全數據。(圖/Shutterstock達志影像)

Anthropic揭露AI安全數據。(圖/Shutterstock達志影像)

Anthropic公布一套用於追蹤前沿人工智慧(AI)發展速度的量測框架,從AI參與AI研發的程度、AI代理監督能力,以及運算資源分配3個面向,公開公司內部最新數據,讓外界更具體了解AI能力提升及安全防護是否同步。


AI已達至少「協作」程度的研發工作逾9成

Anthropic建立「AI研發自動化指數」,衡量Claude自動化公司AI研究及開發工作的程度。以0至5級的自動化程度計算,截至2026年8月,Claude尚未完全自主執行任何一類AI研發工作,但已能「主導」26%的AI研發工作,而達到至少「AI協作」程度的工作占比超過90%。

(圖/AI 生成)
Anthropic建立「AI研發自動化指數」,衡量Claude自動化公司AI研究及開發工作的程度。(圖/AI 生成)

Anthropic表示,AI開始協助開發下一代AI模型,若進一步形成「遞迴自我改進」,可能加快能力提升速度,也讓人類更難理解及控制系統,因此有必要持續公開相關指標。


約3萬AI代理接受監督

在AI代理監督方面,Anthropic表示,其最常用的內部平台目前約有3萬個AI代理同時進行研究及工程工作。所有代理行動都會經過即時監測系統,在執行前檢查危險操作;事後監測則負責找出可能需要進一步調查的異常行為。

Anthropic分析2026年8月超過10億次代理決策後發現,約0.002%遭即時監測系統攔截,相當於約4.7萬次中1次被阻擋。離線監測系統每週約標記10萬份對話紀錄,其中約50份會升級至人工審查。

此外,Anthropic表示,在其檢視的AI研發運算資源中,約6%用於安全工作;若只計算AI驅動AI研發所使用的運算資源,其中約12%分配給安全工作。

Anthropic指出,這些數據可讓政府、研究人員及社會更了解前沿AI的開發過程與安全監督是否跟得上。