
Anthropic 9月22日推出Claude Opus 5.5,作為Claude 5.5系列首款人工智慧(AI)模型,主打程式設計、電腦操作及知識工作能力,同時加強資安防護。Anthropic表示,Opus 5.5在多數工作上的表現與Claude Fable 5.1相當,但運行成本較上一代Opus 5降低40%。
強化AI代理安全防護
Anthropic指出,Opus 5.5在涵蓋近2000種模擬情境的自動化行為稽核中,表現優於近期Claude模型。在測試模型是否會突破限制方面,Opus 5.5試圖繞過測試環境邊界的次數,比Opus 5及Claude Mythos 5.1少約85%,且每次嘗試的嚴重程度都較低,並由模型主動回報。
Anthropic表示,Opus 5.5發布前接受Frontier Design及METR等外部機構的測試。由於模型具備較強的資安及生物學能力,公司也採用與Fable 5.1相近的防護措施,其中部分資安請求會轉交Opus 4.8處理;符合資格的生物及資安研究機構與專業人士,則可申請相關驗證計畫。
程式設計與知識工作提升
Anthropic表示,Opus 5.5特別適合處理大型程式碼遷移及稽核工作。早期測試者曾使用模型,在不到一天內完成68萬行程式碼遷移;另一項測試中,Opus 5.5在3小時內完成20萬行程式碼的檢查與修正,Opus 5則花費超過20小時。
在知識工作方面,Anthropic測試Opus 5.5、Fable 5.1及Opus 5撰寫企業財報分析報告,要求模型自行搜尋資料並核對數據與引述。18份Opus 5.5報告中有16份達到公司的品質標準,其他兩款模型則沒有任何一次達標。另一項模擬企業併購的測試中,Opus 5.5也能建立Excel財務模型及簡報,完成時間較Opus 5縮短約30分鐘,成本降低50%。
降低成本並加強防蒸餾
Opus 5.5每百萬輸入及輸出token分別收費4美元及20美元,快取讀取則為0.20美元;輸出速度也比Opus 5快逾30%。Anthropic同時提高部分付費方案的5小時使用上限,並新增可由訂閱用戶自行保存及使用的速率限制重設功能。
針對透過大量帳號擷取AI模型能力的「蒸餾(distillation)」攻擊,Opus 5.5延續Fable 5.1推出的preserved thinking機制,限制API使用者修改Claude先前的上下文,以降低透過此方式擷取模型推理能力的風險。Anthropic表示,Claude Sonnet 5.5及Haiku 5.5預計在未來幾週推出。