Anthropic推出Claude Opus 5.5,輸入與輸出價格較前一代Opus 5分別下調20%,一般工作成本則降低40%。
Anthropic於22日發布官方公告,宣布Opus 5.5是Claude 5.5系列的首款模型。模型指南顯示,Opus 5.5將在Claude與Claude Platform提供。
Anthropic表示,Opus 5.5在自動化行為測試中,展現截至目前測試模型中的最強表現,但也指出基準測試分數差異未必能完全反映實際工作效能。
價格方面,每100萬個輸入代幣收費4美元(約5500韓元),每100萬個輸出代幣收費20美元(約2.8萬韓元)。相較Opus 5的輸入5美元(約6880韓元)與輸出25美元(約3.44萬韓元),兩者均下調20%。
快取讀取費用為每100萬個代幣0.20美元(約275韓元),較原先的0.50美元(約688韓元)減少60%。快取讀取是重新利用先前儲存的上下文,可降低反覆處理長文件或延續相同工作流程時重新計算輸入內容的負擔。
Anthropic說明,在預設設定下,Opus 5.5的一般工作成本較Opus 5低40%,輸出生成速度也提升逾30%。Pro、Max與Team方案的5小時使用上限同步擴大。
效能測試顯示,Opus 5.5在程式設計、電腦操作與知識工作方面均有改善。在Terminal-Bench 4.0中,Opus 5.5得分66.4%,高於Fable 5.1的55.8%與Opus 5的52.3%。
在評估知識工作的GDPval-AA v2.1中,Opus 5.5取得1846分,Fable 5.1與Opus 5則分別為1735分與1708分。Anthropic表示,內部評估顯示Opus 5.5與Fable 5.1的實際工作差距小於基準測試數據,意味著基準測試優勢未必會在所有工作中轉化為相同幅度的效能差異。
在程式設計方面,Anthropic強調Opus 5.5處理大型程式碼庫的能力。該公司表示,早期測試者在一天內完成68萬行程式碼的移植工作,並在3小時內完成對20萬行程式碼庫的檢查與修正。
同樣是20萬行程式碼的工作,Opus 5則花費超過20小時。Anthropic表示,這反映新模型在連續執行多階段程式設計工作方面具備優勢。
安全機制方面,Opus 5.5採用與Fable 5.1相近的防護等級。Anthropic認為,Opus 5.5在生物學與網路安全領域可媲美Claude Mythos 5.1,因此將在相關領域採用額外防護措施。
生物科學驗證計畫目前開放申請,網路安全驗證計畫的存取權限則預計在數週內擴大。Anthropic另表示,Opus 5.5較前代減少使用專業術語,並將核心資訊放在句子前段;Sonnet 5.5與Haiku 5.5預計在未來數週內推出。
留言 0