Anthropic於今天凌晨正式推出了 Claude Opus 5 。官方稱其為“深思熟慮且主動”的模型,它的智能水平接近 Claude Fable 5 的前沿能力,價格卻只有後者一半。

在編程與知識工作評測中,Opus 5 成為新的SOTA(state-of-the-art),但在網絡安全任務上仍落後於 Mythos 5。該模型即日起成為 Claude Max 默認模型,也是 Claude Pro 最強模型。
成本上,Opus 5 與 Opus 4.8 定價相同但性能大增:Frontier-Bench v0.1 超越所有模型,單位成本更低且性能超前者兩倍以上;CursorBench 3.2 最高算力檔得分與 Fable 5 僅差 0.5%,成本僅一半。ARC-AGI 3 得分是次優模型三倍,OSWorld 2.0 以約三分之一成本超越 Fable 5 最佳成績。科研上其在生命科學評測全面優於 Opus 4.8,有機化學、蛋白質任務分別高出 10.2 和 7.7 個百分點。

安全層面,Opus 5 是 Anthropic 迄今對齊程度最高、最安全的模型,危險雙用途能力未推進前沿,生物學與進攻性網絡安全仍落後 Mythos 5;其網絡分類器較 Fable 5 寬鬆,允許查漏洞但禁二進制掃描與漏洞利用生成。
定價上,Opus 5 輸入每百萬 token 5 美元、輸出 25 美元,與 Opus 4.8 一致,另提供約 2.5 倍速的 Fast 模式。
隨着新模型的推出,Anthropic 同步推出兩項測試功能:一是 Claude Platform 上的對話中途切換工具,開發者可在不使提示詞緩存(prompt cache)失效的情況下,於對話進行中更改 Claude 可調用的工具;二是 API自動回退,當 Opus 5(或 Fable 5)上被安全分類器標記的請求,可自動路由至另一模型而非直接阻斷,開啓後 API 請求默認始終路由至當前最優可用模型。