長話短說
Claude Opus 5 在大多數基準測試中以代幣價格一半的價格擊敗了 Fable 5,是 Anthropic 迄今為止兼容性最好的模型
Anthropic 週四發布了 Cloud Opus 5, 該模型在大多數程式設計和認知工作標準方面與《神鬼寓言 5》的領先者相當或超過,而代幣價格卻只有一半。該型號是繼 6 月初的《神鬼寓言 5》、6 月底的《Sonnet 5》和 7 月 24 日的《Opus 5》之後,第四款 Anthropian 型號在不到兩個月的時間內上市。每百萬個輸入代碼的成本為 5 美元,每百萬個輸出代碼的成本為 25 美元,與其前身價格相同。
在 Frontier-Bench(一種衡量模型是否可以根據工程圖建立工作軟體的符號)上,Opus 5 的得分是其前身的兩倍,並擊敗了包括《神鬼寓言 5》在內的所有競爭模型。在測試新問題解決能力的 ARC-AGI 3 上,Opus 5 的得分比第二個最佳模型高出近三倍。在 Zapier AutomationBench(衡量模型是否能夠從頭到尾完成實際業務任務)中,Opus 5 即使在最低工作量設定下也比任何競爭對手通過了更多的任務。
Anthropic 表示,Opus 5 也是迄今為止最合規的型號,其自動安全審核中記錄的欺騙行為率最低。它的前身在 5 月底推出時為誠實設定了新標準,而 Opus 5 進一步推動了該標準,同時在進攻性網路安全任務中仍然落後於 Mythos 5。 Anthropic 表示,它有意避免訓練網路工作模型,但作為副作用,它改進了這些任務,使其整體能力更強。
該型號現已作為 Cloud Max 上的新預設模型和 Cloud Pro 上最強大的型號提供。開發人員可以透過應用程式介面 (API)、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 來存取它。快速模式以預設速度的 2.5 倍運行,基本速率翻倍,並且還包含兩個新的 API 功能:對話中工具更改,允許開發人員在不破壞提示快取的情況下切換工具,以及自動回退選項,將標記的請求定向到不同的表單而不是阻止它們。
發布的速度講述了有關人工智慧建模市場走向的更廣泛的故事。 Anthropic 從每季推出一款旗艦產品到大約八週內推出四種型號,每種型號在價格和性能方面針對不同的細分市場。 Opus 5 彌合了昂貴的 Fable 層和預算友好的 Sonnet 層之間的差距,為日常編程和知識工作帶來了近乎邊界的智能,而沒有限制 Fable 的網絡安全限製或 Mythos 的訪問限制。








