APAIIF 亞太人工智能產業總會APAIIFAI 知識庫
AI 最新科技

Anthropic Claude Opus 5 正式發佈:同等定價下性能媲美 Fable 5,ARC-AGI-3 評分三倍領先、85% 減少拒絕回應

2026年8月31日5 瀏覽
Anthropic Claude Opus 5 正式發佈:同等定價下性能媲美 Fable 5,ARC-AGI-3 評分三倍領先、85% 減少拒絕回應
Anthropic
Claude Opus 5
AI模型
大語言模型
企業AI

Anthropic Claude Opus 5 正式發佈:重新定義「近前沿」AI 模型的性價比標準

發佈概覽

2026年7月24日,Anthropic 正式發佈 Claude Opus 5,這是其繼 Claude Fable 5 之後推出的重要模型更新。Opus 5 被定位為「近前沿」(near-frontier)旗艦模型,其核心價值主張是:以與前代 Opus 4.8 完全相同的定價,提供在多項關鍵基準測試中媲美甚至超越 Claude Fable 5 的性能。

這一定位在 AI 模型市場中具有重要意義。在 OpenAI、Google 等競爭對手紛紛推出分層定價模型的背景下,Anthropic 選擇以「同等定價、更強性能」的策略,直接挑戰市場對「頂級性能必然伴隨高昂成本」的固有認知。

定價結構:與 Opus 4.8 完全相同

Claude Opus 5 的定價結構如下:

定價層級 輸入 Token 輸出 Token
標準定價 每百萬 5 美元 每百萬 25 美元
快速模式 每百萬 10 美元 每百萬 50 美元

快速模式提供約 2.5 倍的標準速度,適合對延遲敏感的應用場景。值得注意的是,這一定價與 Opus 4.8 完全相同,意味著現有 Opus 4.8 用戶可以在不增加預算的情況下直接升級到更強大的模型。

技術規格:百萬 Token 上下文窗口

Claude Opus 5 的技術規格在業界處於領先水平:

  • 上下文窗口:支援 100萬 Token 的超長上下文,可處理整個代碼庫、長篇法律文件或複雜研究報告
  • 標準輸出限制:128K Token
  • 擴展輸出:透過 Message Batches API 可擴展至 300K Token
  • 自適應思考:支援可調節的推理深度(低、中、高三檔),允許用戶根據任務複雜度和成本預算靈活選擇

基準測試表現:多項指標三倍領先

ARC-AGI-3:通用推理能力的重大突破

在衡量 AI 系統通用推理能力的 ARC-AGI-3 基準測試中,Claude Opus 5 的評分三倍領先於次優模型。這一成績尤為引人注目,因為 ARC-AGI-3 被設計為難以透過記憶訓練數據來「作弊」的測試,真正考驗模型的新問題解決能力。

CursorBench 3.2:編程能力接近 Fable 5

在 CursorBench 3.2 編程評估中,Opus 5 的表現與 Fable 5 的峰值評分相差不超過 0.5%,同時保持顯著更高的成本效益。這意味著對於大多數編程任務,Opus 5 提供了與 Fable 5 幾乎相同的能力,但成本更低。

Frontier-Bench v0.1:代理工作流程性能倍增

在 Frontier-Bench v0.1 評估中,Opus 5 的性能超過 Opus 4.8 的兩倍,顯示出在代理工作流程和複雜任務執行方面的顯著進步。

科學研究能力:有機化學、結構生物學、蛋白質功能預測

Claude Opus 5 是 Anthropic 目前最強大的科學研究模型,在以下領域展現出持續優於 Opus 4.8 的能力:

  • 有機化學:分子結構分析、反應機制預測、合成路徑規劃
  • 結構生物學:蛋白質結構預測、分子對接分析
  • 蛋白質功能預測:基於序列和結構的功能推斷

這些能力使 Opus 5 成為製藥研究、生物技術和材料科學領域的重要工具。

視覺輸出能力:互動式 3D 插圖與動畫

Opus 5 在視覺輸出方面也有顯著提升,能夠生成:

  • 互動式 3D 插圖:可在瀏覽器中直接交互的三維視覺化
  • 動畫效果:動態數據可視化和演示動畫
  • 複雜數據可視化:多維度數據的直觀呈現

這些能力對於需要製作技術報告、科學論文插圖或商業演示的用戶尤為有價值。

安全與對齊:最低欺騙行為率

85% 減少拒絕回應

Opus 5 採用比 Fable 5 更寬鬆的安全分類器,導致拒絕回應率降低約 85%。這一改變反映了 Anthropic 在安全性與實用性之間取得更好平衡的努力——減少不必要的過度謹慎,同時保持對真正有害內容的防護。

最低欺騙行為率

在自動化行為審計中,Opus 5 展現出 Anthropic 迄今最低的欺騙行為率,是其最符合對齊目標的模型。

無數據保留要求

與 Fable 5 不同,Opus 5 沒有數據保留要求,使其成為隱私敏感企業環境的首選模型。這對於金融服務、醫療健康、法律服務等需要嚴格數據保護的行業尤為重要。

可用性:Claude Max 和 Claude Pro 的預設模型

Claude Opus 5 現已成為:

  • Claude Max 訂閱用戶的預設模型
  • Claude Pro 訂閱用戶可使用的最強模型
  • 透過 Claude API 以 claude-opus-5 標識符訪問

市場影響:重新定義性價比標準

Claude Opus 5 的發佈對 AI 模型市場產生了深遠影響。在 OpenAI 推出 GPT-5.6 Sol/Terra/Luna 分層定價體系、Google 推出 Gemini 3.6 Flash 的同期,Anthropic 選擇以「同等定價、更強性能」的策略,向市場傳遞了一個清晰信號:AI 模型的性能提升不必然伴隨成本上升。

對於亞太地區的企業用戶而言,Opus 5 的無數據保留要求和更低的拒絕回應率,使其在合規要求嚴格的市場(如日本、新加坡、香港)中具有特別的吸引力。

結語

Claude Opus 5 代表了 Anthropic 在「效率優先」模型設計理念上的重要里程碑。透過在不提高定價的前提下大幅提升性能,Anthropic 不僅為現有用戶提供了即時的價值提升,也向整個行業展示了 AI 模型發展的另一條路徑:不是更大、更貴,而是更智能、更高效。


資料來源:Anthropic 官方新聞、CoderSera、BenchLM、Coursiv

常見問題

相關文章