APAIIF 亞太人工智能產業總會APAIIFAI 知識庫
AI 最新科技

Anthropic Claude Fable 5.1 正式發佈:快取讀取成本降75%、Terminal-Bench-Science評分翻倍,代理工作流程成本節省達45%

2026年9月2日4 瀏覽
Anthropic Claude Fable 5.1 正式發佈:快取讀取成本降75%、Terminal-Bench-Science評分翻倍,代理工作流程成本節省達45%
Claude
Anthropic
AI模型
代理工作流程
成本優化

Anthropic Claude Fable 5.1 正式發佈:快取讀取成本降75%、Terminal-Bench-Science評分翻倍,代理工作流程成本節省達45%

引言

2026年9月1日,Anthropic 正式發佈 Claude Fable 5.1,這是繼 Fable 5 之後的重要增量更新。雖然定價維持不變,但75%的快取讀取成本削減使典型工作負載成本降低約25%,代理密集型任務更可節省高達45%。與此同時,Terminal-Bench-Science 評測分數從24.7分躍升至52.6分,超過一倍的提升令業界矚目。

核心更新詳解

定價與成本效益

Claude Fable 5.1 的輸入輸出定價維持不變:

  • 輸入:每百萬 Token 10美元
  • 輸出:每百萬 Token 50美元
  • 批次API:輸入5美元/輸出25美元(每百萬Token)

重大變化在於快取讀取成本:從每百萬Token 1.00美元大幅降至 0.25美元,降幅達75%。

Anthropic 估計,這一變化對不同工作負載的影響如下:

  • 典型工作負載:成本降低約25%
  • 代理密集型任務(高上下文、多步驟):成本降低高達45%

對於大量使用提示快取的企業用戶而言,這是一次實質性的成本優化。

性能基準測試

Fable 5.1 在所有主要基準測試中均超越前代 Fable 5,其中最引人注目的是:

Terminal-Bench-Science:52.6分 vs 24.7分(前代),提升超過一倍

這一評測衡量模型在科學推理和終端操作方面的能力,對於需要複雜科學計算和代碼執行的代理工作流程尤為重要。

技術規格

  • 上下文窗口:100萬 Token
  • 最大輸出:128,000 Token
  • 自適應思考:支持可調節的努力等級(lowmediumhighxhighmax
    • Claude Code 默認:high
    • claude.ai 默認:medium

安全分類器改進

Anthropic 實施了更精確的網絡安全和生物學分類器:

  • 網絡安全干預:每次 Claude Code 會話減少約60%
  • 良性生物學問題誤報:減少85%

這意味著合法的安全研究和生物科學工作將受到更少的不必要阻礙。

Mythos 5.1:受限版本

與 Fable 5.1 同步發佈的還有 Claude Mythos 5.1(claude-mythos-5-1),兩者共享相同的模型權重,但 Mythos 5.1 具有更寬鬆的安全護欄,僅向通過「網絡驗證計劃」和「生命科學驗證計劃」審核的組織開放。

三大破壞性API變更

Fable 5.1 引入了三項重要的破壞性變更,現有用戶需注意:

1. 強制工具使用限制

使用 tool_choice 強制指定特定工具或「任意」工具的請求現在將返回400錯誤;僅支持 autonone

2. 思考塊可移植性

Fable 5.1 生成的思考塊無法被舊版模型讀取。在會話中途回退到舊版模型將導致推理上下文丟失。

3. 上下文編輯限制

對於2026年8月31日或之後創建的API帳戶,修改系統提示或對話中較早的消息將使後續思考塊失效,導致400錯誤。

企業前沿安全護欄(EFS)

為應對合規需求,Anthropic 推出「企業前沿安全護欄」(Enterprise Frontier Safeguards,EFS),允許在維持安全監控的同時實現零數據保留。此功能將從2026年秋季開始分階段推出,符合條件的客戶可申請臨時零保留選項。

可用性

Claude Fable 5.1 現已通過以下渠道提供:

  • Claude API(claude-fable-5-1
  • Amazon Bedrock
  • Google Cloud
  • Microsoft Foundry
  • AWS 上的 Claude Platform

對亞太地區開發者和企業的影響

成本優化機會

對於亞太地區大量使用 Claude API 的企業,75%的快取讀取成本削減提供了顯著的優化空間。特別是:

  • 客服自動化:大量重複使用系統提示的場景
  • 文件分析:需要長上下文的法律、金融文件處理
  • 代碼審查:持續的代碼庫上下文維護

遷移注意事項

亞太地區的開發者在遷移至 Fable 5.1 時,需特別注意三項破壞性變更,尤其是工具使用API的調整,可能影響現有的代理工作流程實現。

行業背景

Claude Fable 5.1 的發佈正值AI模型競爭白熱化之際。Google 正在測試內部代號「skimaki」的 Gemini 3.8 Flash,OpenAI 則推出了具備零日漏洞發現能力的 Astra 模型。在這一競爭格局下,Anthropic 選擇以成本效益和性能提升作為 Fable 5.1 的核心賣點,顯示出其對企業市場的深度聚焦。

結語

Claude Fable 5.1 的發佈雖然是增量更新,但75%的快取成本削減和Terminal-Bench-Science評分翻倍,對於重度使用代理工作流程的企業用戶而言,具有實質性的商業價值。隨著AI代理在企業中的應用日益普及,成本效益將成為模型選擇的關鍵考量因素。


資料來源:Claudefa.st、Digital Applied、AI Catchup(2026年9月)

常見問題

相關文章