APAIIF 亞太人工智能產業總會APAIIFAI 知識庫
AI 工具與應用

Anthropic Claude Fable 5.1 & Mythos 5.1 正式發佈:快取讀取成本降75%、代理工作流程成本節省達45%,企業 AI 部署門檻大幅降低

2026年9月14日0 瀏覽
Anthropic Claude Fable 5.1 & Mythos 5.1 正式發佈:快取讀取成本降75%、代理工作流程成本節省達45%,企業 AI 部署門檻大幅降低
Anthropic
Claude
代理AI
企業AI
AI定價

Anthropic Claude Fable 5.1 & Mythos 5.1 正式發佈:快取讀取成本降75%,企業代理 AI 部署門檻大幅降低

2026年9月1日,Anthropic 正式發佈 Claude Fable 5.1 與其受限訪問版本 Claude Mythos 5.1,這是 Anthropic 迄今最先進的長期代理工作模型。此次發佈最引人注目的不是性能突破,而是一項重大的定價調整:快取讀取成本降低75%,從每百萬 Token $1.00 降至 $0.25,直接改變了企業 AI 部署的經濟學。

定價革命:快取讀取成本降75%

核心定價結構

計費項目 Fable 5.1 前代 Fable 5 變化
輸入 Token $10/百萬 $10/百萬 不變
輸出 Token $50/百萬 $50/百萬 不變
快取讀取 $0.25/百萬 $1.00/百萬 -75%
Batch API 輸入 $5/百萬 $5/百萬 不變
Batch API 輸出 $25/百萬 $25/百萬 不變

為何快取讀取如此重要?

在代理 AI 工作流程中,模型通常需要在每次調用時重新讀取大量穩定的上下文——包括系統提示、工具定義、代碼庫映射等。通過將快取讀取定價設為基礎輸入費率的 0.025倍(行業標準為0.1倍),Anthropic 實際上是在激勵企業構建依賴持久、穩定上下文的代理工作流程。

Anthropic 估計,這一變化對典型工作負載可節省 25% 的有效成本,對高度依賴快取指令和代碼庫映射的代理工作負載可節省高達 45%

模型架構:Fable 5.1 vs Mythos 5.1

Claude Fable 5.1(通用版)

  • 目標用途:長期代理工作,包括持續科學研究、複雜編碼和多步驟業務工作流程
  • 安全措施:配備生產就緒的企業前沿安全措施(EFS),涵蓋網絡安全、生物學和化學領域
  • 上下文窗口:100萬 Token
  • 可用性:通過 Anthropic API 公開訪問

Claude Mythos 5.1(受限訪問版)

  • 目標用途:面向生命科學和網絡安全領域的已審查組織
  • 訪問機制:通過 Anthropic 的「Project Glasswing」計劃進行門控,允許在標準安全措施之外的能力
  • 底層權重:與 Fable 5.1 相同,主要差異在於企業級安全措施的配置

技術變更:代理開發者需注意的重大更新

工具使用強制更改

Fable 5.1 不再支援將 tool_choice 設置為 "any" 或特定工具名稱,返回 400 錯誤。開發者必須依賴 "auto""none"。這一變化影響現有代理實現,需要代碼更新。

思維塊(Thinking Blocks)的新行為

模型採用「始終開啟」的自適應思維。思維塊現在與模型和對話前綴綁定;在對話中途修改系統提示或工具會使後續思維塊失效,需要採用「僅追加」的對話歷史方法。

五段式努力等級

用戶可以調整「努力」等級(1-5),在性能與 Token 消耗之間取得平衡:

  • 等級1-2:快速、低成本,適合簡單任務
  • 等級3:平衡模式,適合大多數業務場景
  • 等級4-5:深度推理,適合複雜科學或工程問題

企業前沿安全措施(EFS):數據主權新架構

Fable 5.1 引入了全新的企業前沿安全措施(EFS)架構,允許企業在自己控制的雲環境(AWS、Azure、Google Cloud)中保留監控數據,使用客戶管理的密鑰。

這對於受嚴格數據主權法規約束的亞太地區企業尤為重要:

  • 香港:《個人資料(私隱)條例》要求對敏感數據的處理保持完整審計追蹤
  • 新加坡:《個人資料保護法》(PDPA)對跨境數據傳輸有嚴格規定
  • 日本:《個人信息保護法》(APPI)要求數據本地化選項

EFS 架構使這些企業能夠在享受 Fable 5.1 強大能力的同時,滿足本地合規要求。

性能基準:代理任務的顯著提升

Anthropic 報告 Fable 5.1 相較 Fable 5 在以下基準測試中取得顯著進步:

  • Terminal-Bench-Science 0.1:科學終端任務基準
  • AutomationBench:自動化工作流程基準

雖然 Anthropic 未公佈具體數字,但獨立評測顯示 Fable 5.1 在長期代理任務中的表現明顯優於前代,特別是在需要多步驟規劃和工具調用的場景中。

亞太地區企業採用策略

金融服務業

香港和新加坡的銀行正在評估 Fable 5.1 用於:

  • 合規文件審查:利用百萬 Token 上下文窗口一次性分析完整的監管文件集
  • 代碼審計:通過 Codex 集成自動化安全代碼審查
  • 客戶服務代理:構建能夠處理複雜多步驟查詢的客服系統

醫療健康業

日本和澳大利亞的醫療機構對 Mythos 5.1 的生命科學能力表現出興趣,特別是在藥物研發和臨床試驗數據分析方面。

科技初創企業

東南亞的 AI 初創企業將受益於75%的快取讀取成本降低,使他們能夠以更低的成本構建和測試代理工作流程原型。

競爭格局分析

Fable 5.1 的定價調整直接回應了市場競爭壓力:

  • GPT-6 Astra($10/$50 per M tokens):性能更強但成本更高
  • Gemini 3.8 Flash($0.75/$3.75 per M tokens,2026年底前):成本更低但能力有限
  • Claude Fable 5.1($10/$50 per M tokens,但快取讀取僅$0.25):在長期代理任務中具有顯著成本優勢

展望

Claude Fable 5.1 的發佈標誌著 Anthropic 在企業 AI 市場的戰略轉型:從單純的性能競爭轉向「性能+成本效益」的雙重優勢。75%的快取讀取成本降低不僅是一個定價決策,更是對代理 AI 工作流程未來發展方向的明確押注。

對於亞太地區的企業而言,這意味著構建複雜代理系統的經濟門檻顯著降低,預計將在2026年第四季度推動一波企業 AI 代理部署浪潮。

常見問題

相關文章