
Anthropic Claude Fable 5.1 & Mythos 5.1 正式發佈:快取讀取成本降75%,企業代理 AI 部署門檻大幅降低
2026年9月1日,Anthropic 正式發佈 Claude Fable 5.1 與其受限訪問版本 Claude Mythos 5.1,這是 Anthropic 迄今最先進的長期代理工作模型。此次發佈最引人注目的不是性能突破,而是一項重大的定價調整:快取讀取成本降低75%,從每百萬 Token $1.00 降至 $0.25,直接改變了企業 AI 部署的經濟學。
定價革命:快取讀取成本降75%
核心定價結構
| 計費項目 | Fable 5.1 | 前代 Fable 5 | 變化 |
|---|---|---|---|
| 輸入 Token | $10/百萬 | $10/百萬 | 不變 |
| 輸出 Token | $50/百萬 | $50/百萬 | 不變 |
| 快取讀取 | $0.25/百萬 | $1.00/百萬 | -75% |
| Batch API 輸入 | $5/百萬 | $5/百萬 | 不變 |
| Batch API 輸出 | $25/百萬 | $25/百萬 | 不變 |
為何快取讀取如此重要?
在代理 AI 工作流程中,模型通常需要在每次調用時重新讀取大量穩定的上下文——包括系統提示、工具定義、代碼庫映射等。通過將快取讀取定價設為基礎輸入費率的 0.025倍(行業標準為0.1倍),Anthropic 實際上是在激勵企業構建依賴持久、穩定上下文的代理工作流程。
Anthropic 估計,這一變化對典型工作負載可節省 25% 的有效成本,對高度依賴快取指令和代碼庫映射的代理工作負載可節省高達 45%。
模型架構:Fable 5.1 vs Mythos 5.1
Claude Fable 5.1(通用版)
- 目標用途:長期代理工作,包括持續科學研究、複雜編碼和多步驟業務工作流程
- 安全措施:配備生產就緒的企業前沿安全措施(EFS),涵蓋網絡安全、生物學和化學領域
- 上下文窗口:100萬 Token
- 可用性:通過 Anthropic API 公開訪問
Claude Mythos 5.1(受限訪問版)
- 目標用途:面向生命科學和網絡安全領域的已審查組織
- 訪問機制:通過 Anthropic 的「Project Glasswing」計劃進行門控,允許在標準安全措施之外的能力
- 底層權重:與 Fable 5.1 相同,主要差異在於企業級安全措施的配置
技術變更:代理開發者需注意的重大更新
工具使用強制更改
Fable 5.1 不再支援將 tool_choice 設置為 "any" 或特定工具名稱,返回 400 錯誤。開發者必須依賴 "auto" 或 "none"。這一變化影響現有代理實現,需要代碼更新。
思維塊(Thinking Blocks)的新行為
模型採用「始終開啟」的自適應思維。思維塊現在與模型和對話前綴綁定;在對話中途修改系統提示或工具會使後續思維塊失效,需要採用「僅追加」的對話歷史方法。
五段式努力等級
用戶可以調整「努力」等級(1-5),在性能與 Token 消耗之間取得平衡:
- 等級1-2:快速、低成本,適合簡單任務
- 等級3:平衡模式,適合大多數業務場景
- 等級4-5:深度推理,適合複雜科學或工程問題
企業前沿安全措施(EFS):數據主權新架構
Fable 5.1 引入了全新的企業前沿安全措施(EFS)架構,允許企業在自己控制的雲環境(AWS、Azure、Google Cloud)中保留監控數據,使用客戶管理的密鑰。
這對於受嚴格數據主權法規約束的亞太地區企業尤為重要:
- 香港:《個人資料(私隱)條例》要求對敏感數據的處理保持完整審計追蹤
- 新加坡:《個人資料保護法》(PDPA)對跨境數據傳輸有嚴格規定
- 日本:《個人信息保護法》(APPI)要求數據本地化選項
EFS 架構使這些企業能夠在享受 Fable 5.1 強大能力的同時,滿足本地合規要求。
性能基準:代理任務的顯著提升
Anthropic 報告 Fable 5.1 相較 Fable 5 在以下基準測試中取得顯著進步:
- Terminal-Bench-Science 0.1:科學終端任務基準
- AutomationBench:自動化工作流程基準
雖然 Anthropic 未公佈具體數字,但獨立評測顯示 Fable 5.1 在長期代理任務中的表現明顯優於前代,特別是在需要多步驟規劃和工具調用的場景中。
亞太地區企業採用策略
金融服務業
香港和新加坡的銀行正在評估 Fable 5.1 用於:
- 合規文件審查:利用百萬 Token 上下文窗口一次性分析完整的監管文件集
- 代碼審計:通過 Codex 集成自動化安全代碼審查
- 客戶服務代理:構建能夠處理複雜多步驟查詢的客服系統
醫療健康業
日本和澳大利亞的醫療機構對 Mythos 5.1 的生命科學能力表現出興趣,特別是在藥物研發和臨床試驗數據分析方面。
科技初創企業
東南亞的 AI 初創企業將受益於75%的快取讀取成本降低,使他們能夠以更低的成本構建和測試代理工作流程原型。
競爭格局分析
Fable 5.1 的定價調整直接回應了市場競爭壓力:
- GPT-6 Astra($10/$50 per M tokens):性能更強但成本更高
- Gemini 3.8 Flash($0.75/$3.75 per M tokens,2026年底前):成本更低但能力有限
- Claude Fable 5.1($10/$50 per M tokens,但快取讀取僅$0.25):在長期代理任務中具有顯著成本優勢
展望
Claude Fable 5.1 的發佈標誌著 Anthropic 在企業 AI 市場的戰略轉型:從單純的性能競爭轉向「性能+成本效益」的雙重優勢。75%的快取讀取成本降低不僅是一個定價決策,更是對代理 AI 工作流程未來發展方向的明確押注。
對於亞太地區的企業而言,這意味著構建複雜代理系統的經濟門檻顯著降低,預計將在2026年第四季度推動一波企業 AI 代理部署浪潮。

