claude-fable-5-12026 年 9 月 1 日,Anthropic 在官方頁面 anthropic.com/claude/fable 正式發布 Claude Fable 5.1,同步更新企業版 Mythos 5.1。這是繼 Fable 5(2026 年 6 月 9 日 GA,三天後遭 US Commerce Dept 強制下架,6 月中旬重新上線)之後,Anthropic 最快的主力模型迭代。
值得注意的是,Fable 5.1 不是全新架構——它是在 Fable 5 的基礎上進行的「效率工程迭代」,核心參數、訓練資料、基礎能力與 Fable 5 高度一致。Anthropic 的重點在於讓開發者和企業在實際部署時省更多錢,同時引入了幾項 API 層面的改進。官方描述 Fable 5.1 為「research capabilities 早期預覽」,意味著後續還有更多能力更新會以 point release 形式滾動推出。
要理解 Fable 5.1 最核心的升級,必須先了解 Anthropic 的 Prompt Caching 機制。當你的 API 請求包含重複的 context(例如固定的系統提示、長篇文件、工具定義),Anthropic 的基礎設施會把這段 context 快取在 KV(Key-Value)cache 中。下一次請求如果 prefix 相同,就直接從 cache 讀取,省去重新 tokenize + prefill 的計算成本。
在 Fable 5 時代,cache 讀取的費率是 $1/MTok——比輸入的 $10/MTok 便宜,但對於大量 cache hit 的 agentic 應用來說仍然是顯著成本。Fable 5.1 把 cache reads 直接降到 $0.25/MTok,降幅 75%。
Cache 節省效果取決於你的應用中「重複 context」佔總 token 的比例。以下幾類應用最受益:
相反地,如果你的應用每次請求的 context 都完全不同(例如純粹的一次性翻譯任務),Fable 5.1 和 Fable 5 的費用差距就很小——輸入輸出定價完全相同。
| 規格項目 | Claude Fable 5 | Claude Fable 5.1 | 變化 |
|---|---|---|---|
| API Model ID | claude-fable-5 |
claude-fable-5-1 |
更新 |
| 輸入定價 | $10 / MTok | $10 / MTok | 不變 |
| 輸出定價 | $50 / MTok | $50 / MTok | 不變 |
| Cache Reads 定價 | $1.00 / MTok | $0.25 / MTok | 降 75% 🔥 |
| Context Window | 1M tokens | 1M tokens | 不變 |
| Agentic 能力 | 工具呼叫、長任務鏈 | 同上 + 效率優化 | 強化 |
| Research 能力 | 一般 | 早期預覽強化 | 強化 |
| 企業版 | Mythos 5 | Mythos 5.1(同步更新) | 更新 |
| 與 Grok 4.7 競爭 | 對標 Grok 4.6 | xAI 工程師確認以 Fable 5.1 為競爭目標 | 新動態 |
光說「省 45%」很抽象,讓我們用幾個台灣開發者常見的場景來算具體數字。
假設:每月 500 個 agent 任務,每任務平均 50K input tokens(其中 35K 為重複 context / cache hit),10K output tokens
假設:每月 1,000 次查詢,每次 80K input tokens(其中 75K 為相同文件 context),500 output tokens
假設:每月 5,000 次對話,每次系統提示 30K tokens(cache hit)+ 1K user input + 500 output
透過 DigitalOcean GPU Droplets 或 AI/ML Platform,台灣信用卡直接付款,最低 $6/月起即可開始。支援 Claude API proxy 部署,讓 cache 優化效果最大化。
查看 DigitalOcean 方案Fable 5.1 的發布時間點頗有策略意味。根據 xAI 工程師在社群媒體的確認,Grok 4.7(2.1T 參數,SpaceX 工程資料融入訓練)正處於 9 月 2–9 日的發布窗口,雙方直接競爭。Fable 5.1 等於搶先一步確立了「cache 效率標竿」。
| 模型 | 輸入定價 | Cache Reads | Context | 狀態 |
|---|---|---|---|---|
| Claude Fable 5.1 | $10/MTok | $0.25/MTok 🔥 | 1M tokens | ✅ GA(9/1) |
| Claude Fable 5 | $10/MTok | $1.00/MTok | 1M tokens | ✅ GA(6/9,二次發布) |
| GPT-5.4(OpenAI) | $4/MTok(降價後) | ~$0.50/MTok(推測) | 128K tokens | ✅ GA |
| Grok 4.7(xAI) | TBD(2.1T 參數) | TBD | TBD | ⏳ Sep 2–9 窗口 |
| DeepSeek V4 Pro | $0.435/MTok | ~$0.05/MTok(推測) | 1M tokens | ✅ GA,MIT 開源 |
| Gemini 3.7 Flash | ~$0.075/MTok | 更低 | 1M tokens | ✅ GA(8/13) |
從純粹費用角度看,DeepSeek V4 Pro 和 Gemini 3.7 Flash 在絕對費率上仍遠低於 Fable 5.1。但 Fable 5.1 的優勢在於 能力品質上限——對於需要複雜推理、長文件處理、精確指令遵循的任務,Fable 5 系列的輸出品質仍是業界頂尖。Cache 降價讓這個「品質溢價」變得更合算。
切換到 Fable 5.1 非常簡單,只需要更改 model ID。以下是完整的接入示例:
import anthropic
client = anthropic.Anthropic()
# 使用 Prompt Caching 的 Fable 5.1 請求
message = client.messages.create(
model="claude-fable-5-1", # ← 只改這裡
max_tokens=4096,
system=[
{
"type": "text",
"text": "你是一個專業的程式碼審查助手...",
# 啟用 cache(重複的系統提示 / 長文件使用)
"cache_control": {"type": "ephemeral"}
}
],
messages=[
{
"role": "user",
"content": "請審查以下程式碼:\n\n```python\n..."
}
]
)
print(message.content[0].text)
print(f"Cache reads: {message.usage.cache_read_input_tokens} tokens")
"cache_control": {"type": "ephemeral"},否則仍按全額輸入定價計算。usage.cache_read_input_tokens 和 usage.cache_creation_input_tokens 可以讓你精確追蹤實際 cache 節省。DataCamp 提供從 Prompt Engineering 到 Production LLM Apps 的完整學習路徑,包含 Anthropic Claude API、cost optimization、caching 策略實戰課程。台灣信用卡支援,月付方案彈性入門。
探索 DataCamp AI 課程坦白說,如果你目前的應用沒有啟用 Prompt Caching,Fable 5.1 帶來的差異幾乎是零——能力相同,非 cache 定價相同。Fable 5.1 的核心價值就是 cache 降價。如果你的應用有大量重複 context 且已啟用 cache,升級毫無疑問值得;如果沒有,先評估是否啟用 cache 比換版本更重要。
《AutoDev AI 技能包》包含針對 Fable 5.1 優化的 agentic 工作流模板、Prompt Caching 實戰配置、API 費用最佳化指南。直接套用,立省 45%。
查看技能包內容claude-fable-5-1,Prompt Caching 的降價費率自動適用。唯一需要做的是在你的 API 請求中明確加入 cache_control 標記——Anthropic 不會自動 cache 任何內容。Claude Fable 5.1 不是一次革命性的模型更新——它是一次精準的工程調整,把最讓 agentic 開發者痛的成本節點(重複 context 的 cache 費用)直接砍了 75%。
如果你的應用有大量重複 context,現在就換 model ID,開始節省。如果你的應用沒有重複 context,先評估是否可以重構成 cache 友好的架構,然後再換。無論如何,Fable 5.1 的門檻很低——不需要重寫代碼,不需要重新測試整個系統,只是一個字串的改動。
Grok 4.7 即將到來,Astra 的發布窗口也在本月。9 月是 AI 模型競爭最激烈的一個月,我們會持續追蹤並第一時間更新繁中評測。
相關閱讀: Claude Fable 5 完整評測:史上最強又被政府喊停的 AI ‧ OpenAI Astra 完整解析:史上第一個 Critical AI ‧ Grok 4.6 完整評測:agentic coding 新標竿