9月1日 Claude Fable 5.1 上線了。價格表只改了一行。
輸入 $10 → $10 維持不變
輸出 $50 → $50 維持不變
5m 寫入 $12.50 → $12.50 維持不變
1h 寫入 $20 → $20 維持不變
快取讀取 $1.00 → $0.25 ← 只有這裡
如果只是降價,沒有理由不換。 不過官方寫了有 3 個破壞性變更。
驗證環境:Windows 10 / Claude Code 2.1.258 / 測量截至 2026-09-02
來自官方的遷移指南。對有在做 agent 的人特別有感。
1. 強制工具使用不能用。
tool_choice 傳入 any 或 tool 時會回傳 400。 文件裡列出的錯誤訊息如下(我沒有直接打 API,所以自己沒踩到)。
tool_choice: type "tool" and "any" are not supported for this model.
不只 Messages API,Batch API 和 token 計算也一樣。也就是說,「一定要讓它呼叫這個工具來取得結構化輸出」這種常見作法不能用了。
2. 舊模型讀不懂 5.1 的 thinking 區塊。
3. 編輯過去的 turn 會讓 thinking 區塊失效。
多模型混用的架構,或是會改寫歷史後再送出的實作,都會受到影響。
不會報錯,所以比較不容易察覺。
改變的地方會影響到的場景是:並行工具呼叫會減少,長時間的 agent loop 可能變成一個 turn 只呼叫一次,進度訊息會變少,在會把中途進度顯示到畫面的 UI 裡,以及low effort 時不太會去呼叫搜尋,改成更多從記憶中直接回答。第一點的影響是turn 數變多 = 往返與 token 變多,官方建議「加上一句 batch 指示」。第三點則會影響 用 low effort 跑 RAG 的架構。
新增內容:可以在對話中途調整 effort(beta)、不掉快取地變更、turn-scoped 的系統訊息(beta)、只在下一次使用者發言前有效的指示、display: "updates"(beta)可輸出可讀的進度、快取讀取降價從 $1.00 → $0.25、content provenance(來源標記)。
第一項最有感。 Fable 5 只能在 request 單位調整 effort,一調整就會掉快取。 但在 5.1 裡不會。
Fable 5Fable 5.1Context1M1M最大輸出128K128KthinkingAdaptive(常時)Adaptive(常時)預設 efforthigh``high知識截斷點**2026 年 1 月**2026 年 6 月退役2027-06-09 之後2027-09-01 之後變動的只有知識截斷點往後了 5 個月。
基準測試則是官方公布的資料。所有項目都有提升。
Fable 5Fable 5.1Terminal-Bench-Science 0.124.7%52.6%Terminal-Bench 4.042.0%55.8%AutomationBench17.1%31.4%CursorBench 3.2.070.5%73.4%科學型 agent 的表現已經超過一倍。
兩個版本目前都還能呼叫,所以用相同步驟比較。prefix 和速度幾乎一樣。
前綴 Fable 5 81,880 / Fable 5.1 82,460
單次耗時(5 次) Fable 5 平均 7.1 秒 / Fable 5.1 平均 7.7 秒
真正拉開差距的是快取。 也就是第一次之後再接著跑時的命中率。
試行數99% 以上約 40%Fable 512120Fable 5.118513**Fable 5 12 次全部命中,5.1 則是 18 次中有 13 次沒命中。** 沒命中的話,大概要重寫 5 萬個 token。
中間值沒有。原因不明。 這是上線隔天測的,所以隔一段時間再測一次很有價值。
Fable 5.1 的模型頁面,在同一頁內就出現矛盾。
價格表的欄位 : Cache read $0.25 / MTok
同頁腳注 : prompt caching reads cost 10% of the base input price
輸入是 $10,所以照腳注應該是 $1.00。但表格寫的是 $0.25。 正確的是表格,價格頁也有明確說明。
Cache hits and refreshes on Claude Fable 5.1 and Claude Mythos 5.1 are priced at 0.025x the base input price. All other models use the standard 0.1x multiplier.
(Claude Fable 5.1 和 Claude Mythos 5.1 的快取命中與重新整理,價格是基本輸入價格的 0.025 倍。其他所有模型都使用標準的 0.1 倍倍率)
腳注是全模型共用的固定模板,沒有反映 5.1 的例外。 如果照腳注估價,會差 4 倍。
tool_choice 的 any / tool 會變成 400如果只看到「變便宜了」就直接換版,會在 tool_choice 上踩到 400。 在遷移前,先搜尋一下有沒有用到強制工具呼叫會比較快。
參考
※ 引用部分保留原文與日文譯文並列。翻譯以可讀性為優先,精確表述請以原始資料為準。
JQIT 的工程師有 95% 以上是從零經驗錄用。
如果有興趣,也歡迎來公司網站逛逛。
▶ 公司網站
我們也有工程師招募,如果有興趣,歡迎看看。
▶ 招募網站