9月1日 Claude Fable 5.1 上線了。價格表只改了一行。

輸入       $10     →  $10      維持不變
輸出       $50     →  $50      維持不變
5m 寫入    $12.50  →  $12.50   維持不變
1h 寫入    $20     →  $20      維持不變
快取讀取   $1.00   →  $0.25    ← 只有這裡

如果只是降價,沒有理由不換。 不過官方寫了有 3 個破壞性變更

驗證環境:Windows 10 / Claude Code 2.1.258 / 測量截至 2026-09-02


壞掉的變更有 3 個

來自官方的遷移指南。對有在做 agent 的人特別有感。

1. 強制工具使用不能用。

tool_choice 傳入 anytool 時會回傳 400。 文件裡列出的錯誤訊息如下(我沒有直接打 API,所以自己沒踩到)。

tool_choice: type "tool" and "any" are not supported for this model.

不只 Messages API,Batch API 和 token 計算也一樣。也就是說,「一定要讓它呼叫這個工具來取得結構化輸出」這種常見作法不能用了。

2. 舊模型讀不懂 5.1 的 thinking 區塊。

3. 編輯過去的 turn 會讓 thinking 區塊失效。

多模型混用的架構,或是會改寫歷史後再送出的實作,都會受到影響。


行為也有 3 個變化

不會報錯,所以比較不容易察覺

改變的地方會影響到的場景是:並行工具呼叫會減少,長時間的 agent loop 可能變成一個 turn 只呼叫一次進度訊息會變少,在會把中途進度顯示到畫面的 UI 裡,以及low effort 時不太會去呼叫搜尋,改成更多從記憶中直接回答。第一點的影響是turn 數變多 = 往返與 token 變多,官方建議「加上一句 batch 指示」。第三點則會影響 用 low effort 跑 RAG 的架構。


增加了 5 個新功能

新增內容:可以在對話中途調整 effort(beta)、不掉快取地變更、turn-scoped 的系統訊息(beta)、只在下一次使用者發言前有效的指示、display: "updates"(beta)可輸出可讀的進度、快取讀取降價從 $1.00 → $0.25、content provenance(來源標記)。

第一項最有感。 Fable 5 只能在 request 單位調整 effort,一調整就會掉快取。 但在 5.1 裡不會。


規格幾乎不變

Fable 5Fable 5.1Context1M1M最大輸出128K128KthinkingAdaptive(常時)Adaptive(常時)預設 efforthigh``high知識截斷點**2026 年 1 月**2026 年 6 月退役2027-06-09 之後2027-09-01 之後變動的只有知識截斷點往後了 5 個月。

基準測試則是官方公布的資料。所有項目都有提升。

Fable 5Fable 5.1Terminal-Bench-Science 0.124.7%52.6%Terminal-Bench 4.042.0%55.8%AutomationBench17.1%31.4%CursorBench 3.2.070.5%73.4%科學型 agent 的表現已經超過一倍


我們實測的差異

兩個版本目前都還能呼叫,所以用相同步驟比較。prefix 和速度幾乎一樣。

前綴       Fable 5  81,880   /  Fable 5.1  82,460
單次耗時(5 次) Fable 5  平均 7.1 秒 /  Fable 5.1  平均 7.7 秒

真正拉開差距的是快取。 也就是第一次之後再接著跑時的命中率。

試行數99% 以上約 40%Fable 512120Fable 5.118513**Fable 5 12 次全部命中,5.1 則是 18 次中有 13 次沒命中。** 沒命中的話,大概要重寫 5 萬個 token。

中間值沒有。原因不明。 這是上線隔天測的,所以隔一段時間再測一次很有價值。


官方頁面的表與腳注不一致

Fable 5.1 的模型頁面,在同一頁內就出現矛盾。

價格表的欄位 : Cache read  $0.25 / MTok
同頁腳注    : prompt caching reads cost 10% of the base input price

輸入是 $10,所以照腳注應該是 $1.00但表格寫的是 $0.25。 正確的是表格,價格頁也有明確說明。

Cache hits and refreshes on Claude Fable 5.1 and Claude Mythos 5.1 are priced at 0.025x the base input price. All other models use the standard 0.1x multiplier.
(Claude Fable 5.1 和 Claude Mythos 5.1 的快取命中與重新整理,價格是基本輸入價格的 0.025 倍其他所有模型都使用標準的 0.1 倍倍率

腳注是全模型共用的固定模板,沒有反映 5.1 的例外。 如果照腳注估價,會差 4 倍。


總結

  • 價格表只改了一行。 快取讀取 $1.00 → $0.25,其他維持不變
  • 有 3 個破壞性變更。 最大的是 tool_choiceany / tool 會變成 400
  • 行為也有 3 個變化。 並行工具呼叫減少 / 進度減少 / low effort 不太會去搜尋
  • 新增了 5 項。中途調整 effort 也不會掉快取」最有用
  • 規格不變。知識截斷點晚了 5 個月(2026 年 1 月 → 6 月)
  • 基準測試全面上升。科學型 agent 24.7% → 52.6%
  • 實測:第二個 turn 的快取,Fable 5 12 次全命中,5.1 則是 18 次中 13 次沒命中

如果只看到「變便宜了」就直接換版,會在 tool_choice 上踩到 400。 在遷移前,先搜尋一下有沒有用到強制工具呼叫會比較快。


參考

※ 引用部分保留原文與日文譯文並列。翻譯以可讀性為優先,精確表述請以原始資料為準。

相關文章


JQIT 的工程師有 95% 以上是從零經驗錄用。
如果有興趣,也歡迎來公司網站逛逛。

公司網站

我們也有工程師招募,如果有興趣,歡迎看看。

招募網站


原文出處:https://qiita.com/suwa_nobu/items/c0f5b86dfb8a3106cbaf


精選技術文章翻譯,幫助開發者持續吸收新知。

共有 0 則留言


精選技術文章翻譯,幫助開發者持續吸收新知。
🏆 本月排行榜
🥇
站長阿川
📝19   💬4  
268
🥈
我愛JS
3
評分標準:發文×10 + 留言×3 + 獲讚×5 + 點讚×1 + 瀏覽數÷10
本數據每小時更新一次
📢 贊助商廣告 · 我要刊登