9 月 1 日發佈了 Claude Fable 5.1。快取讀取是 $0.25/M,比輸入價格減半的 Opus 5($0.50/M)還便宜,是很少見的定價。

原本以為長時間的 session 會更划算,實際測了一下之後發現,第 2 個 turn 是否會穩定進入快取並不固定。

同樣的步驟,初次 → 延續 共做 12 次。只列出延續時的命中率。

Fable 5.1   99.6  39.4  39.5  99.6  39.4  99.6
            41.1  41.1  41.2  41.1  39.5  99.6     ← 分成 4 次 / 8 次

Opus 5      99.9  99.7  99.6  99.7  99.6  99.9  99.7   ← 7 次都命中
Sonnet 5    99.9  99.9  99.9  99.9  99.9              ← 5 次都命中

驗證環境:Windows 10 / Claude Code 2.1.258 / 測量時間為 2026-09-02


寫在價格表註腳裡

Cache hits and refreshes on Claude Fable 5.1 and Claude Mythos 5.1 are priced at 0.025x the base input price. All other models use the standard 0.1x multiplier.
(Fable 5.1 與 Mythos 5.1 的快取命中與更新價格為基本輸入價格的 0.025 倍其他所有模型都使用標準的 0.1 倍倍率

模型輸入 1 小時寫入快取讀取輸出Fable 5.1$10$20$0.25$50Fable 5$10$20$1.00$50Opus 5$5$10$0.50$25Sonnet 5$2$4$0.20$10Fable 5 從 $1.00 降到 $0.25。發表時說的「降 75%」就是這個意思。 但輸出仍維持 $50/M,是 Opus 的 2 倍。


測量方式

使用 --output-format json 取得快取的 token 數,執行初次 → 延續

claude -p "hi" --model claude-fable-5-1 --output-format json
claude -p "hi again" --resume <session ID> --model claude-fable-5-1 --output-format json

如果順利的話,第 2 次會幾乎完全從快取讀取對話內容。


分裂的情況

以下是 Fable 5.1 連續執行 6 次時,第 2 個 turn 的內容。

試行readcreate命中率182,37536399.6%232,61050,07239.4%332,61250,02039.5%482,37533499.6%532,61150,05939.4%682,37735599.6%**沒有中間值。** 不是命中,就是重寫 5 萬個 token。

連續 6 次裡分成 3 比 3,所以不是時間帶偏差。 今天跑了 12 次,命中的 4 次,沒命中的 8 次。

同一組條件下也測了 Opus 和 Sonnet,Opus 7 次、Sonnet 5 次都維持在 99% 以上。 只有 Fable 會分裂。


等了也沒有改善

原本以為可能是快取可讀取之間有延遲,所以在第 1 個 turn 之後等了 45 秒再測。

不等待    →  99.6%
等待 45 秒 →  39.5%

反而掉了。 看來不是等待時間的問題。


沒命中時要付出什麼

把重寫的約 50,059 個 token 換算成價格表。1 小時快取寫入在 Fable 5.1 是 $20/M。

沒命中時  50,059 tok × $20/M  =  $1.00
命中時       341 tok × $20/M  =  $0.007

單一個 turn 就有約 1 美元的差距。

另一方面,一旦命中,單個 turn 的讀取費用就會變便宜。

Fable 5.1  82,719 tok × $0.25/M  =  $0.021
Opus 5     81,799 tok × $0.50/M  =  $0.041

大約是半價。 命中就便宜,沒命中就貴。而且每次執行的結果還會變。

我使用的是訂閱方案,所以實際上不會被收費。 這些數字是按 API 定價換算的。


前一版寫錯的地方

這篇文章我其實重寫過一次。一開始我寫成「要到第 2 個 turn 才會進入快取,而且 3 次都能重現」。

那 3 次只是剛好全部落在較低的一側。 重新跑之後,大約 3 次中就有 1 次會出現 99.6%。3 次一致,不能作為二值分裂現象具有可重現性的證據。

另外還修正了一點。原版中我把 Opus 的首次命中率寫成 0%,Fable 寫成 35.9%,看起來像是有差異。其實那只是執行順序造成的。 當時只是還沒跑到 Opus;今天重新測過後,Opus 第一次也只是讀了 28,415 個 token,命中率 34.9%這不是模型差異。


原因不明

因為會分裂成二值,所以看起來像是有某種有時成功、有時失敗的因素在影響,但從外部無法驗證。我們最多只能說「確實會分裂」。

Fable 5.1 是剛公開的隔天。過一段時間後再測一次很有價值。


總結

  • Fable 5.1 的快取讀取是 $0.25/M,比輸入價格是 2 倍的 Opus 5($0.50/M)還便宜
  • 公式註腳寫明「只有 Fable 5.1 和 Mythos 5.1 是 0.025 倍,其他全部是 0.1 倍
  • 但第 2 個 turn 是否命中並不穩定。12 次裡有 8 次沒命中
  • 沒有中間值。 不是 99.6%,就是約 40%。連續 6 次也分成 3 比 3
  • Opus 7 次、Sonnet 5 次全部命中。 只有 Fable 會分裂
  • 等 45 秒也沒改善。 反而更差
  • 沒命中的 turn 會重寫約 50,000 個 token。按定價換算,約 $1.00
  • 原因不明。 由於是公開隔天的測量,之後值得再測一次

「快取讀取是四分之一價」這件事是真的。前提是有命中。


參考資料

※ 引用內容同時附上原文與日文譯文。翻譯以可讀性為優先,精確表達請以原文為準。

相關文章


JQIT 的工程師有 95% 以上都是從零經驗錄用的。
如果有興趣,也歡迎來公司網站看看。

公司網站

我們也在招募工程師。如果您有興趣,歡迎看看。

招募網站


原文出處:https://qiita.com/jqit_suwa/items/8ae6739d0bb525e1b41b


精選技術文章翻譯,幫助開發者持續吸收新知。

共有 0 則留言


精選技術文章翻譯,幫助開發者持續吸收新知。
🏆 本月排行榜
🥇
站長阿川
📝16   💬4  
230
🥈
我愛JS
3
評分標準:發文×10 + 留言×3 + 獲讚×5 + 點讚×1 + 瀏覽數÷10
本數據每小時更新一次
📢 贊助商廣告 · 我要刊登