Claude Opus 5.5 於 2026-09-22 發布。官方的說法如下。

我們的測試顯示,在預設設定下,於一般工作負載上它的成本會比 Opus 5 低 40%。

Opus 5.5 的輸出速度也比 Opus 5 快超過 30%。

「預設設定」「一般工作負載」指的是什麼,官方沒有寫。 我用自己的使用方式測了一下。

同樣的工作分別用 Claude Opus 5 和 Claude Opus 5.5 各跑 3 次

第一次(建立快取的那次)        便宜 24%
第二次以後(讀取快取的那次)    便宜 59%
輸出很長的工作                  便宜 32% / 輸出生成快 21%
輸出 93 token 的工作            速度差 2.6%

Claude Code 2.1.277 會把 claude-opus-5-5 視為 unrecognized_model

驗證環境:Windows 10 / 隔離安裝 Claude Code 2.1.282 / claude -p / 測量於 2026-09-25


首先,Claude Code 版本太舊就不能用

我把 --model claude-opus-5-5 丟給 3 個版本測試。

Claude Code 版本結果 2.1.277(2026-09-18)[claude-code:unrecognized_model] 2.1.280(2026-09-22)可用 2.1.282(2026-09-24)可用從模型發布日當天的 2.1.280 開始可用。 前一天的 2.1.277 會被擋下來。


測量方式:只改模型,重複做同樣的工作

我準備了兩個工作。判定只看 --output-format json 回傳的值。

工作目標 A 讀取 25.5KB 的 Python 程式,回答函式數量(輸出 93 token)以輸入為主,看成本
B 輸出 80 行的固定格式清單(輸出約 1,800 token)以輸出為主,看速度
我抓取 total_cost_usd / duration_api_ms / output_tokens,各跑 3 次後取中位數。


成本:快取命中情況讓結果差到超過一倍

這是工作 A 的實測。第 1 次和第 2 次以後,結果完全不一樣。

回數 快取建立 快取讀取 Claude Opus 5 Claude Opus 5.5 差異
第 1 次 約 6 萬 token 約 8 萬 token $0.6495 $0.4952 便宜 24%
第 2、3 次 0 約 14 萬 token $0.073258 $0.029842 便宜 59%

官方說的 40%,介於這兩種情況之間。

原因從單價表就看得出來。

項目 Claude Opus 5 Claude Opus 5.5 降幅
輸入 100 萬 token $5 $4 20%
輸出 100 萬 token $25 $20 20%
快取讀取 $0.50 $0.20 60%

降幅最大的是快取讀取。
同一個 session 持續下去越划算,每次都重新開始的話,受益就小很多。


速度:輸出很短的工作幾乎看不出差異

工作 A(輸出 93 token)和工作 B(輸出約 1,800 token),差很多。

工作 指標 Claude Opus 5 Claude Opus 5.5 差異
A 輸出 93 token 的 API 時間 3,433ms 3,344ms 快 2.6%
B 輸出約 1,800 token 的 API 時間 17,069ms 13,504ms 短 20.9%
B 輸出生成速度 107.9 tok/s 131.1 tok/s 快 21.5%

沒有達到官方說的「快 30% 以上」。 在我的環境裡是 21%。

工作 A 沒什麼差異其實很正常。 3.4 秒當中,輸出生成只是一瞬間,
剩下的時間都花在輸入處理和來回通訊。「輸出生成比較快」只有在輸出夠長時才看得出來。


不能下的結論

  • 沒有測品質。 只測成本和時間。哪個答案比較好,是另一回事
  • 官方的 Terminal-Bench 4.0(66.4% 對 52.3%)等數據只是引用,我沒有親自跑
  • 每個項目只跑 3 次。次數不多。工作 B 的輸出 token 數量在不同模型間有些差異(1,841 對 1,771)
  • 工作 B 的成本比較不完全公平。 因為先跑了 Opus 5,Opus 5.5 的第 1 次才會吃到快取建立成本($0.3157)。用中位數比是便宜 32%
  • 只有 2 個工作。 官方沒有寫清楚「一般工作負載」到底指什麼
  • Fast mode(官方寫「最高 2.5 倍」)未測試
  • 只做 claude -p 的單次往返,沒有測對話式 session 的體感
  • 價格以 2026-09-25 當時官方發布頁面的數字為準

總結

  • Claude Opus 5.5 需要 Claude Code 2.1.280 以上才可使用。 2.1.277 會出現 unrecognized_model
  • 「便宜 40%」有很大範圍。 我的實測是第一次便宜 24%,第二次以後便宜 59%
  • 真正拉開差距的是快取讀取便宜 60%。 session 持續越久越划算
  • 「快 30%」指的是輸出生成。 輸出約 1,800 token 時快 21%,93 token 時只有2.6%
  • 如果是大量處理短回應,速度上的好處幾乎沒有

你的實際帳單怎麼變,取決於快取命中情況。
只要看 --output-format json 的 total_cost_usd 兩次,就很快能知道。


參考資料


相關文章


JQIT 的工程師有 95% 以上都是從零經驗錄用的。
如果有興趣,也歡迎到公司網站逛逛。

▶ 公司網站

我們也在招募工程師,如果有興趣也歡迎看看。

▶ 招募網站


原文出處:https://qiita.com/suwa_nobu/items/870b1d6c5502aca68f55


精選技術文章翻譯,幫助開發者持續吸收新知。

共有 0 則留言


精選技術文章翻譯,幫助開發者持續吸收新知。
🏆 本月排行榜
🥇
站長阿川
📝62   💬2  
846
🥈
NewsData
2
評分標準:發文×10 + 留言×3 + 獲讚×5 + 點讚×1 + 瀏覽數÷10
本數據每小時更新一次
📢 贊助商廣告 · 我要刊登