Claude Fable 5.1

Fable 5.1 的省錢關鍵不是模型,而是你的快取讀取比例

Firecrawl 實測 57 次 API 呼叫後發現,Fable 5.1 只有在快取讀取密集的長代理任務才便宜,其他情境反而更貴。

Fable 5.1 的省錢關鍵不是模型,而是你的快取讀取比例 — 文章封面
本頁內容6 個段落
  1. 為什麼兩個說法都對,但結論相反?
  2. 快取讀取降價,但快取寫入沒降
  3. 輸出 token 變多,是隱藏的成本
  4. 任務規範的鬆緊,決定哪個模型便宜
  5. 你該怎麼選?
  6. 參考來源

為什麼兩個說法都對,但結論相反?

Anthropic 說 Fable 5.1 比 Fable 5 便宜 25%,有時甚至 45%。Artificial Analysis 卻量出每項任務成本上升 18%。Firecrawl 的 Richard Oliver Bray 在 2026 年 9 月 7 日的文章中,用 57 次 API 計費執行、總花費 26 美元,把這兩個看似矛盾的數字拆開來看。

關鍵在於計費方式。Anthropic 按 token 計費,四種 token 類型中只有一種降價:快取讀取從每百萬 1 美元降到 0.25 美元,降幅 75%。輸入、輸出、快取寫入的價格全部不變。Artificial Analysis 則按「完成一項任務的成本」計算,而 Fable 5.1 在他們的 Intelligence Index 上用了 1.4 億個輸出 token,比 Fable 5 的 8,300 萬多了 69%。輸出 token 是最貴的一種,每百萬 50 美元,所以每項任務成本從 3.14 美元升到 3.69 美元。

兩個數字都對,只是量的東西不同。Anthropic 量的是快取密集的長代理工作,Artificial Analysis 量的是幾乎不用快取的單次任務。你的帳單落在哪一邊,取決於你的工作負載。

快取讀取降價,但快取寫入沒降

Fable 5.1 的價格表只有一行變動:快取讀取從 1 美元降到 0.25 美元。快取寫入維持每百萬 20 美元,是輸入價格的兩倍。這設定了省錢的上限。

Firecrawl 在六個沙箱化的代理建置任務上實際看到帳單差異。一個 Fable 5.1 建置重新讀取 169 萬個快取 token,付了 0.42 美元;一個 Fable 5 建置重新讀取 134 萬個,付了 1.34 美元。省下的錢是帳單的 15% 到 30%,不是 25% 到 45%,因為快取寫入沒有折扣。

快取讀取折扣的效益,取決於同一個 context 被重讀的次數,而不是 context 的大小。如果你建立一個大快取但只讀兩次,幾乎省不到錢。長代理 session 才是這個折扣真正發光的地方。

輸出 token 變多,是隱藏的成本

Firecrawl 的 57 次執行中,Fable 5.1 在每個 effort level 都用掉更多輸出 token。低 effort 是 1.37 倍,高 effort 是 1.12 倍,max effort 是 1.30 倍。

在 max effort 下,多出來的 token 是推理,不是文字。推理 token 從 4,205 增加到 6,725,可見輸出從 3,522 降到 3,301。Fable 5.1 寫了少 6% 的文字,卻多付了 30% 的計費 token。

推理 token 以輸出價格計費,每百萬 50 美元,但它們永遠不會出現在你看到的回覆裡。Fable 5.1 的思考功能永久開啟,無法關閉,budget_tokens 參數會回傳 400 錯誤。你唯一能控制思考量的方式是 effort level。

任務規範的鬆緊,決定哪個模型便宜

Firecrawl 的測試揭露一個雙方都沒量到的變數:你怎麼規範任務。

當任務規範很緊時,Opus 5 在成本上每次都贏。當任務規範很鬆時,Opus 5 平均花 11.83 美元,Fable 5.1 只要 7.00 美元。這表示如果你給模型明確的步驟和限制,Opus 5 可能更划算;如果你丟一個開放式的簡報,Fable 5.1 的穩定性和較低的快取讀取成本會佔優勢。

這呼應了我們之前討論過的模型選擇不該只看每百萬 token 報價。真正的成本是每項成果的成本,而成果的定義取決於你的任務規範。

你該怎麼選?

先看你的帳單結構。如果你的工作負載是長時間的代理 session,重複讀取大量 context,Fable 5.1 的快取讀取折扣會直接反映在帳單上。如果你跑的是單次、快取很少的任務,Fable 5.1 可能因為輸出更多 token 而更貴。

再看你的 effort level。Anthropic 的省錢數字是在預設 effort 下量的,Artificial Analysis 的漲價數字是在 max effort 下量的。Claude Code 預設 High,Claude Cowork 和 Claude.ai 預設 Medium。如果你繼承了某個預設值而沒檢查,成本意外通常來自那裡,不是模型本身。

最後,如果你直接呼叫 API,注意 Fable 5.1 的 API 表面有變動:強制工具使用的行為不同、思考永久開啟、budget_tokens 回傳 400 錯誤。如果你透過 Claude Code 或託管產品建置,這些變動由 harness 處理。

Fable 5.1 不是全面降價,而是把省錢的槓桿移到快取讀取上。你的工作負載決定這個槓桿對你有沒有用。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵