💡 核心結論速覽 (TL;DR)
- 只有一格降價:Claude Fable 5.1 輸入 $10、輸出 $50 完全沒動,只有快取讀取從每百萬 token $1 砍到 $0.25(基本輸入價的 0.025 倍,其他 Claude 模型都是 0.1 倍)。
- 省多少完全看你怎麼用:我把四種用法代進去算,不重複讀同一份脈絡的只省 0.6%;反覆重讀長脈絡的 agent 工作省到 58%,還首次翻轉成比 Opus 5 便宜約 17%。
- 三個變更會直接回 400:強制工具呼叫、跨模型重播思考區塊、改動前面的對話。但只打到「自己組 messages 陣列」的人——用 claude.ai、Claude Code、Cowork 的人官方明文寫 are not affected。
- 先做這件事:訂閱戶把 Claude Code 更新到 2.1.257 以上、打
/model fable選起來(它不是任何方案的預設);開發者今天先跑一次歷史編輯自查,分界是 2026-08-31 早上 8 點(台灣時間)之後開的新帳號。
官方公告寫「典型工作負載成本降約 25%」的時候,我第一個反應跟你大概一樣:那我的帳單就少四分之一了嘛。
結果把自己的用量結構代進去算,答案是 0.6%。
不是官方唬人,是這次降價只動了五格價目裡的一格——快取讀取。你有沒有省到、省多少,完全取決於「重複讀同一段上下文」在你的帳單裡佔多大。而更有意思的是:讓你吃得到這筆折扣的條件,跟這次三個會讓程式直接噴 400 的破壞性變更,講的其實是同一件事——這一代的 Claude,要你把對話當成一本只能往後加、不能回頭塗改的帳本。
我每天掛著 Claude 工作超過十小時,Max 方案跟 API 兩邊都在燒,也自己組過 agent 迴圈跑自動化。這篇就把兩件事一次講清楚:這筆折扣你拿不拿得到、以及你到底要不要動手。
先回答一句:Claude Fable 5.1 這次更新跟你有沒有關係?三個自測題
Claude Fable 5.1 是 Anthropic 於 2026 年 9 月 1 日發布的模型,ID 是 claude-fable-5-1,和同日發布、僅限邀請的 Claude Mythos 5.1 是同一個底層模型。對絕大多數人來說,這次更新不需要你做任何事——三個破壞性變更只打到一小群人,而那一小群人今天就得動手。
它接的是 2026 年 6 月的 Fable 5。上一版剛上線時 Max 內含、Pro 改按量的那一輪帳我從頭算過一次,方案邏輯這次沒有翻掉,但有兩個差異點會讓沿用舊資訊的人吃虧,我放在後面講。
先用三題把自己分出來,三十秒就好。
❶ 你是在哪個介面用 Claude?
如果你是用 claude.ai 網頁/手機/桌面版、Claude Code、Claude Cowork,或是透過第三方產品用 Claude——Anthropic 說明中心與開發者文件逐字寫了這些人「are not affected」,另外把 Claude Managed Agents 與 Claude Agent SDK 也列進豁免名單,理由是「These keep the prefix intact for you」(這些工具會幫你把前綴維持完整)。你可以直接跳到下面〈訂閱戶怎麼把 Fable 5.1 開起來〉和〈不改一行程式也會變的七件事〉兩段,中間那三段是寫給開發者的。
真正會踩雷的只有一種人:自己組 messages 陣列、直接打 Messages API 的人。自寫 agent 迴圈、自製 harness、開源工具作者都算。
❷ 你的 API 帳號是哪一天開的?
分界線是 2026 年 8 月 31 日 00:00 UTC,換算台灣時間是 8 月 31 日早上 8 點。這個時間點之後建立的 Claude Platform 組織、Amazon Bedrock 帳號、Google Cloud Vertex AI 專案、Microsoft Azure Foundry 專案,「改動前文會讓思考區塊失效」這條檢查已經在強制執行。更早開的帳號目前只記錄、不動作。
但官方也把話講明了:未來的模型會對所有帳號一律適用。所以這不是「我躲得掉」,是「我什麼時候要面對」。
❸ 你的快取讀取佔帳單幾成?
這題決定你這次能不能省到錢。如果你的用法是每次丟一份新的長 prompt、不重複使用同一段上下文,那這次降價你一毛都拿不到。下一段我會把算法整個攤開。
⚠️ 做工具、做框架的人請特別看第二題。官方在遷移指南裡點名了一種很容易忽略的情況:你自己的 API key 多半在舊帳號,所以你測起來一切正常;但你的使用者拿自己的 key 跑,而他們可能是新帳號——他們會比你先撞到這個 400。官方的建議是把
prefix_mismatch_behavior設起來測一次。
唯一降價的那一格:Claude Fable 5.1 快取讀取 $1 → $0.25 怎麼算
Claude Fable 5.1 的五格價目裡,只有一格變了。這是理解這次改版的起點。
| 計費項目 | Claude Fable 5 | Claude Fable 5.1 | 變化 |
|---|---|---|---|
| 輸入 | $10 / MTok | $10 / MTok | 沒動 |
| 輸出 | $50 / MTok | $50 / MTok | 沒動 |
| 5 分鐘快取寫入 | $12.50 / MTok | $12.50 / MTok | 沒動 |
| 1 小時快取寫入 | $20 / MTok | $20 / MTok | 沒動 |
| 快取讀取(命中與刷新) | $1 / MTok | $0.25 / MTok | 降 75% |
| Batch API | $5 / $25 | $5 / $25 | 沒動(輸入輸出各半價) |
官方文件的腳註寫得很精確:Claude Fable 5.1 與 Mythos 5.1 的快取命中與刷新,收的是基本輸入價的 0.025 倍,而其他所有 Claude 模型都是標準的 0.1 倍。這是 Anthropic 第一次讓某個模型脫離那個 0.1 倍的通則。
然後是那句最容易被誤讀的話。官方原文是「For typical workloads, costs are reduced by around 25% relative to Fable 5」——注意是 costs(總成本),不是 price(單價)。而且它有一個範圍限定:「wherever usage is billed by token」,也就是按 token 計費的地方。Claude Pro、Max 這種固定月費訂閱,帳單不會因為這次降價變便宜一塊錢;你拿到的好處是同樣的週額度可以撐比較久(後面〈訂閱戶怎麼開起來〉會講)。
我把四種用法代進去算了一遍
下面是我自己拿新舊價目跑的試算,這是我的推算不是官方數字,但每一格單價都來自官方定價頁。單位是百萬 token(MTok)。
| 用法 | Fable 5 | Fable 5.1 | 省下 |
|---|---|---|---|
| 一般問答,幾乎不重複讀脈絡 | $6.67 | $6.64 | 0.6% |
| 中度 agent,一次性任務 | $3.88 | $3.12 | 19.4% |
| 長時 agent,反覆重讀同一份脈絡 | $12.88 | $5.38 | 58.3% |
| 整天跑,20 萬脈絡持續重讀 | $35.62 | $13.12 | 63.2% |
差距大到有點嚇人:同一次降價,有人省 0.6%,有人省 63%。
原因其實很單純。降價只發生在快取讀取那一格,所以你省下來的錢,等於「快取讀取原本在你帳單裡佔的金額」乘上 75%。快取讀取佔比高的人,這次是大禮;佔比低的人,這次跟你沒關係。
官方公布的 25%(典型工作負載)與 45%(複雜編碼與高度代理任務)是實測值——量測基礎是 2026 年 8 月四週的實際用量、在預設 effort 之下跑出來的,不是拿降幅換算的。官方那張圖把帳單拆成「快取讀取」與「其他 token」兩塊,典型工作負載的快取讀取大約佔四成,高度代理工作負載大約佔六成五。所以你要做的第一件事不是換模型,是去 Console 看自己的 cache_read_input_tokens 佔多少。
三個算完才發現的細節,每一個都會讓人白花錢
❶ 快取幾次回本,其實沒有改變。
官方定價頁那句「5 分鐘快取讀 1 次回本、1 小時快取讀 2 次回本」是接在「快取命中=標準輸入價 10%」後面寫的,文件補了 Fable 5.1 的命中價是 2.5%,但沒有替它重算回本次數。我自己算了一遍:回本門檻是(寫入倍率 − 1)÷(1 − 讀取倍率),把讀取倍率從 0.1 換成 0.025,5 分鐘的門檻只從 0.278 移到 0.256、1 小時只從 1.111 移到 1.026,兩次都沒有跨過整數界線。結論是回本次數維持不變,變的是回本之後贏多少(這段是我的推算,不是官方數字)。
舉個好懂的:同一段快取被讀 10 次,輸入端總成本從 $22.5 降到 $15,大約省掉三分之一。但如果 1 小時快取只被讀 1 次,總成本是 $20.25 對上完全不快取的 $20——還是沒回本,只是差距從 Fable 5 時代的 5% 縮到 1.25%。
❷ 短提示會靜默不快取,而且不會報錯。
可快取的最短長度是 512 個 token,低於門檻就直接不快取,API 不會給你任何錯誤訊息。驗證方法很機械:看回應 usage 裡的 cache_creation_input_tokens 與 cache_read_input_tokens 是不是同時為 0。是的話,你根本沒在用快取,這篇談的折扣跟你無關。
❸ 讀取變便宜之後,優化的重點跟著換位置。
以前大家想的是「少讀幾次」,現在該想的是「別讓快取失效」。同樣的 token 量,在 Fable 5.1 上一次 5 分鐘快取寫入等於 50 次快取讀取;在 Fable 5 上只等於 12.5 次。倍數變成四倍,不是因為重寫變貴了(快取寫入兩代一模一樣,官方原文寫 Cache writes are unchanged),而是因為讀取便宜了四倍——重寫的相對代價自然被放大。
還有一個很容易中的陷阱:平行送出的請求會全部被算成快取寫入。快取項目要等第一個回應開始之後才可用,所以你如果一口氣併發打十個請求,那十個都是 $12.50 的寫入,不是 $0.25 的讀取。
順帶一提,這次的斷詞器沿用 Claude Opus 4.7 那一代,token 數跟 Fable 5 基本沒變——如果你還在被「同一段中文為什麼多算三成 token」困擾,那是上一輪的事,我在那次漲價取消、Opus 帳單卻多三成的帳我重算過一次裡整個拆過。
什麼時候 Claude Fable 5.1 反而比 Opus 5 便宜?這條不等式自己算
這是我對完官方文件之後最意外的一件事,而且我到現在還沒看到任何一篇中英文報導提到。
先講一個大家都知道、但沒被說破的事實:Claude Fable 5 的每一格價目,都恰好是 Claude Opus 5 的兩倍。輸入 10 對 5、輸出 50 對 25、5 分鐘寫入 12.5 對 6.25、1 小時寫入 20 對 10、快取讀取 1 對 0.5。既然每一格都是兩倍,那不管你的 token 怎麼組成,Fable 5 的帳單就是 Opus 5 的兩倍,數學上不可能便宜。
Claude Fable 5.1 把這件事打破了。官方遷移指南裡有一句話講得很直白:「Prompt cache reads are $0.25 USD per million tokens, half the Claude Opus 5 rate」——快取讀取只要 Opus 5 的一半。
於是就出現了一個交叉點。我把兩邊的成本函數列出來解不等式(以下推導是我自己做的,不是官方數字):
用 5 分鐘快取時,Fable 5.1 比 Opus 5 便宜的條件是——
每輪的快取讀取量 > 本輪快取寫入量 × 25 + 本輪輸出量 × 100
改用 1 小時快取的話,寫入那個係數從 25 變成 40。
白話版本:每產生 1,000 個輸出 token,你至少要重讀超過 10 萬個快取 token,Fable 5.1 才會比 Opus 5 便宜。
套回我前面那張表:中度 agent 的一次性任務仍然是 Opus 5 划算($1.94 對 $3.12);但到了「反覆重讀同一份長脈絡」那一格,Fable 5.1 是 $5.38、Opus 5 是 $6.44——Fable 5.1 反而便宜約 17%。那個「貴一倍」的直覺,在夠吃快取的場景已經不成立了。
這不是我在紙上推出來的孤證。Cognition(做 Devin 的那家)在官方公告裡講的正是同一件事:他們上線當天就把 Devin 裡原本走 Opus 5 的流量切到 Fable 5.1,理由是「有了新的快取讀取定價,Fable 級模型才終於在那些原本非留在 Opus 不可的工作負載上划算,從 code review 開始」。
怎麼判斷自己屬於哪一邊:三個數字,從 API 回應直接抓
不用估、不用猜,這三個欄位在每一次 API 回應的 usage 裡都有,取一段穩定期間的平均就行:
cache_read_input_tokens——快取讀取量,也就是不等式左邊那個數cache_creation_input_tokens——快取寫入量output_tokens——輸出量
如果前兩個都是 0,先別管選型,你根本沒快取到(多半是沒達 512 token 門檻),修好這個再談。
換算成有感的數字:跑一次那種「整天掛著、20 萬脈絡持續重讀」的工作,Fable 5.1 大約是 13 美元,以 2026 年 9 月初約 1 美元兌 31.5 元新台幣的水準粗估,落在四百多塊台幣的量級;同一份工作在 Fable 5 上要三十幾美元。
官方沒有台幣定價(claude.com/zh-TW/pricing 目前是 404),你實際刷卡付的金額還要看當日匯率跟發卡行的國外交易手續費——這筆通常是 1.5% 左右,長期跑 API 的人值得挑一張海外刷卡回饋比較好的信用卡,我把三家 AI 訂閱的手續費與回饋實算過。
🧭 先別急著全部搬過去。官方自己的選型順序沒有改:多數工作負載仍然從 Claude Opus 5 開始,只有在 Opus 5 拉到 xhigh 或 max effort 評測仍然不夠時,才換 Claude Fable 5.1。這條不等式的用途是「你已經決定要用 Fable 級模型時,判斷它到底貴不貴」,不是「Fable 5.1 變便宜了所以無腦選」。想從頭比較整個模型家族,我另外寫過Fable、Opus、Sonnet、Haiku 我每天用下來的精準對比與 30 秒決策樹。
訂閱戶怎麼把 Claude Fable 5.1 開起來(順便:不會有第二次 $100 額度)
如果你是 Pro 或 Max 用戶,這段是你這篇唯一真的要做點什麼的地方。
官方列出可以用 Claude Fable 5.1 的方案是 Pro、Max、Team、Enterprise 四種付費方案,不含 Free。可以用的介面包括 Claude 網頁版、行動版、桌面版、Claude Cowork、Claude Code、Claude Design、Claude for Microsoft 365、Claude Tag。
Max 和 Pro 拿到的是兩種完全不同的東西
| 方案 | Fable 5.1 怎麼算 | 要注意什麼 |
|---|---|---|
| Max、Team/舊制 Enterprise 的 premium 席次 | 方案內含,可把每週額度上限的至多 50% 花在 Fable 系列 | 50% 是上限不是加碼;Fable 消耗額度比其他模型快 |
| Pro、Team/Enterprise 的 standard 席次 | 不含在額度內,從第一個 token 就走 usage credits | 按標準 API 費率計費,與訂閱費分開帳單 |
| 用量型 Enterprise、Claude API | 按標準 API 費率計費 | 就是前面那張價目表 |
兩件事一定要講清楚,因為網路上流傳的還是舊資訊:
❶ 那個「50%」不是多給你 50%。官方 FAQ 被問到「我會不會因此多拿 50% 的週額度」時,回答是一個字:No。那是同一個池子的使用上限,其他模型的用量跟它共用同一池,總量永遠不會超過你原本的週上限。而且官方明講 Fable 系列消耗額度的速度比其他 Claude 模型快。週上限這個池子本身近期也動過幾次,我追過Claude Code 週限額加碼延期那一輪:收回後少的是 33% 不是 50%。
❷ 沒有第二次 $100 額度。2026 年 7 月 Fable 5 移出 Pro 方案時,官方發過一筆一次性的補償額度。那筆錢只適用 Fable 5——官方逐字寫了「there's no equivalent credit for Fable 5.1」,領取已於 2026 年 8 月 2 日截止,已領的餘額 9 月 17 日到期。另外那個「Fable 5 免費吃 50% 週額度」的促銷也在 2026 年 7 月 19 日結束了,而且從來沒有涵蓋 Fable 5.1。當時那三條路怎麼算帳,我在Fable 5 移出 Pro 方案後,額外使用量、升 Max、退回 Opus 三條路我逐條算過寫得很細,方案分層那部分現在依然適用。
看不到 Fable 5.1?多半是這三件事之一
❶ Claude Code 版本太舊。這裡有個小麻煩:官方三個地方的說法對不起來——說明中心寫 2.1.250、開發者文件寫 v2.1.255、CHANGELOG 裡「Added Claude Fable 5.1」的條目落在 2.1.257。與其糾結,直接更新到 2.1.257 以上最省事。順帶一提,更新後外掛設定不會掉,但如果你正好在整理環境,我把Claude Code 外掛從零安裝到防雷的設定心法寫過一輪。
❷ 你沒有選它。這點反直覺但很關鍵:Fable 在任何方案、任何供應商都不是帳號預設模型。Claude Code 的預設是 Max/Team Premium/Enterprise/API 走 Opus 5,Pro 與 Team Standard 走 Sonnet 5。你得自己打 /model fable,或啟動時加 claude --model fable。
還有一個例外要留意:從 Claude 桌面 App 起的 gateway session,fable 這個別名目前仍會解析到 Fable 5,得在 /model 選單裡明確挑 5.1。
❸ 你照著官方 zsh 範例貼了。這個真的要小心——官方說明頁的 zsh 那段把模型 ID 打成了 claude-fable-5-11(多一個 1),同一頁的 bash 段落卻是對的。照抄會設到一個不存在的模型。正確的 ID 一律是 claude-fable-5-1。
Pro 用戶最該知道的一件事:什麼時候會開始扣你錢
Claude Code 在 Fable 請求會扣 usage credits 之前,互動式 session 會先跳同意提示,模型選單那一列也會標「Requires usage credits」。但非互動模式(加 -p 旗標)與 Agent SDK 不會問,直接計費。如果你有排程腳本在跑,這一條先確認過再改模型——尤其是你已經開了額度重置後自動接著跑的那個開關的話,跑的模型是誰就直接決定了帳單長相。手機 App 的訂閱者只能在網頁版啟用與購買 usage credits,App 內做不到,額度另有每日兌換上限 2,000 美元。
訂閱價目前仍是美金計價:Pro 月繳 $20、年繳一次付 $200(折算每月 $17);Max 5x 是 $100/月、Max 20x 是 $200/月且只有月繳。想看四檔怎麼挑,我在Claude 訂閱方案四檔我算過一輪,多付 US$80 升 Max 上下文其實沒變大裡把每一檔的實際到手內容拆開比過。
🔍 一個容易被誤會的頁面。到我查證的這一刻,
claude.com/pricing這個行銷頁還停在 Fable 5 時代:方案比較表的提示文字還寫「Claude Fable 5 is included on Max plans…」、API 價目卡的快取讀取仍標 $1、脈絡窗那列還寫 200k。這是頁面沒同步,不是訂閱戶不能用。以 Anthropic 說明中心與開發者文件為準——Fable 5.1 在聊天、Claude Code、Cowork 三個介面對付費方案都是 100 萬 token 脈絡窗。
22 家公司拿 Claude Fable 5.1 做了什麼、量到什麼數字
官方跑分表我等一下會講怎麼讀(它有三個坑)。但我自己更看重的是另一份東西:官方公告裡放了 22 家早期夥伴的實測回饋,每一家講的是自己產業裡的具體工作。要判斷一個模型跟你合不合,找一家工作內容像你的公司,比看 benchmark 分數有用得多。
| 公司 | 測的是什麼工作 | 量到的結果 |
|---|---|---|
| Browserbase | 最難的瀏覽器代理 benchmark | 完成 82%(每題約 10 分鐘),Opus 5 為 74%、Fable 5 為 57%,且 token 用得比兩者都少 |
| Cognition(Devin) | 把 Opus 5 流量切過去做 code review | 上線日就切;表示新快取價讓 Fable 級模型首次在這些工作上划算 |
| Crosby | 合約紅線 RedlineBench | 47.9 → 57.0,增益多半來自第一輪品質(該項分數翻倍),編輯也更精簡 |
| Rogo | 金融分析與投影片生成 | 準確度與 Fable 5 持平,但少用 20% token |
| Samaya | FrontierFinance 投資工作流 | rubric 49.2 → 55.9;會直接去看法說會逐字稿抓管理層原話而非引二手報導 |
| Glean | 日常問答、高意圖研究、草稿產出 | 判官模型偏好 Fable 5.1 的答案約以 2 比 1 勝過 Fable 5 |
| iGent | 研究級難題與 GPU kernel 優化 | 把 Fable 5 已優化不動的 kernel 再加速約 35% |
| Ramp | 無人值守的機器學習長跑 | 一次 38 小時:診斷出先前結果是標籤假象、做出修正、啟動六個平行實驗跑整夜 |
| MongoDB | 從零建複雜原型 | 約 3 天完成,其中無人值守跑數小時,隔天帶回完整視覺化 walkthrough |
| Plaid | 跨 8 個以上服務、3 個 codebase 的變更 | 端到端映射到個別函式與資料表都正確 |
| Datadog | 生產事故根因分析 | 推理強於 Opus 5,診斷出他們測過最複雜的生產事故 |
| Canva | 寫作品質盲測與程式生成 | 盲測偏好其寫作;做出有真實音樂、節拍對得上的節奏遊戲 |
| Hebbia | PowerPoint 與財報引用查核 | 兩項自評皆為測過最佳;複雜多段問題首次每一段都答到 |
| Shopify | 長時間無人值守工作流 | 長跑不失焦、自己記錄、能從中斷處接續 |
| Red Hat | 壞掉的 build 找根因 | 測試的每個壞 build 在所有 effort 等級都正確找出根因(樣本數未公布) |
| Every | 當日常主力模型 | 「Fable 級智慧、Opus 級價格、Sonnet 級速度」;比 Opus 5 快約 2 倍、token 用量只有一半 |
| Block | 30 天模擬經營公司 | 每 token 效率遠高於 Opus 5 |
| SpaceXAI | CursorBench 3.2.0 | max effort 73.4%,為其測過最強;medium effort 68.0%/每題 $3.53 已超過對手 max effort 的 67.2%/$5.69 |
| Millennium | 百萬分之一機率才崩潰的程式 | 四到五年無人能解、含 Fable 5 在內每個模型都漏掉;它反組譯外部廠商函式庫比對 core dump 找到根因 |
(另外四家是 Jane Street Capital、IMC、Rakuten 與前述公司,內容分別是量化交易直覺、研究套件創意解法、臨床研究專案查核。)
誠實標一下:這 22 則絕大多數是各家自己的 benchmark 與自評,不是第三方獨立評測。唯一由第三方獨立量測並回報的是 CursorBench——官方系統卡寫「measured and reported independently by Cursor」,但公告的引言公司名標的是 SpaceXAI,兩份官方文件用詞不同,我照兩邊原樣並陳,不自行合併。
我自己讀這張表最在意的是 Every 那句「Fable 級智慧、Opus 級價格、Sonnet 級速度」,以及 Rogo 的「準確度持平但少用 20% token」。這兩句合起來的意思是:就算你不是為了那 45% 的折扣來的,光是它把同一件事做完所需的 token 變少,帳單就已經動了。
如果你想看的是跨品牌對決而不是 Claude 自家換代,我另外寫過五大旗艦的價格與跑分攤開比,最強的不一定是最該付錢的那個。上一代 Fable 5 我還實際拿它跟另外四家做過同一份任務,結果在五大 AI 做遊戲實測:最貴的不是最好玩,最慢的反而最認真。
破壞性變更一:tool_choice 設成 any 或 tool,Claude Fable 5.1 直接回 400
從這裡開始的三段是給自己組 messages 陣列的人看的。介面使用者可以直接跳到下一個大段。
第一個變更最單純,也最容易在改模型 ID 的第一分鐘就撞到。Claude Fable 5.1 與 Mythos 5.1 不支援強制工具呼叫,tool_choice 設成 {"type": "any"} 或 {"type": "tool", "name": "..."} 會回 400 invalid_request_error,訊息逐字是:
tool_choice: type "tool" and "any" are not supported for this model.
這句可以直接拿去 grep 你的 log。{"type": "auto"}(預設值)跟 {"type": "none"} 完全不受影響。要注意這個檢查在 Messages API、Message Batches API、token counting 三個端點都會跑,所以你連估 token 都會被擋。
官方解釋的原因我覺得滿有說服力:這些模型的思考是永遠開著的,強制工具呼叫會直接跳過思考階段,模型只好把推理過程寫進工具參數裡,反而讓參數品質變差。換句話說,這不是把功能拿掉,是把一條會傷害輸出品質的路封起來。
三條替代路線,先問自己「我到底要什麼」
❶ 只是要 schema 合規的 JSON。保持 tool_choice: auto,在工具定義加上 strict: true(文法約束取樣)。代價是:使用 CMEK 的組織不能用,而且 computer_toolset_20260801 與 browser_toolset_20260801 不接受 strict——這一條對台灣的金融、醫療客戶特別關鍵,值得先確認。
❷ 其實根本不需要跑工具、只是要結構化 JSON。改用 structured outputs 的 output_config.format。代價是會被注入額外的 system prompt 讓 input token 略增;而且改動 format 會清掉該對話的 prompt cache(想想前面算的帳,這件事現在比以前更痛);第一次用某個 schema 還有文法編譯延遲,之後快取 24 小時。
❸ 你是真的要它去呼叫那個工具。在提示裡直接點名就好,例如「Use the get_weather tool to answer」。官方說 Fable 5.1 對明確的工具指示遵循度很可靠。
如果你的應用層非強制不可,官方給的正解是:在最新的 user turn 之後追加一則 role: "system" 訊息去點名工具。這是 stable 功能、不需要 beta header,而且因為是「追加」不是「改寫」,前面每一個 turn 都保持逐位元不變,prompt cache 繼續命中——你會發現這個設計思路,跟後面第三個變更是完全同一套邏輯。
擺放有兩個限制,放錯一樣回 400:不能是 messages 的第一則,也不能夾在 tool_use 與它對應的 tool_result 之間。
官方推薦的組合拳是三個一起上:tool_choice: auto + strict: true + 指令裡點名工具。
破壞性變更二:換模型會靜默丟掉推理,Claude Fable 5.1 不報錯也不計費
這一個沒有錯誤訊息,所以它比會噴 400 的那個危險得多。
Claude Fable 5.1 的思考區塊是單向綁定的:它讀得到 Claude Opus 5、Fable 5、Mythos 5、Opus 4.8 以及更早模型產生的思考區塊,但反過來不行——除了它自己和 Mythos 5.1,沒有任何模型讀得到 Fable 5.1 產生的區塊。
一句話記住:往上升級不掉推理,往下降級一定掉。
「靜默」的意思是:API 在模型看到之前就把區塊移除,請求照樣回 200,被丟掉的 token 不計入 input_tokens、也不計費。你的 dashboard 全綠,錯誤率是 0,但目標模型拿到的是一段被抽掉推理的對話,只好重新規劃一次——你看到的現象會是「換模型之後品質怪怪的、第一個 turn 特別慢也特別貴」,然後你完全查不出原因。
要讓它現形,送一個 beta header thinking-binding-controls-2026-08-01,回應就會多出一個頂層的 input_transformations 陣列,長這樣:
{"type": "thinking_dropped", "path": "messages.1.content.0", "reason": "model_binding_mismatch"}
reason 只有兩種值,分得很清楚:model_binding_mismatch 是換模型造成的,官方明說這不是你的 bug、不用修;prefix_binding_mismatch 是你自己改了前文,那個要修(就是下一段的主題)。
串流的人多留意一個坑:input_transformations 出現在 message_start 的 message 物件上;但如果中途發生 server-side fallback,最後的 message_delta 會再帶一次。只監聽 message_start 會漏掉後面那次。
三種很常見的架構會中招
❶ 多模型 router:用便宜模型先分類、再把對話丟給貴模型(或反過來)。
❷ client 端重試換模型:一個模型逾時就換另一個重送。
❸ 分類器拒答後 fallback:包含官方的 server-side fallback。這裡有個很容易漏的細節——安全分類器的拒絕不是錯誤,它回的是 HTTP 200 帶 stop_reason: "refusal"、content 是空陣列。你如果是用 5xx 或錯誤率做監控,這件事永遠不會出現在你的告警上。
順帶提醒兩件錢的事:Fable 5.1 允許的 fallback 目標只有 Claude Opus 4.8 與 Claude Opus 5,你不能指定 Sonnet 或 Haiku 來省錢。而 fallback credit 退的是「換模型後必須重寫快取」的那個價差,不是退整筆錢;它的 token 五分鐘就過期,而且兌換時 request body 一個字都不能改——所以不要自己先剝掉思考區塊,官方要的是你原樣送回、讓 API 自己去丟。
破壞性變更三:動了前面的對話,後面的思考就失效——8/31 是分水嶺
這是整篇的重點,也是我覺得這次改版最值得被講出來的一件事。
規則本身一句話:在 Claude Fable 5.1 上,只要你改動了某個思考區塊「前面」的任何東西——system 提示、tools 陣列,或任何較早的訊息——下一次請求就會失敗。錯誤訊息是:
The block is bound to a different conversation
如果你沒送 beta header,訊息還會多一句點名 thinking-binding-controls-2026-08-01——看到那句話,就代表你的帳號已經在強制執行了。
兩個必須先講的操作事實。第一,這個錯誤是永久性的:同一個 request body 重試一百次還是失敗,指數退避那一套完全無效,只會白燒 quota。第二,drop_block 是連坐——它不只丟掉那一個區塊,而是丟掉它以及對話中它之後的每一個思考區塊。
還有一個反過來的預設值要小心:Message Batches API 在你沒設 prefix_mismatch_behavior 時,預設是「丟掉失敗的區塊」而不是讓批次項目失敗。想要它報錯,你得明確設成 "error"。
官方的「什麼算編輯」對照表
| ❌ 會讓後面的思考區塊失效 | ✅ 不會失效 |
|---|---|
| 編輯、重排或刪除較早的 turn | 在結尾追加 |
| 每回合注入、下回合又刪掉的提醒文字 | 從最舊那端依序移除思考區塊 |
重建頂層 system 或 tools 陣列 |
改 max_tokens、tool_choice、metadata 等其他參數 |
| 從中間抽掉一個思考區塊 | 移動 cache_control 標記 |
| 圖片或文件 URL 下次回傳不同的位元組 | 改 effort、server-side compaction 與 context editing |
(圖片那條有個貼心的設計:檢查看的是位元組不是網址,所以同一個檔案用會輪替的簽章 URL 沒問題。)
我看過不少人寫 agent 迴圈的手法,就是每一回合往歷史裡塞一句提醒——「記得先檢查收件匣」「使用者看不到這段工具輸出」——下一回合再把它拿掉。這是最常見的失效模式,而且以前完全不會有人告訴你它有問題。正解是改用 turn-scoped system message:role: "system" 加上 clear_at: "next_user_message"(beta header mid-conversation-system-clear-at-2026-08-21),它在當回合有系統提示的權威,之後不再渲染、也不花 input token,但必須逐字留在陣列裡繼續送回去,永遠不要刪。
中途要換工具集也一樣:用 defer_loading: true 先宣告,再用 tool_addition / tool_removal 開關(beta header mid-conversation-tool-changes-2026-07-01)。沒被引用過的 deferred 工具不算 prefix,追加是安全的;直接追加一般工具則不安全。
今天就能做的自查,兩種都不用改架構
❶ 離線 diff(連 API 都不用打):把連續幾次請求的 request body dump 下來,比對 system、tools 與 messages 的共有前綴是不是逐位元相同。不同的那一格,就是你要修的地方。
❷ 線上實測:在請求裡設 thinking.block_binding.prefix_mismatch_behavior 為 "drop_block" 跑一輪,把 input_transformations 全部記下來,看有幾個 prefix_binding_mismatch。注意——任何帳號只要設了這個欄位,就等於自己把執行打開了,這也正是舊帳號可以主動提前測試的方法。CI 上建議設成 "error",讓任何一次歷史編輯直接讓 build 紅燈。
至於 client 端 compaction,官方沒有禁止,紅線只有一條:不要把一個思考區塊留在你已經重寫過的前綴後面。最安全的形狀是整段壓成一則摘要+一個新的 user turn,不重播任何舊 turn。另外別在一個 tool round 的中間做 compaction——tool_use 還在等 tool_result 的那個 assistant turn,必須連同思考區塊原樣送回。
為什麼要這樣做:這條規則的真名叫反蒸餾
官方在發布公告裡把動機講得很白,而且它被放在「Anti-distillation mechanisms」這個小標下面。
Anthropic 是把思考區塊加密的,但過去有一個公開流傳的技巧:改掉思考區塊之前的對話,就能誘導 Claude 把自己的推理解密印出來。而蒸餾這件事往往是工業規模在做的——用上千個假帳號,把前沿模型的能力抽出來,之後可能在沒有對等防護的情況下被發布。所以官方選擇從新帳號開始把這條路關掉,並且說明會「逐步推出以降低干擾」,未來的模型則會對所有使用者適用。
對照一下你就會發現一件事:官方要你做的每一件事——不要改前文、用追加取代改寫、把提醒改成不刪的 turn-scoped 訊息、把 compaction 交給 server 端——同時也正好是讓 prompt cache 一直命中的做法。換句話說,這一代把「安全要求」跟「省錢誘因」設計成了同一個方向。你照做,帳單自己會變少;你不照做,先是快取一直被打掉,然後某一天直接噴 400。
順帶一提,如果你懶得自己一條條改,Claude Code 裡可以直接跑 /claude-api migrate this project to claude-fable-5-1,它會處理模型 ID 替換、破壞性參數變更、prefill 替換與 effort 校準,並產出一份需要人工確認的清單。這類自動化改造我自己會習慣先開一個乾淨分支再跑,理由跟我在AI 驗收的 5 道關卡寫的一樣:讓它改可以,但驗收的責任不能一起外包出去。
不改一行程式,Claude Fable 5.1 也會變的七件事(附官方修法該放哪)
這段回到所有人都用得上。就算你什麼都沒改,換到 Claude Fable 5.1 之後有七件事的手感會不一樣,官方全部列出來了,也給了修法。
先說一句:這七件事跟「它是不是變笨了」是兩回事。每次改版都會有一批人覺得模型退步,其中有真的行為改變、也有限流與體感的錯覺,我把兩者怎麼分辨寫在Claude/ChatGPT 突然變慢變笨,是被降智了嗎。下面這七件是官方自己列的、有明確修法的那一類。
症狀❶ 一回合只叫一個工具。在「下一步要抓什麼是任務隱含、而不是你明講」的 agent 迴圈裡,Fable 5.1 可能一次只發一個工具呼叫,Fable 5 會batch 好幾個。多出來的來回吃 token、吃往返次數、吃時間——這是七項裡唯一一項官方明確保證「不會降低答案品質」的(原文 but don't reduce answer quality)。修法是加一句指令,要它先私下列出接下來需要什麼、再把彼此不相依的請求一次發出。
症狀❷ 跑很久都不說話。先別急著改提示詞——第一步是確認你的 client 收不收得到。thinking.display 的預設值是 "omitted",模型寫的進度更新會回傳成空的 thinking 區塊,長長的一輪 agent 工作在使用者眼中就是一片沉默。設成 "updates"(beta header thinking-display-updates-2026-08-18)才拿得到那些文字。第二步才是刪掉你自己提示詞裡「把發現留到最後再一起說」這類抑制句。
症狀❸ low effort 更常憑記憶回答、不去搜尋。這是官方點名要留意的風險,不是無害的差異。最省事的解法不是整段對話拉高 effort,而是只把需要新鮮資訊的那幾回合調高。官方另有一段要放在系統提示裡的查證引導。
症狀❹ 文字變密了。句子更長、段落更少。官方修法有長短兩版,短版就一句話:Please remove all mannered prose. 而且官方特別註明,這句放在使用者訊息裡比放系統提示更有效。
症狀❺ 聊天裡的粗體、標題、清單變少了。這一項的修法很反直覺——第一步是刪掉你自己為舊模型寫的「不要用格式」規則,不是再加一條新規則。很多人的個人偏好設定裡就躺著這種句子,那是為了對付以前的模型愛排版寫的,現在反而會把該有的結構壓掉。
症狀❻ 做摘要時更常不標引號地重現原文段落。對做內容的人來說,這是實實在在的抄襲風險,我看到這條的時候是真的坐直了。官方的修法不是加規則,而是在系統提示裡放一個完整的正確範例(含使用者提問、正確回答、以及一句說明為什麼這樣才對),並提醒要把範例裡的 [web_search: ...] 換成你自己工具的名字。
症狀❼ 小改動也傾向整檔重寫。結果通常一樣,但多花輸出 token 跟時間。這段指令可以放系統提示,也可以放第一則使用者訊息。
🔴 一個必須誠實講的限制。這份 prompting guide 是寫給 API 開發者的,全文沒有提到 claude.ai、也沒有提到 CLAUDE.md。官方明說可以放進使用者訊息的只有三段:文字密度、避免整檔重寫、以及 xhigh/max 的長輸出提醒。其餘幾段都要放系統提示才有效。把 API 用的提示詞包裝成「人人複製貼上就見效」,是這次我在查證裡看到最多的誤導。
還有兩個實用發現順便放這裡。一是安全誤攔有三個已知的觸發情境:問「這程式編譯得過嗎」這種措辭(改問「這程式有沒有 bug」就好)、冷門程式語言、以及工具輸出裡出現 base64。
二是 effort 的建議跟直覺相反——xhigh 與 max 可能先在思考裡把整份長交付物草擬一遍、再寫一次,等更久又多花 token,官方對這類長輸出請求的第一建議是乾脆用 high 跑。而且 effort 等級名稱在不同模型之間不對應同樣的思考量,你在 Fable 5 上調好的參數要重跑一次。effort 五個等級各自怎麼挑,我在Opus 5 那篇的 effort 調法裡寫過一輪,那套邏輯在這裡一樣適用。
好消息是 claude.ai 也調得到 effort:點送出鍵旁邊的模型名稱 →「Effort」→ 選等級,官方確認這個選單支援 Fable 5.1、Opus 5、Sonnet 5、Fable 5 等模型。Fable 5.1 在 Claude API 與 Claude Code 的預設是 high,在 Claude Cowork 與 claude.ai 是 medium。Max 用戶如果覺得 Fable 吃額度太快,把 effort 調低是最直接的一招——低 effort 一樣能用,只是別拿它問需要查最新資料的問題(見症狀❸)。想再壓一點用量,我整理過不升級也能讓 token 砍半的 10 個習慣。
另外提醒:Fable 5.1 的思考不能關閉,在所有 effort 等級、包含 Claude API 都是永遠開著的。這跟 Opus 5 不一樣(Opus 5 在 high 以下可以關)。
同一個模型卻差 5.1 分:Claude Fable 5.1 的安全防護鬆綁到哪、還會被擋什麼
這一段我認為是官方文件裡最被低估的東西。
Claude Fable 5.1 與 Claude Mythos 5.1 是同一個底層模型,只有外圍防護不同——這句話官方在公告與系統卡裡總共講了五次。然後在 Terminal-Bench 4.0 上,Fable 5.1 拿 55.8%、Mythos 5.1 拿 60.9%。
官方對這個差距的解釋是:它反映的是「舊版較不精準的 cyber 防護介入的那些任務」,並預期新防護上線後差距會小很多。
換句話說——那 5.1 個百分點,就是安全防護的價碼,而且是 Anthropic 自己公開量化出來的。這個 benchmark 的標準誤只有 ±1.6 到 2 個百分點,所以它不是雜訊。官方甚至自承 Fable 5.1 是在「生產防護全開」的狀態下跑分,被防護攔下的題目直接記 0 分,「這很可能壓低了 Fable 5.1 與 Fable 5 在這些 benchmark 上的表現」。
順便破除一個我看到很多人搞反的誤讀:Mythos 5.1 不是「更受限的版本」,它是防護更寬鬆的那一版。受限的是取得資格——它只開放給 Project Glasswing 的參與者,目前僅限一組美國組織,一般個人與企業拿不到。有些英文報導的框架把這件事寫反了。
放行了什麼、還擋什麼
已放行:Fable 5.1 現在可以用來找出軟體漏洞,也就是提升自家系統安全的防禦性資安工作。這是這一代最實質的鬆綁。
仍然轉給 Opus:滲透測試、exploit 生成、二進位漏洞掃描會轉到 Opus 4.8;病毒學、毒理學、藥物與分子設計等雙用途生技題會轉到 Opus 5。
數字面:Claude Code 使用者平均每個 session 少約 60% 的 cyber 防護介入(這是官方內文的口徑,摘要另有一句寫成「誤攔少 60%」,兩者講的不是同一件事)。生物防護對初階生物與醫療類良性提問的觸發率少 85%。各產品面的總 fallback 降幅大約是 claude.ai 67%、Cowork 55%、Claude Code 17%、Claude Platform 7%。
「我明明選了 Fable,為什麼回我的是 Opus?」
因為自動切換模型是預設開啟的。有三件事值得知道:
❶ 防護會掃描模型讀到的所有內容,不只你剛打的那句——包含記憶、連接器內容、網頁搜尋結果與檔案。所以你可能被自己根本沒打的東西觸發。
❷ 被擋的計費規則:輸入端就被擋等於全部按 Opus 費率;串到一半才被擋,前半按 Fable 5.1 費率、後半按 Opus 費率。
❸ 切換後模型選擇器會停在 Opus,要自己切回來;而且如果原始請求還留在對話裡,可能再被擋一次,官方建議先編輯前一則訊息再重試。想關掉的話在 Settings > Capabilities(Claude Code 是 Config > MODEL & OUTPUT),關掉後被擋的請求會暫停對話而不是換模型。
讀官方跑分表的三條紅線
❶ 表上所有數字都是 max effort、五次取平均,而 claude.ai 預設是 medium、只跑一次。你在聊天視窗的體感本來就不會等於跑分。
❷ OSWorld 2.0 的 partial(77.9%)與 strict(41.7%)差 36 個百分點,絕對不能混用;官方也明文寫 OSWorld 2.0 與 CursorBench 不可跨版本比較。
❸ 系統卡裡另有五項 Fable 5.1 不是第一名:SWE-bench Multilingual 與 Multimodal 輸給 Opus 5、HealthBench Professional 輸給 Fable 5、ARC-AGI-1 輸給 Fable 5、ARC-AGI-2 輸給 GPT-5.6 Sol。官方公告當然不會把這些放在首頁。
Claude Fable 5.1 規格、30 天資料保留與浮水印:採購前要確認的事
如果你是要幫公司做決定的人,這段是實際會卡住流程的地方。
| 項目 | Claude Fable 5.1 |
|---|---|
| 模型 ID | claude-fable-5-1(Bedrock 為 anthropic.claude-fable-5-1) |
| 脈絡窗 / 最大輸出 | 100 萬 token / 12.8 萬 token |
| 知識截止 | 2026 年 6 月 |
| 思考 | 自適應思考永遠開啟,不能關閉 |
| 狀態 | Active (latest);退場不早於 2027 年 9 月 1 日 |
| 資料保留 | 30 天最低保留;除非 Anthropic 明文授權,否則不提供零資料保留(ZDR) |
把「知識截止在 2026 年 6 月」跟前面那條「low effort 更常憑記憶回答」放在一起看,就會得到一條很具體的使用建議:問時效性題目時,要嘛把 effort 拉高,要嘛明確要求它先去查。
那個「30 天保留」到底打到誰
這條最近在中文社群被轉得有點失真,我把它講清楚。
Claude Fable 5.1 與 Mythos 5.1 被官方指定為 Covered Models(指定日期是 2026 年 8 月 31 日),這類模型帶 30 天最低資料保留,而且在能存取它們的 workspace 裡不提供零資料保留。
但這條政策真正打到的,是「原本就設了 ZDR」的組織——Console 的 ZDR workspace、用 ZDR 跑 Claude Code 的 Enterprise、透過 Bedrock/Google Cloud/Microsoft Foundry 以 ZDR 存取的客戶。個人的 Free/Pro/Max,以及一般預設保留設定的 API 帳號,完全不受影響,也不用做任何設定。原本有 ZDR 需求的組織可以繼續用先前的 Claude 模型。
保留期內預設沒有 Anthropic 人員可以讀你的對話;人工審查只在自動化系統標記之後、由少數核准審查者進行,每次存取會寫入審查者無法竄改的日誌,30 天後自動刪除。
至於 Enterprise Frontier Safeguards(EFS)——資料存在客戶自己的雲、客戶自管金鑰——今年秋季分階段推出,Anthropic 不收費但你要付自己雲端的儲存與 egress 費用。對台灣的中小企業與個人開發者來說,這個幾乎等於沒關係:它是 enterprise 專屬、要申請,資格門檻官方也沒公開定義。
如果你在意的是自己的聊天資料會不會被拿去訓練,那是另一組開關,我整理過五家 AI 的訓練開關路徑與關掉後還留多久。
內容標記:兩套機制,別搞混
Claude Fable 5.1 與 Mythos 5.1 產出的文字,在所有可用平台都帶 Anthropic 的統計式浮水印。它不新增 token、不含隱藏字元、不含任何關於你或你組織的資訊,也不改變輸出的意義與品質。這是因為 Anthropic 在 2026 年 7 月與另外 190 家簽署方一起簽了歐盟 AI 法案的《AI 生成內容透明度行為準則》,要為 2026 年 8 月 2 日之後發布的模型加上標記——Fable 5.1 是第一批從發布第一天就帶標記的模型。
圖片與影片是另一套:Claude 透過程式碼執行工具產生的支援檔案,要在你用 Claude API 的 Files API 取回時,才會帶簽章的 C2PA Content Credentials。
驗證這件事目前是兩層:免費的 Claude Content Checker 已經上線可以自己驗檔;但文字偵測 API 仍是 private preview,只開放給有歐盟法規義務的一方(監管機關、執法、媒體、事實查核、獨立研究者、教育機構、歐盟公民社會團體)與有相同合規義務的企業,一般人跟一般公司拿不到。浮水印本身是全球一起上、不分區域的。
想知道這套浮水印實際上怎麼運作、哪類文本最容易被驗到,我把官方公開的原理整個拆過一次在Claude 浮水印怎麼驗:沒有隱形字元,翻譯稿最容易被驗到。
Claude Fable 5.1 要不要現在動?一張表看你該做什麼
把前面所有東西收成一張表。
| 你是誰 | 現在該做什麼 | 成本 |
|---|---|---|
| claude.ai / Cowork 訂閱戶 | 模型選單直接選 Fable 5.1;Max 覺得吃額度快就把 effort 調低 | Max 內含(上限 50% 週額度);Pro 走 usage credits |
| Claude Code 使用者 | 更新到 2.1.257 以上,/model fable 選起來(它不是預設) |
同上;非互動模式不會問就計費,先確認排程腳本 |
| 用官方 SDK / Agent SDK 的開發者 | 換模型 ID,移除 tool_choice 的 any/tool,重跑 evals |
低;官方已幫你維持 prefix 完整 |
| 自組 messages 陣列的開發者 | 今天就跑歷史編輯自查,改掉注入又刪除的提醒 | 要花時間,但報酬是快取一直命中=帳單變少 |
| 有 ZDR 需求的組織 | 先確認資格,或繼續用先前的模型等 EFS | 可能直接卡關 |
不適合現在動的人:快取讀取佔帳單比例很低、一次性長 prompt 為主的用法(這次降價你拿不到,Opus 5 仍然明顯便宜);以及有硬性零資料保留要求的組織。
我自己的結論是這樣:Claude Fable 5.1 最有價值的地方,不是它跑分又前進了多少,而是它第一次讓「把對話寫乾淨」這件事有了直接的金錢回報。以前你把歷史整理得再漂亮,省下的也只是那 0.1 倍的快取讀取價;現在同一件事的報酬變成四倍,而且不做的話遲早會撞上 400。
某種程度上,這比多幾個百分點的 benchmark 更像一個世代交替的訊號——模型公司開始用定價和錯誤碼,去教你怎麼跟它相處。
如果你也在每天跟這些工具搏鬥,我平常在部落格寫的就是這些踩坑與算帳的過程,Claude 相關的更新我會持續跟。下一步想繼續看的話,AI agent 一個任務燒掉好幾美元的真相與砍半省 token 心法跟這篇是同一條線,可以接著讀;想一次看完我手上這批工具怎麼分工,可以從按需求挑 AI 工具的總整理那篇開始。
FAQ 常見問題
Claude Fable 5.1 和 Claude Fable 5 差在哪?
同價、只有一格降價、外加三個破壞性變更。五格價目裡只有快取讀取從 $1 降到 $0.25/百萬 token(基本輸入價的 0.025 倍,其他模型是 0.1 倍),輸入 $10、輸出 $50、5 分鐘快取寫入 $12.50、1 小時 $20 全部沒動。官方說典型工作負載的總成本約降 25%、高度代理任務最多約 45%。要留意的是三個破壞性變更(強制工具呼叫回 400、思考區塊單向綁模型、改動前文會讓思考失效)與七件不改程式也會遇到的行為變化。
我只用 claude.ai 或 Claude Code,這些破壞性變更會影響我嗎?
不會。官方說明中心逐字寫明使用 Claude Code、Claude Cowork、claude.ai 或透過第三方產品用 Claude 的人「are not affected」,開發者文件另外把 Claude Managed Agents 與 Claude Agent SDK 也列進豁免名單。唯一要動手的是自己組 messages 陣列、直接打 Messages API 的人。你要做的只有兩件事:把 Claude Code 更新到最新版,然後用 /model fable 把它選起來。
為什麼我把 model 換成 claude-fable-5-1 就回 400?
最可能是 tool_choice。Claude Fable 5.1 與 Mythos 5.1 不支援強制工具呼叫,設成 {"type": "any"} 或 {"type": "tool", "name": "..."} 會回 400,訊息是 tool_choice: type "tool" and "any" are not supported for this model.。auto 與 none 不受影響,Messages API、Batches API 與 token counting 三個端點都會擋。原因是這些模型思考永遠開著,強制呼叫會跳過思考。要 schema 合規的 JSON 就保持 auto 加 strict: true,或改用 structured outputs;要它真的呼叫工具就在提示裡點名。
出現「The block is bound to a different conversation」是什麼意思?
代表你在兩次請求之間改動了某個思考區塊前面的東西——system 提示、tools 陣列,或任何較早的訊息。這個錯誤對同一個 request body 是永久的,自動重試迴圈解不掉。
有兩條出路。
❶ 剝掉歷史裡所有 thinking 與 redacted_thinking 區塊,重送一次。
❷ 送 thinking-binding-controls-2026-08-01 這個 beta header,並設 prefix_mismatch_behavior: "drop_block"。
但要注意 drop_block 是連坐,會丟掉該區塊與它之後的每一個思考區塊,而且該設定只對那一個請求生效、之後整段 session 都要繼續帶。然後回頭修掉造成編輯的那段程式碼。
我的 API 帳號是舊的,這條限制現在會管到我嗎?
分界是 2026 年 8 月 31 日 00:00 UTC,換算台灣時間是 8 月 31 日早上 8 點。之後建立的 Claude Platform 組織、Amazon Bedrock 帳號、Google Cloud Vertex AI 專案、Microsoft Azure Foundry 專案已在強制執行;更早建立的帳號目前 API 只記錄不動作。但官方明說未來的模型會對所有帳號一律適用。做工具、做框架的人要特別注意:你的 key 多半在舊帳號,你的使用者卻可能在新帳號,他們會比你先撞到。自測法是在請求裡設 prefix_mismatch_behavior,任何帳號設了就等於主動開啟執行。
Claude Fable 5.1 真的比 Fable 5 便宜 25% 嗎?
要看你的快取讀取佔帳單多少。降價只發生在快取讀取這一格,其他四格一毛沒動。官方的 25%(典型)與 45%(高度代理)是 2026 年 8 月四週實際用量、在預設 effort 下量出來的實測值,官方圖表顯示典型工作負載中快取讀取約佔帳單四成、高度代理工作負載約佔六成五。
如果你是一次性長 prompt、沒有重複使用同一段上下文,這次降價一毛都省不到。另外官方原文限定是「按 token 計費的地方」——Claude Pro/Max 這類固定月費訂閱,帳單不會因此變便宜。
什麼情況下 Claude Fable 5.1 反而比 Opus 5 便宜?
Fable 5 的每一格價目都恰好是 Opus 5 的兩倍,數學上永遠不可能便宜。Fable 5.1 把快取讀取變成 $0.25、只有 Opus 5($0.50)的一半,第一次打破這個關係。
判準(我自己推導的):每輪快取讀取量要大於「本輪快取寫入量 × 25 + 本輪輸出量 × 100」(5 分鐘快取),用 1 小時快取則寫入係數改成 40。白話說,每產生 1,000 個輸出 token,至少要重讀超過 10 萬個快取 token。實務上要到「反覆重讀同一份長脈絡」那個量級才會翻盤。官方的選型順序也仍是先 Opus 5,評測在 xhigh 或 max effort 下不夠才上 Fable 5.1。
Claude Code 裡看不到 Fable 5.1 怎麼辦?
要做兩件事。
❶ 更新到最新版(官方三處版本號說法不一致,建議直接更新到 2.1.257 以上)。
❷ 自己把它選起來。Fable 在任何方案、任何供應商都不是帳號預設模型:在 session 裡打 /model fable,或啟動時 claude --model fable。Claude Code 的帳號預設是 Max/Team Premium/Enterprise/API 走 Opus 5,Pro 與 Team Standard 走 Sonnet 5。
另有一個例外:從 Claude 桌面 App 起的 gateway session,fable 目前仍會解析到 Fable 5,要在 /model 裡明確挑 5.1。
我是 Pro,用 Claude Fable 5.1 會不會被扣錢?還有沒有那筆 $100 額度?
會扣,而且沒有第二次 $100。Pro 方案與 Team/Enterprise 的 standard 席次用 Fable 5.1 是從第一個 token 就走 usage credits,按標準 API 費率計費、與訂閱費分開帳單。那筆一次性 $100 補償只適用 Fable 5,官方逐字寫「there's no equivalent credit for Fable 5.1」,領取已於 2026 年 8 月 2 日截止、已領餘額 9 月 17 日到期。Claude Code 的互動式 session 會在扣款前跳同意提示,但非互動模式(-p 旗標)與 Agent SDK 不會問、直接計費。
Max 方案能免費用 Claude Fable 5.1 嗎?那個「50%」是什麼意思?
Max 方案與 Team/舊制 Enterprise 的 premium 席次是方案內含,可以把每週額度上限的至多 50% 花在 Fable 系列上、不另外收費。但那是上限不是加碼——官方 FAQ 直接回答 No,你不會因此多拿 50% 週額度,其他模型的用量跟它共用同一池,總量永遠不會超過原本的週上限,而且 Fable 消耗額度的速度比其他 Claude 模型快。用完之後只能改掛 usage credits 或換模型。
Claude Fable 5.1 和 Claude Mythos 5.1 是同一個模型嗎?哪個比較強?
是同一個底層模型,只有防護等級不同。Terminal-Bench 4.0 上 Fable 5.1 是 55.8%、Mythos 5.1 是 60.9%,官方原文說這 5.1 個百分點反映的是「舊版較不精準的 cyber 防護介入的那些任務」,並預期新防護上線後差距會小很多。要澄清一個普遍誤讀:Mythos 5.1 不是更受限的版本,它是防護更寬鬆的那一版,受限的是取得資格——它只開放給 Project Glasswing 的參與者,目前僅限一組美國組織。
為什麼我明明選了 Claude Fable 5.1,回我的卻是 Opus?
安全防護把你的請求判成需要轉單了。目前的規則是攻擊性資安技術轉 Opus 4.8,生物、化學與生命科學類轉 Opus 5。要注意防護會掃描模型讀到的所有內容,不只你剛打的那句——包含記憶、連接器內容、網頁搜尋結果與檔案。
切換後模型選擇器會停在 Opus,可以自己切回來;但如果原始請求還在對話裡可能再被擋一次,官方建議先編輯前一則訊息再重試。也可以在 Settings > Capabilities(Claude Code 是 Config > MODEL & OUTPUT)把自動切換關掉,關掉後被擋的請求會暫停對話而不是換模型。
為什麼 Claude Fable 5.1 一次只呼叫一個工具、跑很久都不說話?
這兩個都是官方列出的行為變化。平行工具呼叫在「下一步要抓什麼是任務隱含而非使用者明講」的 agent 迴圈裡變得比較不固定,官方明說這只吃 token、往返次數與時間,不會降低答案品質;修法是要模型先私下列出接下來需要什麼、再把彼此不相依的請求一次發出。
至於「跑很久不說話」,第一步不是改提示詞,而是先確認你的 client 收不收得到——預設 thinking.display 是 "omitted",模型寫的進度更新會回傳成空的 thinking 區塊,要設成 "updates"(beta header thinking-display-updates-2026-08-18)才看得到。第二步是刪掉自己提示詞裡「把發現留到最後再說」這類抑制句。
用 Claude Fable 5.1 寫的東西會被驗出來是 AI 寫的嗎?
文字會帶 Anthropic 的統計式浮水印,在所有可用平台都有,但它不新增 token、不含隱藏字元,也不含任何關於你或你組織的資訊,對輸出品質與內容沒有實質影響。關鍵是文字偵測 API 目前仍是 private preview,只開放給歐盟法規義務方(監管機關、執法、媒體、事實查核、獨立研究者、教育機構、歐盟公民社會團體)與有相同合規義務的企業,一般人與一般公司拿不到。圖片與影片則是另一套:透過 Claude API 的 Files API 取回時才帶簽章的 C2PA Content Credentials,這個可以用官方免費的 Claude Content Checker 自己驗。
參考資料
- Anthropic — Introducing Claude Fable 5.1 and Claude Mythos 5.1(發布公告,含跑分表、22 家夥伴回饋、成本與可用性、反蒸餾機制)
- Claude Platform Docs — Claude Fable 5.1 模型總覽(規格、模型 ID、價目、退場承諾)
- Claude Platform Docs — What's new in Claude Fable 5.1(三個破壞性變更、五項新增、七項行為差異的原文)
- Claude Platform Docs — Claude Fable 5.1 遷移指南(自 Fable 5/Opus 5/Opus 4.8 遷移的逐項檢查清單)
- Claude Platform Docs — Prompting Claude Fable 5.1(七項行為變化的官方修法與可複製提示詞)
- Claude Platform Docs — 定價(繁體中文)(五格價目、快取倍率腳註、Batch 折扣)
- Anthropic 說明中心 — Claude Fable models on your plan(各方案規則、Claude Code 版本需求、無第二次額度)
- Anthropic 說明中心 — Covered Models(30 天資料保留、指定日期、EFS)
- Anthropic 說明中心 — 變更模型、effort 與思考設定(claude.ai 的 effort 選單支援範圍)
- 歐盟執委會 — AI 生成內容透明度行為準則(2026 年 8 月 2 日起適用的標記與標籤義務)
- C2PA — Content Credentials 標準(圖片與影片的來源標記規格)