Claude API 價格:漲價取消了,Opus 帳單為什麼反而多三成?我重算一次

目錄

💡 核心結論速覽 (TL;DR)

  • 漲價確實取消了:官方定價頁寫明 Sonnet 5 的 $2/$10 已是標準價,原訂 9/1 調到 $3/$15 不會發生。
  • 但計價的 token 變多了:Claude 4.7 以後的模型換了新斷詞器,同一段字約多算 30% token。
  • 兩件事併算後方向相反:Sonnet 4.6 換 Sonnet 5 只省約 13%(不是 33%);Opus 4.6 換到 4.7 以後同價卻多付約三成。
  • 先做這件事:打開帳單看你跑在哪一條線上——在 Opus 這條就先開提示快取,光快取命中就只要基礎輸入價的 0.1 倍。

單價一毛沒漲,帳單卻多了三成。這不是錯覺,是官方定價頁上兩則 Note 相乘的結果。

Claude API 價格在 2026 年 8 月同時改了兩件事:Claude Sonnet 5 每百萬輸入/輸出 token 的 $2/$10 從導入價正式變成標準價,9 月 1 日調到 $3/$15 的計畫取消;同一頁另一則 Note 則寫明,Claude 4.7 及更新版本的模型換用了新的斷詞器,同一段文字約會多產生 30% 的 token。

牌價往下、計費單位往上。這兩條線交叉之後,不同模型的使用者拿到的答案完全相反。

我每天用 AI 超過十小時,同時養著兩家 200 美元等級的高階訂閱,另外還有一堆自己寫的自動化在後面吃 API。所以「這個月帳單為什麼跟上個月不一樣」對我來說不是新聞,是月初對帳時會皺眉的那一行數字。

這次我把官方定價頁跟模型總覽頁攤開逐格對過,發現中文圈流通的說法幾乎清一色只搬了「漲價取消」這半邊——甚至還有頁面停在舊資訊、直接把 Sonnet 5 標成 $3/$15。另外半邊沒人算。

所以你真正要決定的不是「Claude 變便宜還變貴」,而是你的工作流跑在哪一條模型線上。這兩條線這次的走向,剛好是反的。


Claude API 價格 9 月到底改了什麼?兩則官方 Note 要合起來看

官方在同一頁放了兩則 Note:一則說 Sonnet 5 不漲價了,一則說 Claude 4.7 以後的模型會把同一段字算成更多 token。單獨看任何一則都會得到錯的結論。先把原文放上來,因為這兩段的措辭很精準,轉述容易失真。

第一則,關於取消漲價(引自Anthropic 官方繁體中文定價頁):

Claude Sonnet 5 在發布時宣布的每百萬輸入/輸出 token 為 $2/$10 的優惠定價(原定至 2026 年 8 月 31 日止),現已成為標準價格。原定於 2026 年 9 月 1 日調漲至每百萬輸入/輸出 token 為 $3/$15 的計畫將不會實施。

第二則,關於斷詞器(同一頁往下第三則 Note):

Claude 4.7 及更新版本的模型以及 Claude Mythos Preview 使用較新的 tokenizer(分詞器),這有助於提升其在各種任務上的效能。此 tokenizer 對相同文本會產生約多 30% 的 token。確切的增加幅度取決於內容和工作負載型態。Claude Sonnet 4.6 及更早版本的模型使用先前的 tokenizer。

把這兩句放在一起,你會發現分界線畫在很奇怪的地方:它不是按「新舊模型」分,是按「版本號有沒有到 4.7」分。Sonnet 5 是新斷詞器,Sonnet 4.6 是舊的;Opus 4.7 是新斷詞器,Opus 4.6 是舊的。同一個 Opus 家族,跨過 4.7 這條線就換了計費單位。

下面是官方現行的完整價目表,我把「斷詞器世代」這一欄自己補上去,因為官方表格沒有這欄,但它才是這次的關鍵變數:

模型 輸入(每百萬 token) 輸出(每百萬 token) 斷詞器世代
Claude Fable 5 US$10 US$50 新(4.7 以後)
Claude Opus 5 US$5 US$25 新(4.7 以後)
Claude Opus 4.8 US$5 US$25 新(4.7 以後)
Claude Opus 4.7 US$5 US$25 新(分界點)
Claude Opus 4.6 US$5 US$25
Claude Sonnet 5 US$2 US$10 新(4.7 以後)
Claude Sonnet 4.6 US$3 US$15
Claude Haiku 4.5 US$1 US$5

看出來了嗎?Opus 那四列的單價一模一樣,都是 $5/$25。換句話說,從 Opus 4.6 換到 4.7、4.8 或 5,你在牌價上什麼都沒省到——但計費的 token 數多了。這一格就是本篇後面要拆的重點。

這段你可以帶走的一件事:先去 Console 或程式碼裡確認一下你現在打的 model id 是什麼。如果你還沒挑定,Fable 5、Opus、Sonnet、Haiku 這四條線我每天用下來的精準對比可以先看一輪,再回來算錢比較有意義。


為什麼「不漲價」不等於「不變貴」?Claude API 的斷詞器換了計費的尺

因為 API 是按 token 計費,而斷詞器決定「同一段文字等於幾個 token」。單價是每個 token 多少錢,斷詞器是這段字有幾個 token——換掉後者,等於換掉整把尺。

斷詞器你可以想成計程車的跳表器。車資單價沒調,但跳表的間距從 300 公尺改成 230 公尺——同一段路,跳的次數變多,你付的錢就變多。官方換斷詞器是為了模型表現(Note 裡自己寫了「有助於提升效能」),但帳單這一端是實實在在會有感的。

官方給的數字是「約多 30%」,並且補了一句「確切的增加幅度取決於內容和工作負載型態」。市面上的第三方成本分析把區間抓在大約 1.0 倍到 1.35 倍之間,這個區間值得記住,因為它會決定你的試算要用哪個數。

但我在官方模型總覽頁挖到一組更硬的數字,這頁把 100 萬 token 的脈絡視窗換算成實際容量,兩代模型的換算值不一樣:

  • Opus 4.6 / Sonnet 4.6(舊斷詞器):100 萬 token ≈ 75 萬英文字 ≈ 340 萬個 unicode 字元
  • Opus 5 / Sonnet 5 / Fable 5(新斷詞器):100 萬 token ≈ 55.5 萬英文字 ≈ 250 萬個 unicode 字元

同樣是「100 萬 token」,能裝的字元少了約 26%。反過來回推,同一批字元在新斷詞器下會變成約 1.36 倍的 token——比 Note 寫的「約 30%」還高一點。這組數字是官方自己在模型頁上換算的,不是我猜的。

這段你可以帶走的一件事:不要用「感覺」估。官方有 token 計數 API,可以在送出請求前先算這段 prompt 到底幾個 token。拿你自己最常用的那份系統提示,在新舊模型上各算一次,你會拿到屬於你的乘數,而不是官方的平均值。


Sonnet 4.6 換到 Sonnet 5,Claude API 帳單是省還是貴?我算給你看

結論先講:換過去確實會省,但省的幅度大概只有牌價看起來的四成。$3 降到 $2 是降 33%,把多出來的 30% token 算進去之後,實際只省約 13%。

我用一組好記的假設跑一遍。假設你每個月跑 3,000 萬個輸入 token 加 300 萬個輸出 token——注意,這是用舊斷詞器的口徑算的量,換到 Sonnet 5 之後同樣的文字會變成 3,900 萬和 390 萬。

換代路徑 單價變化 token 變化 我算出的實際帳單
Sonnet 4.6 → Sonnet 5 $3/$15 → $2/$10(−33%) ×1.30 US$135 → US$117(省 13%
Opus 4.6 → Opus 4.7/4.8/5 $5/$25 → $5/$25(不變) ×1.30 US$225 → US$292.5(多 30%
Haiku 4.5(沒動) $1/$5(不變) ×1.00(仍是舊斷詞器) 不受影響

Sonnet 那一列換算成新台幣,大約是每月從 4,200 元降到 3,600 元(以 1 美元約 31 元粗估,匯率會浮動)。有省,但如果你當初是照「降價 33%」在編下個月的預算,這裡就會差一截。

因為官方只給「約 30%」,我把三個乘數都跑了一次,讓你知道誤差落在哪:

  • ❶ 乘數 1.00 倍(你的內容剛好對新斷詞器很友善):省 33.3%,跟牌價一致。
  • ❷ 乘數 1.30 倍(官方近似值):省 13.3%。
  • ❸ 乘數 1.35 倍(第三方估計的上界):省 10.0%。

所以 Sonnet 這條線不管怎麼算都是省的,只是省的幅度在 10% 到 33% 之間跳。這件事我覺得反而是好消息——它讓「要不要從 4.6 換過去」變成一個沒有風險的決定,剩下的只是模型能力差異。那一塊我在Sonnet 5 值不值得升級、以及升級前該先看的那個陷阱裡拆過,這裡就不重複。

這段你可以帶走的一件事:如果你已經在用 Sonnet 4.6,把 model id 改成 claude-sonnet-5,然後對照一個月的帳單看實際乘數落在哪。這是最快知道「你的內容型態偏貴還是偏便宜」的方法。


真正變貴的是 Opus 這條線:Claude API 同價、帳單卻多三成

Opus 4.6、4.7、4.8、5 的官方單價完全相同,都是每百萬輸入 $5、輸出 $25。但 4.7 以後換了斷詞器,所以從 Opus 4.6 升上去的人,跑同樣的工作、拿到的帳單會多出約三成。

這件事沒有發布會、沒有新聞稿,它只是官方定價頁上一則不起眼的 Note。而它影響的偏偏是最貴的那條線——Opus 的輸出單價是 Sonnet 5 的 2.5 倍,同樣多 30% token,絕對金額差得更明顯。

用剛剛那組假設:Opus 4.6 每月 US$225,換到 Opus 5 之後變成 US$292.5,多出 US$67.5。換算新台幣大約是每月從 7,000 元變成 9,100 元(同樣以 1 美元約 31 元粗估)。如果你的量是這個的十倍,那就是每月多兩萬多塊。

這裡有個我自己一開始也搞混的地方,值得單獨講清楚,因為兩個「token 數字」講的根本不是同一件事:

  • 斷詞器帶來的 +30%:講的是「同一段文字被切成幾個 token」,是計量單位的改變,輸入輸出都受影響。
  • Opus 5 官方宣稱的「少產生 26% token」:講的是「達成相似表現時,模型自己會少寫多少字」,是行為的改變,只影響輸出。

兩者方向相反、作用範圍也不同,不能直接相減。我之前拆過Opus 5 說省 26% token、我卻覺得它變囉唆的那件事,那篇比的是 Opus 4.8 和 Opus 5(兩者都是新斷詞器,所以沒有斷詞器變數);本篇比的是跨過 4.7 那條線的換代。看的角度不一樣,結論才不會打架。

順帶一提,斷詞器這條線的起點其實是 Opus 4.7 那一代,只是當時的討論全被跑分吸走了。Opus 4.7 當初的 5 大升級重點我整理過一次,現在回頭看,最貴的那一項不在跑分表上。

這段你可以帶走的一件事:如果你還停在 Opus 4.6 而且對成本敏感,先別急著跳。留在 4.6 是合法選項(官方仍列在價目表上),先跑一個星期的 A/B 比較品質提升值不值那三成再說。


中文使用者要多看一格:Claude API 脈絡視窗被吃掉的那一塊

新斷詞器不只影響帳單,也影響你一次能塞多少字進去。100 萬 token 的脈絡視窗,能裝的 unicode 字元從約 340 萬掉到約 250 萬——這一格對中文內容的影響比對英文更直接,因為中文是按字元密集吃 token 的語言。

官方對 token 的粗估是「1 個 token 約等於 4 個字元或 0.75 個英文單字」,並直說「確切數量因語言和內容類型而異」。英文一個單字常常就是一個 token,中文則是一個字就可能吃掉一個以上。斷詞器一換,這個比例整個往上調。

實務上會先撞到牆的通常是這三種場景,我自己三種都踩過:

❶ 長文件問答。本來一份完整的年報或合約能一次丟進去,現在同一份檔案的 token 數變多,開始要切塊。切塊之後答案品質會掉,因為模型看不到全貌。

❷ RAG 的檢索結果。你設定「每次帶 20 段參考資料」,這 20 段的 token 數悄悄變多,把留給對話歷史的空間擠掉。症狀是模型開始忘記前面講過的事。

❸ 專案設定檔。那份寫了半年的長篇專案說明或風格指南,每一次請求都會被完整送進去。它變貴 30% 是每一次、每一天,複利效果最兇。

第三點是最容易被忽略、也最好處理的。我自己的做法是把設定檔砍成兩層:真的每次都要的規則留在主檔,只有特定任務才用的搬去外部檔案按需載入。這種瘦身心法我在用量上限總是爆時,讓 token 砍半的那 10 個習慣裡整理成清單了,斷詞器換代之後那份清單的價值反而變高。

這段你可以帶走的一件事:把你最長的那份系統提示丟進 token 計數 API 跑一次。如果它超過 5,000 個 token,就值得花一個下午做瘦身——這是唯一一種「省下來的錢每天都會再省一次」的優化。


怎麼把 Claude API 成本壓回去?4 個官方機制與 2 個別誤開的開關

斷詞器你改不了,但官方留了四個機制可以把成本壓回去,其中提示快取的槓桿最大——快取命中只要基礎輸入價的 0.1 倍,等於九折之外再打一折。這四個都是官方定價頁上白紙黑字的規則,不是技巧。

❶ 提示快取(省最多,優先做)。官方乘數是:5 分鐘快取寫入 1.25 倍、1 小時快取寫入 2 倍、快取讀取(命中)0.1 倍。官方自己算過回本點——5 分鐘版讀 1 次就回本,1 小時版讀 2 次回本。所以只要你的系統提示會被重複使用,開就對了。

❷ Batch API(不急的活全丟)。輸入輸出都打 5 折。Sonnet 5 批次價是 $1/$5、Opus 5 是 $2.50/$12.50。而且它可以跟提示快取疊加,官方常見問題裡明講兩者可以合併使用。

❸ 完整 100 萬 token 脈絡是標準價。Claude 4.6 以後不對長脈絡另外加價,官方寫得很白:「90 萬 token 的請求與 9 千 token 的請求按相同的每 token 費率計費」。

這點值得特別記住,因為別家不是這樣玩的——Grok 4.6 就有一道 200K 的斷崖,多 1 個 token 整筆帳單就翻倍。同樣是長脈絡工作流,計價邏輯天差地遠。

❹ 模型分層。官方的成本最佳化建議是簡單任務用 Haiku、多數生產工作負載用 Sonnet、最複雜推理才用 Opus。而 Haiku 4.5 剛好還在舊斷詞器上,這次完全沒被影響——把能降級的任務降下去,等於同時避開兩筆成本。

接下來是兩個容易誤開、開了就默默多付錢的開關:

🚫 別誤開一:inference_geo: "us"指定僅限美國推論會套用 1.1 倍乘數,而且是全套——輸入、輸出、快取寫入、快取讀取都乘。除非你有明確的資料落地合規需求,否則預設的全球路由就好。

🚫 別誤開二:快速模式(Fast mode)。它讓 Opus 5 和 Opus 4.8 輸出更快,代價是價格變成 $10/$50——輸入直接兩倍。而且它不能跟 Batch API 併用。趕時間才開,不要設成預設。

還有一個小發現該講,因為它是這次唯一往好處走的一格:工具使用的固定開銷反而變小了。官方表上,Opus 5 的工具使用系統提示只要 286 到 406 個 token,Opus 4.7 卻要 675 到 804 個。

如果你跑的是會大量呼叫工具的 agent,這一格會回補掉一部分斷詞器帶來的漲幅。這類 agent 的帳單結構我在一個任務燒掉好幾美元的真相與砍半心法裡拆得更細。

這段你可以帶走的一件事:今天就先做提示快取這一項。它不需要改架構,只要在請求最上層加一個 cache_control 欄位,系統會自動管理快取斷點。


那我到底該換哪個模型?三種人的 Claude API 決策框架

直接給結論:Sonnet 4.6 使用者無腦換 Sonnet 5;Opus 4.6 使用者要先算過再換;Haiku 使用者這次什麼都不用做。下面把「適合誰、不適合誰、預算、下一步」四件事拆開講。

第一種:你在跑 Sonnet 4.6。換到 Sonnet 5 是這次唯一沒有懸念的決定——單價降 33%、扣掉斷詞器還淨省一成以上,模型能力也是往上。不適合的情況:你的產品對輸出格式有極嚴格的既有測試,換模型要重跑整套驗收。那就先算驗收成本再說。下一步:改 model id、跑一個月、對帳。

第二種:你在跑 Opus 4.6,而且成本敏感。這是唯一真的會被咬到的一群。適合換的情況:你的任務是複雜代理式寫程式或長鏈推理,模型品質提升能直接換成人力節省——那三成很划算。

不適合的情況:你只是拿 Opus 跑摘要、分類、格式轉換這類 Sonnet 就做得完的活。那你要做的不是換 Opus,是降級到 Sonnet 5——同樣一份工作從 $5/$25 掉到 $2/$10,就算 token 多三成也還是省一大截。

預算:以我前面的假設量,維持 Opus 每月約 US$292.5,降級到 Sonnet 5 只要約 US$117。下一步:挑一個最不重要的任務,這週先降級試跑。

第三種:你根本沒在打 API,只是訂閱使用者。這次的斷詞器變動對你不會直接反映成帳單,但會反映成「同樣的對話比較快撞到用量上限」。訂閱端該怎麼選、什麼時候該從 Pro 跳 Max,我在四檔訂閱方案我實際算過的那筆帳裡算過,那邊的判準跟這篇的 API 邏輯不一樣,別混用。

順帶提醒一個常見的誤判:不要只因為「新版比較便宜」就整套搬過去。只看單價、沒看計價規則而算錯的例子,別家 API 上更多。

DeepSeek 那次漲價,離峰時段跑帳單直接砍半是一種規則;Gemini 3.6 Flash 的降價和省 token 則是相乘的,那是少數兩個變數同向的例子。每一家的陷阱長得都不一樣。

如果你是想先用免費額度試水溫再決定要不要付費打 API,免費 AI API 接自動化會先撞到的那兩道牆可以先看,避免第一步就走錯。跨品牌的定價結構對照,GPT-5.5 的 1M 上下文與 $5/$30 定價也是一組值得放在同一張表上比的數字。


FAQ 常見問題

Claude Sonnet 5 到底還會不會在 9 月 1 日漲價?

不會。官方定價頁的 Note 寫得非常明確:$2/$10 已經成為標準價格,原訂 2026 年 9 月 1 日調漲到 $3/$15 的計畫「將不會實施」。如果你看到還在寫「8 月 31 日後調漲」的頁面,那是沒更新的舊資訊。要確認一律回官方定價頁看那則 Note 還在不在。

新斷詞器和 Opus 5 官方說的「少產生 26% token」,會不會互相抵消?

不會直接抵消,因為兩者作用的位置不同。斷詞器影響的是「輸入和輸出的每一段文字被切成幾個 token」,是計量單位;「少產生 26% token」講的是模型在達成相似表現時自己會少寫多少內容,只影響輸出量。輸入端完全吃不到那 26% 的好處。所以如果你的工作流是「長輸入、短輸出」(例如文件問答),漲幅會更明顯。

我該留在 Opus 4.6 不升級嗎?

如果你對成本敏感而且工作內容沒有真的變難,留著是合理選項——官方價目表上 Opus 4.6 還在,沒有被列為停用。但別把「不升級」當成長期策略,模型有生命週期,官方會公告停用時程。比較務實的做法是趁這次重新檢視:那些任務其實用 Sonnet 5 就夠?把它們降下去,省的錢比糾結 Opus 版本多得多。

怎麼知道新斷詞器對「我的內容」到底多算了幾成?

用官方的 token 計數 API 實測。拿你最常送的那份 prompt,分別指定新舊世代的模型各算一次 token 數,兩個數字相除就是屬於你的乘數。官方只給「約 30%」的平均值,實際落在 1.0 到 1.35 倍之間,內容型態差很多。做過這一次,之後所有成本試算才有意義。

提示快取和 Batch API 可以一起用嗎?

可以。官方常見問題明確寫了 Batch API 和提示快取的折扣能夠合併使用,各種乘數會互相疊加。唯一要注意的是快速模式不能跟 Batch API 併用。實務上建議的順序是:先把不急的任務丟 Batch,再對重複使用的長系統提示開快取,這兩層疊起來的效果最大。


結論:這次要對的不是新聞標題,是你自己的那張帳單

「Claude 不漲價了」這句話沒有錯,但它只覆蓋了一半。Claude API 價格這次真正改變的是計價的尺,而尺換了之後,Sonnet 的使用者拿到折扣、Opus 的使用者拿到帳單。同一則消息,兩種結局。

我這幾年對帳對出一個習慣:看到「降價」兩個字,先問「計價單位有沒有跟著動」。這次官方其實兩件事都寫了,只是分在兩則 Note,中間隔了一張表格——資訊沒有被藏起來,只是沒有人把它們放在一起乘一次。

如果你今天只做一件事,就去 Console 打開這個月的用量明細,看看你的輸入輸出比例長什麼樣。輸入重的工作流,這次受影響最大;輸出重的,反而可能因為模型變簡潔而打平。這個數字只有你自己有。

我每個月都會把這類定價規則的變動重新算一次,也會把踩到的坑寫下來。如果你想知道寫這些東西的人平常在幹嘛,我的自我介紹在這裡;想收到後續的更新,可以訂閱我的部落格,會不定期收到信。


參考資料

 

延伸閱讀