Claude Sonnet 5 值得升級嗎?價格只要 Opus 4.8 四成、實力幾乎追平,帳單還比前代少 13%

目錄

💡 核心結論速覽 (TL;DR)

  • Claude Sonnet 5 是什麼:Sonnet 的價格、逼近頂規 Opus 4.8 的實力,程式與知識工作大幅贏過前代 Sonnet 4.6,API 端還給到 1M(一百萬)token 的超長上下文(訂閱端在 claude.ai 聊天則是 200k)。
  • 多少錢:每百萬 token US$2 進 / US$10 出。這組數字本來標的是「只到 2026 年 8 月 31 日」的導入優惠價,但官方後來改口——它現在就是標準價,9 月回到 US$3 / US$15 那件事不會發生。免費方案就用得到,它已是預設模型。
  • 最多人算錯方向的一格:新 tokenizer 確實讓「同一段文字被算成 1.0~1.35 倍的 token」,但單價從 US$3 / US$15 降到 US$2 / US$10 已經把它蓋過去——從 Sonnet 4.6 換過來,同樣的工作帳單反而少約 13%。真正因為斷詞器多付三成的是 Opus 4.6 換到 4.7 以後那條線,那邊單價一毛沒降。
  • 該怎麼選:日常寫作、跑 Agent、寫 code 直接用 Sonnet 5;只有最難的攻堅任務才動用 Opus 4.8。先用免費或 Pro 內建的 Sonnet 5 跑一週,再決定要不要加碼。

先講結論:Claude Sonnet 5 我會用,而且它大概會變成我每天的主力——但「它比 Opus 4.8 便宜又幾乎一樣強」這句漂亮話底下,有一筆幾乎沒人跟你算清楚的帳:這代同時換掉了斷詞器,同一段文字被算出來的 token 數會變,只看單價會把方向算反。

Claude Sonnet 5 是 Anthropic 六月底剛推出的新模型,官方給它的定位很直接:Sonnet 的價格,逼近 Opus 4.8 的實力。而且一上線就變成免費與 Pro 方案的預設模型,等於大部分人已經在用它,只是不一定知道。

身為每天用 AI 超過十小時、同時扛著 ChatGPT 跟 Claude 兩個 US$200 高階方案的人,每次新模型一出,我第一件事不是歡呼,是打開帳單和用量頁面。因為「更聰明」通常伴隨「更花錢」或「更快撞到上限」。這篇我就把值不值得換、跟 Opus 4.8 到底差多少、那個 tokenizer 到底吃掉多少便宜(還是其實根本沒吃掉),一次算給你聽。


Claude Sonnet 5 是什麼?一句話:Sonnet 的價格,逼近 Opus 4.8 的實力

如果你只想記一件事:Claude Sonnet 5 就是那個「花中階的錢、拿接近頂規的力氣」的模型。它不是要取代最強的 Opus 4.8,而是把「日常大部分任務」的性價比拉到一個很難拒絕的位置。

它是 Claude 家族裡「速度與聰明最平衡」的那一檔。往上是攻堅用的 Opus 4.8,往下是更省的 Haiku。過去 Sonnet 一直被當成「堪用但不驚豔」的中間選項,這一代第一次讓我覺得——很多時候我根本不需要開 Opus。

對每天在用的人來說,真正有感的是這三件事:

  • 它已經是預設了:免費和 Pro 方案打開 Claude 就是 Sonnet 5,你不用特別切換,多數人是「被動升級」。
  • 1M 超長上下文(API 端):一百萬 token 大約是好幾本書的量,整包程式碼、整份長合約一次丟進去都吃得下。要注意這是 API 的規格;訂閱端在 claude.ai 聊天時,官方方案比較表寫的是 200k。
  • 更會「自己把事做完」:這一代主打 agentic(代理式)能力——會自己規劃、開瀏覽器、跑終端機、連續做很多步驟不用你一直盯。

我自己最在意的是第三點。因為我常把 Claude 拿去跑那種「你去把這件事查完、整理好、輸出成表格」的長任務,模型能不能穩穩跑完不脫線,比它多考幾分基準測試重要得多。想深入這塊的話,我把 Claude 並行上千個子智能體到底省 token 還是燒更兇拆得很細,這裡先不岔開。


Claude Sonnet 5 多少錢?免費能用嗎?(順便更正一個已經過期的漲價說法)

先回答最直接的:免費方案就能用 Claude Sonnet 5,因為它現在是預設模型。你不用付一毛錢就能試。真正要談「錢」,是當你用量大、或走 API 串接自己的工具時,才會實際感覺到成本。

API 這邊,價格是這樣算的(每一百萬 token):

方案 輸入 輸出
Sonnet 5 標準價(原標示為導入優惠價,官方已取消調漲) US$2 US$10
前代 Sonnet 4.6 US$3 US$15
頂規 Opus 4.8(對照組) US$5 US$25

把頂規的 Opus 4.8 擺進來一起看,你就懂「便宜」是怎麼來的:Sonnet 5 的單價只有 Opus 4.8 的四成,輸入 US$2 對 US$5、輸出 US$10 對 US$25,兩格都是四成——但實力卻幾乎追平(下一段的基準測試會攤給你看)。換算成新台幣抓個感覺:輸入大約是每百萬 token 六十幾塊、輸出兩百出頭。聽起來很香對吧?這也是這波「Sonnet 5 超划算」風向的來源。

這裡有一件到現在還有一堆中文頁面沒更新的事:US$2 / US$10 一開始掛的是「導入優惠價、只到 8 月 31 日」,九月起要跳回 US$3 / US$15。但官方定價頁後來把那則註記改掉了——這組價格現在就是標準價,那次調漲不會實施。所以你如果是照著半年前的文章在估年度預算,記得把 US$3 / US$15 那一格改回 US$2 / US$10,不然會高估五成。至於價格細節與各方案內容,直接看 Claude 官方定價頁最保險,官方隨時可能調整。如果你在意的不是 API 而是訂閱方案——Pro、Max 每一級差在哪、上限怎麼算,我在Claude 訂閱方案 Pro、Max 怎麼挑那篇一級一級講清楚了。

那免費用戶完全不受影響嗎?也不是。你不會直接被扣錢,但用量上限(那個惱人的「幾小時內的訊息額度」)會受影響——這跟下一段的 tokenizer 直接有關。順帶一提,如果你最近覺得 Claude「變慢變笨」,那多半是限流不是降規,我在 Claude、ChatGPT 突然變笨是不是被降智了裡把限流機制講得很白。


Sonnet 5 vs Opus 4.8 vs Sonnet 4.6:實力到底差多少?

直接看官方公布的基準測試,結論很清楚:Claude Sonnet 5 在程式與終端任務上把前代 Sonnet 4.6 甩開一大截,整體逼近頂規 Opus 4.8,知識工作甚至還小勝一點。

測試項目 Sonnet 5 Opus 4.8 Sonnet 4.6
程式任務 SWE-bench Pro 63.2% 69.2% 58.1%
終端機任務 Terminal-Bench 2.1 80.4% 82.7% 67.0%
電腦操作 OSWorld 81.2% 83.4% 78.5%
知識工作 GDPval-AA v2 1618 1615 1395

白話翻譯一下這張表:程式那格,Sonnet 5 從前代的 58 分跳到 63 分,跟 Opus 4.8 的 69 分只差六分——這六分是「最難那批題目」的差距,日常寫 code 其實感覺不太出來。終端機任務更誇張,直接從 67 衝到 80,這是我覺得升級最有感的一格。

最有意思的是最後一列。在模擬真實白領工作的 GDPval 測試裡,Sonnet 5 拿 1618,反而比 Opus 4.8 的 1615 高。我不會拿這三分去說「Sonnet 5 比 Opus 強」——這種分數本來就有誤差——但它至少證明一件事:對絕大多數「整理、分析、寫報告」的日常任務,你花 Opus 的錢並不會換到更好的結果。想把 GPT、Gemini、Grok 這些對手也拉進來一起比的話,我在主流 AI 模型全對決那篇做過跨家的完整對照,這裡就不重複攤表了。

所以我現在的實際做法是:日常九成任務丟 Sonnet 5,只有那種「一步錯全盤皆輸」的複雜重構、超長推理,我才會切去 Opus。想看純寫 code 場景的手感差異,可以搭 Cursor 跟 GitHub Copilot 我實測後怎麼選一起看,工具搭模型才是完整的一套。


Claude Sonnet 5 會亂編嗎?誠實度與安全,這代默默補了什麼

先講一個比分數更實際的進步:比起前代 Sonnet 4.6,Claude Sonnet 5 亂編(幻覺)和亂做事的機率降低了。對只是聊聊天的人這無感,但對「把長任務丟給它自己跑」的我來說,這比多考幾分基準分數還關鍵。

為什麼這麼在意?想像模型要連續做十個步驟,中間第三步它憑空編了一個不存在的檔名或數字,後面七步全部歪掉,你還得回頭抓錯——那個成本遠比它慢個幾秒可怕。幻覺率下降,等於這種「跑到一半悄悄翻車」的機率變小,這才是我敢把整包工作交給 Sonnet 5 的底氣。

但要誠實講一個取捨:在「該不該拒絕危險請求」這件事上,Sonnet 5 仍然沒有頂規的 Opus 4.8 那麼保守,官方也把資安防護預設打開。對一般人這不影響日常,但如果你的用途會碰到敏感邊界,這是選型時要放進去的一格。至於「開源模型或中國模型到底安不安全」是完全不同的一題,我在 中國 AI 資安追上 Anthropic、GLM-5.2 部分項目贏 Claude 裡單獨聊過,這裡不混為一談。


便宜的背後:新 tokenizer 會多算 token,但方向跟你想的相反

這是整篇最重要、也最多人把方向算反的一段:Claude Sonnet 5 換了新的 tokenizer,同樣一段文字,會被算成比以前更多的 token——官方自己講的範圍是 1.0 到 1.35 倍,看內容型態而定。這句話翻成人話就是:單價便宜不等於帳單便宜,你得把「單價」跟「token 數」乘起來看。

什麼是 token?你可以想成 AI 計費的「字數單位」,但它切的不是字,是詞塊。同一篇文章,換一套 tokenizer 就可能被切出更多塊,而你是按塊付錢、按塊算上限的。

我幫你把兩條路各算一遍,而且刻意用對自己最不利的假設——你的內容剛好落在 1.35 倍那端:

  • Sonnet 4.6 → Sonnet 5:輸入單價從 US$3 降到 US$2,就算文字多算 1.35 倍,US$2 × 1.35 ≈ US$2.7,還是比前代的 US$3 便宜。整包(輸入加輸出)用比較常見的 1.30 倍去算,同樣的工作大約省 13%;就算真的落在最不利的 1.35 倍,也還有一成左右的空間。換過去帳單不會變貴。
  • Opus 4.6 → Opus 4.7 以後:這條線才是真的會咬人。單價從頭到尾都是 US$5 / US$25、一毛沒降,但 4.7 以後換上同一套新斷詞器,同一段文字多算三成——牌價沒漲,帳單卻多付約 30%。

看懂了嗎?「不漲價不等於不變貴」這句話是對的,但它只對 Opus 那條線成立。斷詞器是同一套,差別在於 Sonnet 這邊單價跟著降了、Opus 那邊沒有。所以如果有人拿「新 tokenizer 會多算 token」來勸你別換 Sonnet 5,那是只算了一半——他忘了乘上另一半的價格。

那訂閱用戶(免費 / Pro)呢?這裡就是斷詞器唯一真的會咬到你的地方:你不會收到 API 帳單,所以也拿不到那個「單價變便宜」的補償,但那個「用量上限」是用 token 在算的。同一段對話吃掉更多 token,就代表你會比以前更快撞到額度天花板。這也是為什麼有些人升級後反而覺得「怎麼比較快被限流」。真正要對付這件事,我建議搭 用 GPT 起稿、Claude 修文、Gemini 補資料的多模型分工——把粗活分出去,重活才留給 Claude,額度撐得久很多。


那我到底該用 Sonnet 5 還是 Opus 4.8?(幫你對號入座)

如果只能給一句建議:先預設用 Claude Sonnet 5,除非你手上的任務真的難到會讓它出錯,才升級 Opus 4.8。大部分人是把 Opus 當「安心感」在買,但你的錢包其實不需要為安心感每天多付一倍。

下一代 Sonnet 5.5 單價沒漲、輸出快三成,但 effort 開到最高時每題反而比 Opus 5.5 貴,我把這筆帳拆開算了。

直接對號入座比較快:

你的情況 我的建議
免費 / Pro 用戶,日常問答、寫作、查資料 Sonnet 5 綽綽有餘,什麼都不用做,它已是預設
寫程式、跑 Agent、做自動化流程 主力用 Sonnet 5,卡關的難題再切 Opus 4.8
API 串服務、成本敏感、量很大 可以換,US$2 / US$10 已是標準價;預算用「單價 × tokenizer 倍數」重算一次就好
做最難的重構、超長推理、一步都不能錯 直接上 Opus 4.8,這時候省那點錢不划算
本來就用得很順的 Sonnet 4.6 老用戶 不急,跑幾個你的真實任務對比再決定(見下方 FAQ)

講點具體的。我自己現在的分工大概是這樣:早上整理素材、寫稿、回信這種量大但不燒腦的活,一路交給 Sonnet 5;下午遇到那種要一次讀完整包程式碼、跨很多檔案改動的重構,才把它升到 Opus 4.8。這樣一個月下來,我開 Opus 的次數大概只剩以前的三分之一,體感幾乎沒差,帳單卻明顯輕很多。這就是我說的「把頂規當重裝備、不當日常」。

老實說,我最想勸退的是「看到新模型就手癢全換」的人。新不等於對你更好,換模型是有隱藏成本的——你熟悉的提示詞手感會變、輸出風格會變、預算模型要重算。這跟前陣子大家搶著問「該不該換掉 ChatGPT、Claude」的 DeepSeek 熱潮是同一個道理:先搞清楚它解決了你哪個具體問題,再決定要不要動。


怎麼開始用 Claude Sonnet 5:免費付費怎麼搭、effort 怎麼調、3 個踩坑

上手其實很簡單,因為你八成已經在用了。想有意識地把 Sonnet 5 用好,照這個順序走:

訂閱要不要升是一回事,打 API 又是另一筆帳——Sonnet 5 的 $2/$10 已經變成標準價,但省的沒有牌價看起來那麼多。

❶ 先用免費 / Pro 內建的 Sonnet 5 跑一週你的真實任務。別看評測分數,看它處理「你自己那些日常活」順不順。這一步不花錢,卻是最準的判斷依據。說到不花錢,能免費用到有感的 AI 工具其實不只 Claude,我在免費 AI 工具清單裡整理過一輪,預算有限可以先從那篇挑。

❷ 覺得不夠力再往上加碼。如果一週後你發現總在複雜任務卡關,那才是升級 Pro 以上、或在難題切 Opus 4.8 的時機。順序反過來——先付錢再試——最容易買貴。

❸ 走 API 的話,學會調 effort。Sonnet 5 這代可以調「思考力道」,從 low 到 xhigh 到 max。簡單任務用低檔省 token,難題才開高檔。這是控制那個 tokenizer 成本最實際的旋鈕。

三個我建議先知道的踩坑:

  • 別再照舊文用 US$3 / US$15 估預算。網路上很多文章還停在「9 月起漲」的舊版本——那次調漲已經取消,現在的標準價就是 US$2 / US$10。
  • 提示詞可能要微調。換代之後輸出風格會變,你以前調得很順的 prompt 未必照樣好用,值得重新校一次。
  • 長上下文不是萬靈丹。API 的 1M token 塞得下,不代表塞越多越好(訂閱端聊天是 200k)。塞一堆不相關的東西進去,反而稀釋重點、又多燒 token。

如果你想把 Claude 玩得更進階——外掛、快捷鍵、跑自動化——我把日常在用的設定整理在 Claude Code 精選 12 個真正省時的隱藏功能,還有各種疑難雜症的總入口 Codex/Claude Code 常見問題大全,接著看剛好。


FAQ 常見問題

Sonnet 5 值得從 Sonnet 4.6 升級嗎?

如果你是免費 / Pro 用戶,這題沒得選——它已經是預設,你自然就升級了,而且程式與知識工作明顯更強,接受就好。API 用戶則可以放心換:US$2 / US$10 已經是標準價(原訂 9 月的調漲取消了),就算把新 tokenizer 多算的 1.0~1.35 倍 token 乘進去,同樣的工作大約還是省 13%。仍然建議拿你「真實會跑的任務」在兩個模型上各跑幾次,因為要比的是「完成同一件事的總花費」,不是「單價」。

Sonnet 5 和 Opus 4.8 我只能選一個,該選哪個?

選 Sonnet 5。對九成的人、九成的任務,Opus 4.8 多出來的那幾分基準分數,你在日常根本感受不到,卻要多付接近一倍的錢。留一個判斷原則就好:當任務難到 Sonnet 5 開始出錯、或錯了代價很大(例如正式環境的複雜重構),那一次才值得動用 Opus 4.8。把 Opus 當「特殊場合的重裝備」,不是每天的主力。

Sonnet 5 的優惠價到期後會變貴嗎?

不會,因為那個「到期日」已經被取消了。US$2 / US$10 原本標示為導入優惠價、預計 2026 年 9 月 1 日回到 US$3 / US$15,但官方定價頁後來改口,這組價格現在就是標準價。就算把新 tokenizer 多算的 1.0~1.35 倍 token 算進去,從 Sonnet 4.6 換過來大約仍省 13%。真正會被斷詞器咬到的是兩種人:

  • 走 Opus 4.6 升到 4.7 以後那條線的人:單價一毛沒降,實際帳單多付約三成。
  • 訂閱用戶:拿不到單價變便宜的補償,只感覺到額度比以前快用完。

Claude Sonnet 5 跟 ChatGPT、Gemini 比呢?

這題沒有標準答案,因為它們各有主場。以我同時訂 ChatGPT 和 Claude、也常用 Gemini 的體感:Sonnet 5 在寫 code、跑 Agent、處理超長文件上手感最穩;ChatGPT 語音對話和生態整合強;Gemini 綁 Google 服務、找即時資料方便。與其糾結誰最強,更實際的是把它們當成一支團隊分工用,這也是我一直在做的事。真的要從三家挑一家主力的話,我在Claude、ChatGPT、Gemini 三家怎麼選那篇從方案價格一路比到各家強項,看完再決定不遲。


寫在最後:新模型是工具,不是信仰

Claude Sonnet 5 是這一年我少數會主動推的升級——它把「日常好用」和「不用一直心疼錢」這兩件事,第一次同時做到了。但我還是想把那句老話留給你:模型再強,也只是工具;適不適合你,要用你自己的任務去驗,不是用別人的評測分數。

我的建議很簡單:今天就打開你手上的 Claude,用 Sonnet 5 跑幾個你平常最常做的活。如果你也在認真經營自己的 AI 工作流,歡迎訂閱我的部落格,我會不定期把踩過的坑和新發現寄給你——畢竟這個領域,跑得快不如避得準。至於要不要為了攻堅任務加碼頂規,看完 Claude Opus 4.8 到底該不該升級你會更有底。


參考資料

 

延伸閱讀