💡 核心結論速覽 (TL;DR)
- 牌價只講一半:$2/$6 只適用未滿 200K 的 prompt,達門檻整筆改用 $4/$12。
- 漲的是快取:快取輸入 $0.30→$0.50、長脈絡 $0.60→$1.00,都 +66.7%。
- 免費版就有:官方比較表 7 檔全打勾;批次折扣 4.6 是 0%,grok-4.3 有兩成。
- 下一步:量最長那支 prompt,壓在 200K 以下同筆任務少付約五成。
一個 token 的差別,可以讓同一筆請求的價格直接乘以 2。這不是比喻,是官方價目表自己寫的規則。
Grok 4.6 的 API 牌價是輸入 US$2.00、輸出 US$6.00/百萬 token,但這兩個數字只覆蓋 prompt 未滿 200,000 token 的請求。一旦 prompt 達到門檻,官方會把整筆請求裡的所有 token 改用長脈絡費率——輸入 US$4.00、輸出 US$12.00。
我每天用 AI 超過 10 小時,同時付著兩家各 US$200/月的高階方案,對「帳單怎麼被算出來」這件事特別敏感。這次官方公告只寫了 $2 和 $6 兩個數字,我把開發者文件的價目表和模型註冊表拉開逐格對過,發現沒講的比講的多。
所以你要決定的其實不是「新版好不好」,而是你的工作流會不會剛好踩在漲價的那一格。上一代 Grok 4.5 的 500K 脈絡和訂閱帳我算過一輪,可以先看它便宜在哪,再回來對照這次的差異。
Grok 4.6 的官方牌價是多少?$2/$6 只講了一半
Grok 4.6 的官方定價分成兩段:prompt 未滿 200,000 token 時輸入 US$2.00、快取輸入 US$0.50、輸出 US$6.00;prompt 達到 200,000 token 後,同一筆請求全部改用輸入 US$4.00、快取輸入 US$1.00、輸出 US$12.00。單位都是每百萬 token。
這件事在官方發布公告裡只留下一句「起價 US$2/US$6」。要看到第二段費率,得自己去開發者文件的價目表。繁體中文這邊目前流通的報導,幾乎清一色只搬了那兩個數字。
| 費用項目 | Grok 4.6 未滿 200K | Grok 4.6 達 200K 以上 | Grok 4.5 未滿 200K |
|---|---|---|---|
| 輸入(每百萬 token) | US$2.00 | US$4.00 | US$2.00 |
| 快取輸入(每百萬 token) | US$0.50 | US$1.00 | US$0.30 |
| 輸出(每百萬 token) | US$6.00 | US$12.00 | US$6.00 |
| 批次折扣 | 0% | 0% | 0% |
其他規格我也一併對過,順便打掉幾個常見誤會。官方模型頁寫的脈絡上限是 500,000 token,跟 Grok 4.5 一模一樣——脈絡不是這次的升級點。
模型 id 是 grok-4.6,發布日期 2026 年 8 月 12 日。官方對它的定位是「在 Grok 4.5 基礎上,特別針對長時間執行的 agent 與更有企圖心的互動式、視覺化工作」。
模型註冊表裡還有幾格是文件正文沒寫、但直接影響你怎麼用的:
- 知識截止日:2026 年 2 月 1 日。要問更新的事,得自己餵資料或開搜尋工具。
- 模態:輸入吃文字與圖片,輸出只有文字。語音是另外的 API,不要以為訂了就有。
- 推理強度:low/medium/high/xhigh 四段,預設是 high。
- 速率上限:150 RPS、7,200 RPM、50,000,000 TPM。
- 服務叢集:只有 us-east-1 與 us-west-2,沒有歐洲叢集。
最後一格我特別想標出來。同一份註冊表裡,grok-4.3 以及語音、語音轉文字那幾款都另有 eu-west-1;只有 4.6 這一代沒有。如果你的專案有資料落地要求,這不是規格表上的小字,是選型的硬條件。
順帶一提品牌名。官方站台現在整套自稱「SpaceXAI」——發布頁標題、內文寫的都是 SpaceXAI API;但頁尾的法律實體仍然掛著 X.AI LLC。中文報導兩種寫法混用,讓不少人以為是兩家公司,其實是同一個官方頁上品牌名與法人名並存。
這一段你可以帶走的下一步:打開開發者文件的價目表,把你正在呼叫的那一列拉出來,確認自己看的是短脈絡還是長脈絡那一格。不確定 Grok 4.6 在幾家旗艦裡該排第幾?我把主流模型的取捨攤開比過,可以先定位再談錢。
Grok 4.6 為什麼多送 1 個 token,整筆帳單就翻倍?
因為 Grok 4.6 的長脈絡計價是斷崖式,不是級距式。官方價目表下方明確寫著:一旦請求的 prompt 達到該模型的長脈絡門檻,這筆請求裡的所有 token 都按長脈絡費率計價。門檻由模型註冊表寫死在 200,000。
大部分人看到「超過 200K 加價」,腦中浮現的是手機吃到飽的級距——前 200K 照原價,超出的部分才貴。不是這樣。它比較像停車場的計次收費:多停一分鐘,整張票換一張貴的。
我把最赤裸的那一組數字算給你看,你可以自己驗算:
❶ 輸入 199,999 個 token:199,999 ÷ 1,000,000 × US$2.00 ≈ US$0.40。
❷ 輸入 200,000 個 token:200,000 ÷ 1,000,000 × US$4.00 = US$0.80。
❸ 差別:多送 1 個 token,同一份工作的輸入費用直接乘以 2。
而且被翻倍的不只輸入。同一筆請求的輸出也從 US$6 變 US$12,快取輸入也從 US$0.50 變 US$1.00。整筆請求的三個費率一起換檔。
還有一格特別容易被漏掉:官方的快取計費文件寫明,判斷有沒有達到門檻是看「含快取在內的總 prompt token」。那段被快取的長前綴不會因為算得便宜就不計入,它照樣把你推向 200,000。
接著把三個不同的「2 倍」分清楚,中文報導經常把它們混成同一件事——
❶ 長脈絡 2 倍:prompt 達 200,000 就整筆換貴費率。這是本文講的斷崖,不需要你做任何設定就會遇到。
❷ 優先處理 2 倍:官方的 Priority Processing 要你自己在請求裡加 service_tier 才會啟動,按標準費率的 2 倍計價,快取折扣先算完才乘上去。沒加就不會被收這一筆。
❸ 公告裡那句「fast variant 貴一倍」:官方發布頁確實有這句,但價目表與模型註冊表裡都沒有對應的 SKU。查不到的東西我不會拿來估成本,你也別照抄。
光看單筆你可能無感,我用一個貼近實際的情境試算(以下是以固定用量假設做的推算,不是實測帳單):
假設一支程式碼審查 agent,每次把專案脈絡塞成 210,000 token 輸入、產出 30,000 token。
- 照現況跑:0.21 × US$4 = US$0.84(輸入)+ 0.03 × US$12 = US$0.36(輸出)= US$1.20/次
- 把輸入壓到 195,000:0.195 × US$2 = US$0.39 + 0.03 × US$6 = US$0.18 = US$0.57/次
- 差距:US$0.63,等於省下 52.5%——只因為砍掉 7% 的輸入長度。
如果這支 agent 一天跑 300 次,兩種寫法的日成本是 US$360 對 US$171,一天差 US$189。同樣的模型、同樣的任務,差在你有沒有量過那支 prompt。
這就是我覺得最值得先講的一件事:Grok 4.6 的帳單風險不在單價,在你不知道自己踩在門檻的哪一邊。而 prompt 長度是會自己長大的——對話越久、工具回傳越多,它就越靠近 200,000。
如果是我,我會這樣設防線:
❶ 先量:從 API 回傳的用量欄位撈出 prompt_tokens,記下最近一週的最大值,不要憑感覺猜。
❷ 抓安全邊界:我會把硬上限設在 180,000,留 10% 給對話成長和工具回傳的不確定性。
❸ 超過就切:把「整份文件塞進單一 prompt」改成「先檢索、只送相關段落」,這比換模型有效得多。
怕計費規則改動突然吃掉預算?另一家調價那次的新舊價目我也逐格算過,兩相對照你會發現,真正咬人的從來不是牌價,是規則。
公告沒說的漲價:Grok 4.6 快取輸入貴了 66.7%,誰被咬最痛?
Grok 4.6 的快取輸入從 Grok 4.5 的 US$0.30 漲到 US$0.50,長脈絡那一格從 US$0.60 漲到 US$1.00,兩者都是漲 66.7%。而輸入 US$2、輸出 US$6 的牌價完全沒動。
這件事我是在同一張官方價目表上發現的——grok-4.5 和 grok-4.6 兩列並排,只要橫著看過去就會撞到。但官方發布公告一個字都沒提,中文圈的報導也全部寫「價格與 4.5 相同」。
老實說我第一眼也差點滑過去。US$0.30 到 US$0.50,帳面只差兩毛,誰會在意?會在意的是那些讓快取真的命中的人。而 Grok 4.6 主打的正是「長時間執行的 agent」——長系統提示詞、長對話、反覆讀同一份專案脈絡,恰恰是快取命中率最高的場景。
換句話說,官方在自己最主推的使用情境上,安靜地漲了三分之二。
快取這件事還有一個少人講的操作面。官方文件寫的是 API 會自動快取開頭相同的訊息,但同時建議你自己帶上 x-grok-conv-id 這個 HTTP 標頭來拉高命中率。同一個動作在 Grok 4.5 上是純好處,換到 4.6 之後它同時也是把帳單往上推的槓桿。
想知道自己命中多少,看回傳的 usage.prompt_tokens_details.cached_tokens(Responses API 換成 usage.input_tokens_details.cached_tokens)。這格是 0,代表快取根本沒發生。
我用一個客服型 agent 做假設試算(同樣是假設用量,數字你可以照自己的量替換):
- 設定:系統提示詞加固定檢索脈絡共 120,000 token,一天 400 次請求,其中 90% 命中快取。
- 命中的快取量:400 × 0.9 × 120,000 = 43,200,000 token/日,也就是 43.2M。
- Grok 4.5 費率:43.2 × US$0.30 = US$12.96/日。
- Grok 4.6 費率:43.2 × US$0.50 = US$21.60/日。
- 差距:US$8.64/日,一個月(30 天)就是 US$259。
那沒命中的 10% 呢?400 × 0.1 × 120,000 = 4.8M,兩代都是 US$2/百萬,費用一樣是 US$9.60。所以這整筆多出來的錢,百分之百來自快取那一格。
兩個機制還會疊在一起。如果這段常駐前綴長到讓整筆 prompt 越過 200,000,快取那格會再從 US$0.50 跳到 US$1.00——等於同一筆請求被咬兩次。
這也是為什麼我認為「Grok 4.6 和 4.5 同價」是一句會害人的話。它對偶爾呼叫幾次的人成立,對真的在跑常駐 agent 的人完全不成立——而後者正是官方要你升級的理由。
我自己的判斷是:如果你的工作流有一大塊固定不變的前綴(系統提示詞、角色設定、知識庫摘要),而且每天呼叫幾百次以上,那快取這一格的漲幅會蓋過 4.6 帶來的能力增益。這種情況我會先留在舊版,等到 4.6 真的解決了你手上某個做不到的任務再說。
想確認留在 Grok 4.5 會少付多少?上一代的完整規格與定價我整理在這篇,把兩張表對著看最快。
Grok 4.6 長時間 agent 的隱藏帳單:工具呼叫每千次 5 美元怎麼累加
Grok 4.6 的伺服器端工具是與 token 分開計費的:網頁搜尋、X 搜尋、程式碼執行各 US$5/1,000 次呼叫,檔案附件 US$10/1,000 次,Collections 檢索 US$2.50/1,000 次。只算 $2/$6 的成本估算,對 agent 場景一定嚴重偏低。
這一格最麻煩的地方在於:呼叫幾次不是你決定的,是模型決定的。你只是丟一句「幫我把這週的產業新聞整理成簡報」,它自己判斷要搜幾次、要跑幾次程式碼。
我照這個情境做了一組假設試算:
- 設定:每個任務呼叫網頁搜尋 6 次、X 搜尋 4 次、程式碼執行 3 次、檔案附件 2 次。
- 三種 US$5 級的工具:(6+4+3) = 13 次 × US$5 ÷ 1,000 = US$0.065。
- 檔案附件:2 次 × US$10 ÷ 1,000 = US$0.02。
- 工具小計:US$0.085/任務。
再把 token 算進來。假設每個任務輸入 40,000 token、輸出 5,000 token,一天 200 個任務、跑滿 30 天共 6,000 個任務:
- 輸入:6,000 × 0.04M = 240M × US$2 = US$480
- 輸出:6,000 × 0.005M = 30M × US$6 = US$180
- token 合計:US$660
- 工具合計:6,000 × US$0.085 = US$510
工具費是 token 費的 77%。換句話說,照 $2/$6 抓出來的 US$660 預算,實際帳單是 US$1,170——真正的支出有 44% 落在牌價完全看不到的那一格。這還是在我假設呼叫次數很克制的前提下算出來的。
還有一格連工具都不算,卻同樣走輸出費率:推理 token。官方的計費對照表把模型內部的推理 token 明列為「按完整的輸出 token 價格計費」,也就是短脈絡 US$6、長脈絡 US$12,跟你看得到的那段回答同價。
而 Grok 4.6 的預設推理強度是 high。什麼都不設,它就用四段裡的第三段在想。任務如果沒那麼難,把強度降到 medium 或 low,是這整篇裡最直接、也最少人真的去動的一根成本槓桿。
我在自己架 AI 系統的時候踩過同一類的坑——不是這家,但機制一樣。當時把「有需要就搜」設成預設,結果一個任務跑出十幾次搜尋,回頭看用量才發現錢都花在重複查同一件事上。那次之後我養成三個習慣:
❶ 硬鎖上限:在系統提示詞裡明寫「同一個任務最多搜尋 3 次」,並在程式端也設一道計數器攔截。
❷ 固定檢索自己跑:每次都要查的那幾份資料,我不讓模型去搜,直接在後端撈好塞進 prompt。
❸ 挑便宜的那格:能用 Collections 檢索(US$2.50/千次)解決的,就不要用網頁搜尋(US$5/千次),差一倍。
擔心 agent 自己亂跑燒錢?我把 Grok Build 建站那次踩到的坑寫成流程了。另外以為官方寫「免費」就真的夠用?我對過各家 agent 的官方額度落差,那篇的查證方法跟這篇是同一套:只看官方頁面,不看轉述。
批次處理買新旗艦為什麼反而虧?grok-4.3 的 1M 脈絡與兩成折扣
因為 Grok 4.6 的批次折扣是 0%,而同門的 grok-4.3 有 20%。官方價目表的批次折扣區只列了 grok-4.3 與 grok-4.20 系列,並註明未列出的模型沒有批次折扣;模型註冊表裡 grok-4.6 與 grok-4.5 的折扣欄位也都是 0。
再把 grok-4.3 的另外兩格拉出來看,落差更明顯:它的脈絡上限是 1,000,000 token,是 4.6 的兩倍;短脈絡單價是輸入 US$1.25、輸出 US$2.50,打完八折約等於 US$1.00 與 US$2.00。
這裡要先擋掉一個很容易誤會的推論:200,000 那道斷崖不是 4.6 專屬的。官方價目表上每一款有長脈絡定價的模型都標著同一個門檻,grok-4.3 也一樣會踩到,它的長脈絡費率是輸入 US$2.50、輸出 US$5.00。所以換過去的理由不是躲開斷崖,是斷崖之後那一格便宜得多。
我用「每天固定處理一批長文件」這個很常見的場景做假設試算——100 份文件,每份輸入 300,000 token、輸出 4,000 token:
- Grok 4.6:300,000 已達長脈絡門檻,全部用貴的費率。輸入 100 × 0.3M = 30M × US$4 = US$120;輸出 0.4M × US$12 = US$4.80。合計 US$124.80。
- grok-4.3:同樣踩過門檻,改用它自己的長脈絡費率。輸入 30M × US$2.50 = US$75;輸出 0.4M × US$5 = US$2,小計 US$77,批次八折後 US$61.60。
- 差距:US$61.60 約是 US$124.80 的 49.4%,等於省下約五成。
兩件事疊在一起才會差到一半:❶ 4.3 的長脈絡費率本來就低得多,輸入 US$2.50 對 US$4、輸出 US$5 對 US$12。
❷ 4.3 還能再打八折,4.6 一毛折扣都沒有。
那顆 1,000,000 token 的脈絡呢?它的價值不在省錢,在「塞得下」。同一份長文件在 4.6 的 500K 上限之前就得先切開,在 4.3 可以整份丟進去,少了切檔案這道工。
我知道「不要買最新的」聽起來很反直覺。但這是官方自己價目表上的硬證據:在「長文件、可離線排隊、不需要即時互動」這個場景,買新旗艦是純虧。買貴的理由應該是它能做到舊版做不到的事,不是因為它比較新。
還有一個容易被忽略的附加理由:前面提過 Grok 4.6 只部署在 us-east-1 與 us-west-2,而 grok-4.3 另有 eu-west-1。如果你的客戶或法遵要求資料留在歐洲,這一格會直接把選擇權收回去。
但換過去有代價,這點我必須先講。同一份模型註冊表上,grok-4.3 的速率上限是 37 RPS、1,800 RPM、10,000,000 TPM,而 Grok 4.6 是 150 RPS、7,200 RPM、50,000,000 TPM——大約只有四分之一到五分之一。
對「排隊跑一整批」的場景這通常不致命,因為批次本來就不趕時間;但如果你原本是靠高併發把一批文件在半小時內掃完,換過去整批的完成時間會被拉長。決定前先拿你實際的併發數去對這三個數字。
另外一格是預設值:grok-4.3 的預設推理強度是 low,Grok 4.6 是 high。同一份 prompt 丟過去,4.3 產出的推理 token 會少得多——帳單更好看,但輸出品質要自己抽樣驗過再決定整批搬。
下一步可做:把你手上的任務分成「要互動的」和「可以排隊的」兩堆,後面那堆先拿一天的量去 grok-4.3 跑一次對照。每天靠 AI 寫程式又不想被訂閱綁死?兩款主流編輯器的成本我攤開算過,那套「先分堆再選工具」的邏輯完全通用。
免費版真的能用 Grok 4.6 嗎?官方比較表七檔全部打勾
可以,免費方案就能用 Grok 4.6。官方定價頁的功能比較表裡,「Grok 4.6」那一列在全部 7 個方案欄位都是打勾的,包含免費方案。方案之間的差別在額度,不在模型。
那 7 個欄位分別是 Free、SuperGrok Lite、SuperGrok、SuperGrok Plus、SuperGrok Heavy、Business、Enterprise。
這一格我查得特別小心,因為那頁不是普通表格,是用 CSS 排版拼出來的格線,還分了三個分頁。這種頁型最容易把數字掛錯方案。所以我是先確認欄位表頭的順序,再對齊該列的每一格,確定行列沒錯位才敢下這個結論。
為什麼要這麼囉嗦?因為中文圈目前流通的說法幾乎全錯。我看到的版本包括「免費版用的是 Grok 3」「要付 US$30 訂 SuperGrok 才有 4.6」——前者是好幾代以前的資訊,後者跟官方自己的比較表直接打架。
更有趣的是,官方自己也在打架。定價頁上 SuperGrok 那張 US$30/月的方案卡,把「Grok 4.6 模型」列為主打賣點;但同一頁下方的比較表卻顯示免費方案也有這一格。行銷文案和功能表放在同一頁互相矛盾,難怪外面轉述得亂七八糟。
順便說一件我刻意不寫的事:網路上流傳的「免費版每 2 小時 10 次」「Think 模式 5 到 10 次」這類具體額度,我在官方頁面上一個都找不到。官方只寫了「寬鬆的限制」和「有限」這種模糊字眼。看到具體次數的,那不是官方數字,別拿來做決策。
至於月費,官方定價頁的個人分頁只渲染出三張價格卡:Free US$0、SuperGrok US$30/月、SuperGrok Plus US$100/月。Lite 和 Heavy 只出現在比較表欄位和按鈕上,沒有月費數字——所以外面流傳的那兩個價格,我同樣不會拿來當依據。
訂閱線怎麼配才不重複付錢,這篇不重做一次。不想為同一份權限付兩次?Grok 各檔訂閱線我整理成一張選擇路徑,需要挑方案直接看那篇比較快。另外想知道哪些「免費方案」其實只有帳面數字的一小塊,我也對過一輪。
Grok 4.6 官方自家跑分表十列攤開,它到底拿下幾個第一?
Grok 4.6 在官方自家那張跑分表上只拿下三個第一。把發布頁那十列逐列數過去,第一名的分布是:Grok 4.6 拿 3 項、Fable 5 拿 5 項、GPT-5.6 Sol 拿 2 項。同一張自家的表上,它輸掉 7 項。
先講清楚性質:這張表是 xAI 自己公布的比較數字,不是中立第三方的評測結論。我只做一件事——把官方自己放出來的十列全部攤開,然後數第一名落在誰身上。這件事沒有任何一篇中英文報導做過。
表格底下還有一行小字值得先讀:對手的分數取自它們自報或公開可得結果中的最佳值。所以這不是一次同場實測,是把各家最好看的數字排在一起比。
| 官方基準 | Grok 4.6 | GPT-5.6 Sol | Fable 5 |
|---|---|---|---|
| AA Intelligence Index | 61 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 73% | 70% |
| FrontierCode v1.1(Extended) | 61.3% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | — | 58.8% |
| AA-Briefcase | 1577 | 1502 | 1574 |
| Harvey LAB(Vals) | 15.8% | 2.5% | 11.3% |
Grok 4.6 真正拿下的三項是 GDPVal-AA v2(1753)、AA-Briefcase(1577)與 Harvey LAB(15.8%)。這三項的共同點很清楚:都是跨職業的知識工作、長流程商務任務、法律作業,不是在終端機裡跟編譯器搏鬥。
而它輸得最難看的一項,剛好就是終端機。Terminal-Bench v3.0 只有 26%,對上 GPT-5.6 Sol 的 34.6% 和 Fable 5 的 34.1%,只有對手的四分之三左右。DeepSWE v1.1 的 65.9% 也輸給 73%。
這裡有一個我覺得很值得記下來的細節:xAI 的 API 產品頁把 grok-4.6 寫成「在寫程式上領先業界」,但同一週、同一家公司的發布頁跑分表上,它在終端機任務落後兩家對手 8 個百分點以上。行銷頁和數據頁打架的時候,我一律相信數據頁。
還有一個藏在表頭裡、幾乎沒人注意的東西:那張表註明 Grok 4.6 與 4.5 跑在 High 檔,GPT-5.6 Sol 與 Fable 5 跑在 Max 檔。而模型註冊表顯示 Grok 4.6 其實還有一個 xhigh 沒有公布成績。
這可以雙向解讀。往好處想,它是用預設強度去打對手的最高強度,還能拿三項第一;往壞處想,最強那一段的成績沒公布,通常不是因為好看。我不打算替官方選一個解釋,但你在讀任何「追平某某」的標題時,值得先問一句:兩邊是不是跑在同一個推理強度上。
跟上一代比呢?Terminal-Bench 從 15.7% 進步到 26%,DeepSWE 從 54% 到 65.9%,AA Intelligence Index 從 56 到 61。進步是真的,只是進步之後仍然沒追上那兩家的軟體工程分數。
對不寫程式的人怎麼翻譯這張表:Grok 4.6 贏的那三項,講白了就是「照著一份長流程把一件工作做完」的能力。如果你的用途是整理資料、跑合約與文件、把一份長任務交出去讓它自己完成,這是它的主場。只想知道現在該把主力放在哪一家?五款旗艦的實際差距我整理過一次。
API、SuperGrok 還是 Cursor?Grok 4.6 三條管道的成本結構不一樣
取得 Grok 4.6 的三條管道,成本結構完全不同:API 是按 token 線性計費、訂閱是定額買額度、開發工具是「內含用量+超額」。選錯的代價不是貴一點,是整個預算模型都對不上。
官方發布頁列出的首發通道是 Cursor、Grok Build 和 xAI API,另外還有 OpenRouter、Vercel、Cloudflare 等夥伴平台。我把它們的計費邏輯拆成三種來看。
❶ 直接刷 API:付多少完全看你送多少 token,加上前面講的工具呼叫另計。優點是能塞進自己的系統、能精算;缺點是 200,000 那道斷崖和 agent 自己決定的工具次數,會讓月底的數字比你估的高。
❷ 訂 SuperGrok:官方個人分頁渲染出的月費是 US$30,上面那檔 SuperGrok Plus 是 US$100。因為 7 檔方案都含 Grok 4.6,你買的其實是額度不是模型。
❸ 走開發工具:Cursor 與 Grok Build 是首發通道,兩邊在發布首週(2026 年 8 月 12 日起算的第一週,約 8 月 19 日結束)提供 2 倍的內含用量。這個優惠有期限,看到這篇時請先確認還在不在。
那我會怎麼選?如果你一週只在聊天框裡問幾次,訂閱那 US$30 對你是浪費,比較表上免費方案就有 4.6。如果你每天在編輯器裡寫程式,走 Cursor 的通道通常比自己拼 API 划算,因為內含用量已經幫你吸收掉一部分波動。
如果你是要把模型接進自己的產品,我會建議先從聚合層試水:OpenRouter 的模型清單可以讓你不換程式碼就切換模型比價,Vercel 的 AI Gateway 和 Cloudflare 的 Workers AI 則適合已經把服務架在那邊的人,省掉一層自建轉發。
還有一筆很多人漏掉的成本:這幾條線幾乎都是美元扣款。海外交易手續費與匯率價差各家發卡機構的收法不同,實際落在帳單上的數字一定高於標價,長期訂閱下來不是小錢——這一筆要用你自己那張卡的條件去算,不能照抄別人的數字。訂閱前先算海外刷卡手續費與信用卡回饋,這篇能幫你少繳一筆。
Grok Build 那條線實際跑起來像什麼?我的建站紀錄在這裡,包含它在時間認知上出的錯——那類問題不會寫在任何官方規格表上。
三種工作流的 Grok 4.6 帳單體質:我會把哪一種留在 4.5
要不要動到 Grok 4.6,決定的是你的工作流長什麼樣子,不是版本號新不新。我把常見的用法分成三種體質,直接給判斷。
體質 A:重度快取型。特徵是有一大塊固定不變的前綴——系統提示詞、角色設定、知識庫摘要——而且每天呼叫幾百次以上。這種人被快取那格的 +66.7% 咬得最痛,前面的試算是每月多付約 US$259。
我會怎麼做:留在 Grok 4.5。除非 4.6 解決了你手上某個真的做不到的任務,否則多付的錢換不到等值的東西。
體質 B:長文件批次型。特徵是每天固定跑一批文件、可以排隊、不需要即時回應,而且單份輸入常常超過 200,000 token。這種人同時被斷崖和「批次折扣 0%」兩刀砍到。
我會怎麼做:改掛 grok-4.3。它的長脈絡費率只有 4.6 的一半上下,還有兩成批次折扣,前面試算的差距是省下約五成;百萬脈絡則讓長文件不必先切檔。
體質 C:長流程 agent 與互動式專案。特徵是一個任務要跑很久、中途會自己決定用哪些工具、產出偏向完整交付而不是單次問答。這是官方的主打場景,也是跑分表上它真的拿第一的地方。
我會怎麼做:上 Grok 4.6,但先把工具呼叫上限鎖住。不鎖的話,工具費可以吃掉 token 費七成以上的額外預算。
還有第四種人:只是想在聊天框裡用一用。那你不用加錢——官方比較表顯示免費方案就有 Grok 4.6,差別只在額度。
不適合現在動的人:需要資料留在歐洲的(4.6 沒有歐洲叢集)、需要語音輸出的(4.6 只輸出文字)、需要問 2026 年 2 月以後的事又沒接搜尋工具的。這三種情況換過去只會製造新問題。
三個立刻可做的下一步——
❶ 從最近一週的 API 用量撈出 prompt_tokens 最大值,看看你離 200,000 有多遠。
❷ 別用猜的估快取:從回傳的 cached_tokens 撈出實際命中量,一天的總和乘以 US$0.20 的漲幅差,就是換代每天多付的錢。
❸ 把可排隊的任務挑一天的量,拿 grok-4.3 跑一次對照,用真實帳單決定要不要搬。
還在猶豫要不要把工作流留在上一代?Grok 4.5 的真心話我寫在這篇;訂閱線的月費與額度怎麼配才不浪費,我也算過一次。
FAQ 常見問題
Grok 4.6 和 Grok 4.5 的價差到底在哪一格?我該用哪一個?
差在快取輸入這一格:短脈絡從 US$0.30 漲到 US$0.50、長脈絡從 US$0.60 漲到 US$1.00,都是 +66.7%;輸入 US$2、輸出 US$6 的牌價兩代相同。
判斷方式很簡單:工作流有固定長前綴又高頻呼叫、快取命中量大的,多付的錢就集中在這裡,我會先留在 4.5;低頻使用或每次 prompt 都不同的,快取幾乎沒命中,這筆漲價對你等於不存在。
我的 prompt 剛好在 200K 附近上下跳,有什麼實際做法可以避開翻倍?
把硬上限設在 180,000 token、留 10% 給對話成長與工具回傳,這是我會抓的安全邊界。做法有三個方向:整份文件別直接塞 prompt,改成先檢索再送相關段落;長對話定期摘要壓縮再續接;一次性的大任務拆成兩次請求。
前面試算過,輸入從 210,000 壓到 195,000 只砍了 7% 的長度,同一筆任務的費用卻能少 52.5%,投報率非常高。
只是想在聊天框用 Grok 4.6,需要訂 SuperGrok 嗎?
不需要。官方定價頁的功能比較表裡,Grok 4.6 那一列在全部 7 個方案欄位都是打勾的,包含免費方案;付費買到的是額度不是模型。
所以判斷準則是「你會不會撞到額度上限」,不是「免費版有沒有這顆模型」。要注意官方只寫了「寬鬆的限制」這種模糊描述、沒公布具體次數,外面流傳的數字都不是官方來源。
寫程式的話,Grok 4.6 贏 GPT-5.6 Sol 嗎?
以 xAI 官方自己公布的跑分表來看,軟體工程類的項目上並沒有贏。Terminal-Bench v3.0 是 26% 對 34.6%、DeepSWE v1.1 是 65.9% 對 73%,兩項都落後;只有 CursorBench v3.2 的 69.9% 高於 67.2%。
而 xAI 的 API 產品頁卻寫它在寫程式上領先業界,兩個官方頁面互相矛盾。如果你的主要用途是終端機任務或深度軟體工程,這張表不支持換過去。
Grok 4.6 有沒有批次折扣?大量離線任務怎麼跑比較省?
沒有,Grok 4.6 的批次折扣是 0%。官方價目表的批次折扣區只列了 grok-4.3 與 grok-4.20 系列(20%),並註明未列出的模型沒有折扣。
所以大量離線任務我會直接改掛 grok-4.3:它有 1,000,000 token 脈絡、短脈絡單價 US$1.25/US$2.50(八折後約 US$1.00/US$2.00),長脈絡也只要 US$2.50/US$5.00。前面用 100 份長文件試算的結果是省下約五成,而且 4.3 還有歐洲叢集可選。
結論:Grok 4.6 的價格風險在規則不在單價
把這篇的東西壓成一句:Grok 4.6 的價格風險不在單價,在規則。US$2 和 US$6 是真的,但它們只覆蓋 prompt 未滿 200,000 token 的請求,而且完全沒有涵蓋快取那格的 66.7% 漲幅與工具呼叫的另計費用。
我對完這幾張官方頁面之後最大的感受是:官方沒有騙人,但官方也沒有義務幫你把不利的那幾格擺在公告裡。那幾格全部躺在開發者文件和模型註冊表裡,任何人打開都看得到——只是沒人打開。
所以我給的順序永遠是:先量你的 prompt,再估你的快取命中量,最後才討論要不要換模型。倒過來做,你會先被行銷文案帶走,等到帳單來了才回頭找原因。
另外提醒一句時效:Cursor 與 Grok Build 的 2 倍內含用量是發布首週限定(2026 年 8 月 12 日起算,約 8 月 19 日結束),要試就趁還在的時候試;而發布公告與價目表隨時可能再動,做決策前建議自己去官方頁面回看一次。另一家改價那次我也做過同樣的逐格對照,你會發現這種「公告寫一半」的模式其實是常態。
如果這種把官方頁面逐格拆開算給你看的內容對你有用,歡迎訂閱夜羽凌的部落格,之後有新的模型定價拆解或工作流成本試算,你會不定期收到信。
參考資料
- SpaceXAI 官方發布公告:Introducing Grok 4.6(發布日期、定位、官方跑分表、首發通道與首週用量優惠)
- xAI 開發者文件・定價頁(兩段式 token 費率、長脈絡計價規則、批次折扣、伺服器端工具計費)
- xAI 開發者文件・模型總覽(脈絡上限 500K、知識截止日、推理可設定)
- xAI 開發者文件・grok-4.6 模型頁(模型註冊表:推理強度四段、模態、速率上限、服務叢集)
- SpaceXAI 官方定價頁(7 檔方案功能比較表與個人方案月費)
- xAI 開發者文件・快取用量與計費(
cached_tokens欄位、推理 token 按輸出價計費、門檻計入快取 token) - xAI 開發者文件・Priority Processing(
service_tier參數與 2 倍計價規則) - Cursor 官方部落格:Grok 4.6 上線說明(首發通道之一的取得方式)