AI 最新模型 2026:一週五款,GPT-6 到 Gemini 3.8 我按預算分三層

目錄

💡 核心結論速覽 (TL;DR)

  • 三天五款,按牌價分三層:旗艦 $10/$50(Astra、Fable 5.1)、中價 $1.25–$2(Muse、Qwen)、平價 $0.75(Flash)。
  • 五張牌價都沒漲,帳單各動一格:快取倍率、回合數、資料條款、建立費、token 用量。
  • AA 9/5 v4.2:智慧 Fable 5.1 56.8>Astra 54.7;每題 Flash $0.74 最省、Fable 5.1 $6.12 最貴。
  • 開發者先查 272K/快取/effort;訂閱戶看GPT-6 方案篇;11/21、12/31 前先別動。

三天,五款 AI 最新模型,三家旗艦廠——OpenAI、Anthropic、Google——一家都沒缺席,Meta 與阿里再各補一張牌。

三家的頂規方案都在我的卡費裡,這一週我做最多的事是反覆開三家的模型選單對名字。以前一個月出一款新模型我會很興奮,這一週 9 月 1 日到 3 日連著五封公告信,我的反應變成:先別點開,先算錢。

直接給答案:這五款 AI 最新模型我不是按誰最強排,是按 API 牌價分成三層、再用 Artificial Analysis 的每題成本排層內順序。

旗艦層是 GPT-6 Astra 與 Claude Fable 5.1、中價層是 Muse Spark 1.3 與 Qwen3.8-Max-0902、平價層是 Gemini 3.8 Flash。

五款的價目表看起來各自「沒漲」或「同價」,但帳單全部都動了,而且動的方式五款五個樣。

你手上可能只付了其中一家的訂閱,或者根本還沒付。沒關係,這篇的目標只有一個:看完之後,你知道這一週的哪一款該先打開看、哪一款先別碰,以及兩個到期日之前你其實不用急。


先講結論:2026 年 9 月這一週五款 AI 最新模型,我會先看哪一款

2026 年 9 月 1 日到 3 日發布的五款 AI 最新模型——Claude Fable 5.1、Gemini 3.8 Flash、Muse Spark 1.3、Qwen3.8-Max-0902、GPT-6 Astra——按 API 牌價可以分成三層:旗艦層輸入 $10、中價層輸入 $1.25 到 $2、平價層輸入 $0.75。

而我會先看的,不是最貴的那一層。

帶團隊做採購這些年,我學到的第一件事是:報價單上最大的那個數字,通常不是決定成敗的數字。真正該問的是「這筆錢買的是哪一層的能力,而我需要的是哪一層」。把五款先分層,你至少不會拿平價層的 Flash 去跟旗艦層的 Fable 比誰聰明——那個比法從一開始就問錯問題。

模型 每題成本(AA) 一句話
GPT-6 Astra旗艦 $10/$50$2.57單價最貴、每題 token 最省,還在分批開放
Claude Fable 5.1旗艦 $10/$50$6.12智慧指數最高、每題也最貴,快取讀取那一格降最多
Muse Spark 1.3中價 $1.25/$4.25$0.96每題成本次低,便宜檔的代價是資料與速率
Qwen3.8-Max-0902中價 $2/$6本篇未取得顯式快取 $0.17 要先付建立費,多數人用隱式更省
Gemini 3.8 Flash平價 $0.75/$3.75$0.74三代同價,但每題多跑幾趟

(每題成本引自 Artificial Analysis Intelligence Index v4.2,2026 年 9 月 5 日查證的改版後數字,單位美元;Qwen 的每題成本本篇未取得該站數值,不硬填。)

那我會先看哪一款?分三種人講。

只用訂閱、不碰 API 的人:先看你付錢的那家有沒有真的把新模型放進你的方案——這一週三家的答案都不是「有」或「沒有」那麼乾脆,後面〈不寫程式的人這一週該注意什麼〉那段有一張表。

在跑 agent、會反覆重讀長脈絡的人:先看 Claude Fable 5.1,因為它唯一動的那一格正好是你帳單最大宗的那一格;然後才看 Astra,而且是看它的每題 token 用量,不是看它的單價。

預算敏感、量大的人:先看 Muse Spark 1.3 的 Standard 檔和 Gemini 3.8 Flash 的 low 檔,這兩個組合是這一週「智慧沒掉多少、每題最便宜」的位置。Contributor 檔那個 $0.10 先別被吸過去,條件在中價層那段。

至於 GPT-6 Astra,我的順序是「先看、先不換」。它還在分批開放,等官方宣告全面開放再動,你什麼都不會錯過。

這段能帶走的一句:先把五款放進三層,再問自己的錢在哪一層——順序反過來,你會為用不到的層付錢。


時間線:9/1 Fable 5.1、9/2 三款同日、9/3 GPT-6 Astra,三家都把最強資安能力另外圈起來

這一輪 AI 最新模型的發布順序是:9 月 1 日 Anthropic 的 Claude Fable 5.1 與 Mythos 5.1,9 月 2 日 Google 的 Gemini 3.8 Flash、Meta 的 Muse Spark 1.3、阿里的 Qwen3.8-Max-0902 同一天。

9 月 3 日 OpenAI 的 GPT-6 Astra——9 月 1 到 3 日三天內五款。

而且 OpenAI、Anthropic、Google 三家都在同一週,把「防護較少的資安版本」另外圈了起來。

如果你有印象,7 月那一週也是這樣:十天內四大旗艦全到齊,再被一款中國模型補上第五張牌。上一輪五款比較在這裡:7 月那一週 Fable 5、GPT-5.6、Grok 4.5、Gemini 3.5、Kimi K3 怎麼排

才過兩個月,那張表就整個換血。這也是我為什麼每次都要先寫時間線——看評比之前,先確認它是不是 9 月之後寫的。

❶ 9 月 1 日(週二):Anthropic 發布 Claude Fable 5.1 與 Mythos 5.1。兩者是同一個底層模型,差的是外圍防護;Mythos 5.1 同價但走 Glasswing 邀請制,一般人拿不到。Fable 5.1 五格價目只動了快取讀取一格。

❷ 9 月 2 日(週三):三款同一天。Google 的 Gemini 3.8 Flash 直接 GA(模型卡標「Published 2 September 2026」),同日還有只給受信任防禦方的 3.8 Flash Cyber。

同一天 Meta 的 Muse Spark 1.3 上了 Muse Code 與 Meta Model API;阿里的 Qwen3.8-Max-0902 是快照版,主打顯式快取。

❸ 9 月 3 日(週四):OpenAI 的 GPT-6 Astra。公告原句是 "rolling out today to a limited set of organizations"——是分批開放,不是全面開放。

它同時是第一個被 OpenAI 自家 Preparedness Framework 判定網安能力達到 Critical 等級的模型。這件事對一般使用者的實際後果是「系統可能誤判合法活動而暫停你的工作」,Plus 到底有沒有 GPT-6、Pro 一週 200 則的額度怎麼算,我把官方五處說法並排對過,那篇講得細,這裡不重複。

有一個我覺得比「誰先誰後」更有意思的觀察:三家在同一週都把最強的資安能力另外圈起來——Anthropic 是 Mythos 5.1 的 Glasswing,Google 是 3.8 Flash Cyber,OpenAI 則是把較寬鬆的防護放進 Daybreak 計畫,官方寫的是數週內才擴大開放(另一篇公告、美國優先)。

你我買到的一律是「防護全開」的那一版,而防護全開是會反映在跑分上的——同一顆模型的兩種防護版本在同一個 benchmark 上差幾分,Anthropic 自己就公開過,Fable 5.1 與 Mythos 5.1 那 5 個百分點的防護價碼我在專文裡算過

換句話說,這一週你在網路上看到的所有「某某模型碾壓」,先問一句:它跑的是你買得到的那一版嗎?

收一句:三天內五款不是巧合,是三家都在搶同一個「開學季」;但你能買到的版本,跟他們拿去跑分的版本,不一定是同一個。


五款 AI 最新模型價目表沒動的字,帳單都動了:五種漲價方式一次看

這五款 AI 最新模型裡,有四款的牌價欄位看起來「沒漲」或「同價」——Claude Fable 5.1 輸入輸出照舊 $10/$50、Gemini 3.8 Flash 三代同價 $0.75/$3.75、Muse Spark 1.3 標準檔 $1.25/$4.25、Qwen3.8-Max-0902 沿用 $2/$6。

但五款的帳單都動了,而且動的方式全不一樣。

我自己踩過一次這種雷。某一版模型換上去之後單價一毛沒變,月底帳單卻差不多翻了一倍,查了半天才發現新版每題多跑好幾趟工具呼叫、每趟都把整段脈絡重送一次。從那次之後,我看價目表只看一個問題:哪一格會被我的用法放大。這一週五款,放大的格子各不相同。

模型 牌價(輸入/輸出) 真正動的那一格 我拆過的專文
Claude Fable 5.1$10/$50(沒動)快取讀取 $1 → $0.25,其他四格不動官方說省 25%,我算完有人只省 0.6%
Gemini 3.8 Flash$0.75/$3.75(三代同價)每題成本 $0.74(v4.2),比 3.7 Flash 多四成,因為它多跑幾趟官方自己寫的那句勸退,每題成本我拆成三格
Muse Spark 1.3$1.25/$4.25(標準檔)Contributor 檔 $0.10/$0.20,代價是資料與 1/30 速率便宜 21 倍是拿自己比自己,速率只剩三十分之一的細節
Qwen3.8-Max-0902$2/$6(沒動)顯式快取 $0.17,但建立費 1.25 倍、只活 5 分鐘$0.17 的前提是先付建立費,我算出 8 次那條線
GPT-6 Astra$10/$50(Sol 促銷價 $4/$20 的 2.5 倍,促銷至少到 11/21)單價漲、每題 token 少,272K 以上整筆翻倍同樣 $10/$50 的兩張價目表逐格對完,帳單差在三格

五種動法,我一款一款講白話。

Fable 5.1 是「只降一格」。官方定價文件的腳註寫得很精確:Fable 5.1 與 Mythos 5.1 的快取命中收的是基本輸入價的 0.025 倍,其他所有 Claude 模型都是 0.1 倍。所以你省多少完全看「重複讀同一段脈絡」在你帳單裡佔幾成——一次性長 prompt 的人幾乎拿不到,長時 agent 的人拿最多。

Gemini 3.8 Flash 是「同價但多跑幾趟」。官方公告自己寫了它 "works harder",會多做推理步驟、反覆呼叫工具,"might use more tokens"。

Artificial Analysis 9 月 3 日的評測文章(v4.1.1)量到的幅度是每題成本從 $0.40 到 $0.58,多 43.4%;9 月 5 日改版後的 v4.2 是每題 $0.74——單價那一列一個字沒改。

Muse Spark 1.3 是「用你的資料換折扣」。標準檔 $1.25 輸入、Contributor 檔 $0.10,12.5 倍的價差來自一句話:Meta 可以拿你的提示與輸出去訓練。而且 Contributor 檔的每分鐘請求數只剩標準檔的三十分之一。便宜的不是模型,是你交出去的東西。

Qwen3.8-Max-0902 是「先付建立費」。顯式快取命中 $0.17 是真的,但建立那份快取要付標準輸入價的 1.25 倍,而且快取只活 5 分鐘。同一段前綴在 5 分鐘內重複不到 8 次,開顯式反而比自動的隱式快取更貴。

GPT-6 Astra 是「單價漲、用量降」。$10/$50 是 GPT-5.6 Sol 促銷價 $4/$20 的 2.5 倍(以促銷價計,促銷至少到 2026 年 11 月 21 日,之後要重算)。

但 Artificial Analysis 9 月 3 日的文章(v4.1.1)量到它每題輸出 token 只有 14,934,比 Sol 的 16,879 少 11.5%;在 Coding Agent Index 裡 token 用量甚至只有 Sol 的三分之一。

單價乘以用量之後,智慧指數的每題成本比前代貴 75%,寫程式代理的每題成本則跟 Sol 差不多。

看出共通點了嗎?五家都把「漲價」藏在單價以外的地方——快取倍率、回合數、資料條款、建立費、token 用量。價目表是廣告,用量結構才是帳單。

所以我的判斷是:這一週看價格,不要看「輸入/輸出」那兩格,要看每一家「動的那一格」是不是你帳單裡最大的那一格。


旗艦層($10/$50):GPT-6 Astra 與 Claude Fable 5.1 同牌價,每題 $2.57 和 $6.12 是怎麼來的

GPT-6 Astra 與 Claude Fable 5.1 的 API 牌價都是輸入 $10、輸出 $50,但 Artificial Analysis 智慧指數(9 月 5 日 v4.2)的每題成本一個是 $2.57、一個是 $6.12。

差距不是來自單價,是來自每題吐的 token:AA 9 月 3 日文章(v4.1.1)量到 Fable 5.1 每題輸出 31,173 個、Astra 只用 14,934 個。

這是我看完這一週最需要「翻譯」的一件事。兩家旗艦的牌價第一次一模一樣,於是網路上出現一堆「同價的話當然選分數高的」——但同價從來不等於同帳單。

先把數字放好。同一套智慧指數評測跑下來:

❶ 智慧分數(AA 9/5 v4.2):Fable 5.1 56.8、Astra 54.7,差 2.1 分,Astra 全站排第 2,只輸 Fable 5.1。

❷ 每題輸出 token(AA 9/3 文章,v4.1.1):Fable 5.1(xhigh)31,173、Astra 14,934——Astra 大約是一半。

❸ 每題成本(AA 9/5 v4.2):Fable 5.1 $6.12、Astra $2.57,Astra 大約是 42%。

所以旗艦層的真正問題不是「哪個比較聰明」,是「多出來的那 2.1 分,你願不願意用 2.4 倍的每題成本去買」

兩家 API 都在燒的這幾個月,我的做法是按工作分邊:需要它自己跑一整晚、反覆重讀同一份脈絡的 agent 工作,Fable 5.1 降最多的那格快取讀取會把差距整個吃掉;一次性、脈絡不重複的推理任務,Astra 的省 token 才會真的反映到帳單。

順帶一提,OpenAI 自家公告文末的比較表上,Artificial Analysis 智慧指數那一列(引的是 v4.1.1)Astra 也是排在三款 Claude 後面——這不是我挑的數字,是官方自己放上去的。

逐格怎麼讀、快取倍率、272K、知識截止,這些我全部留在 GPT-6 Astra 與 Claude Fable 5.1 三種用法各該用哪一款的完整對照,本篇只做同層排序。

還有一格獨立評測量到的退步要放在旗艦層一起看:Artificial Analysis 9 月 3 日的文章寫 Astra 在 GDPval-AA v2(知識工作)的 Elo 是 1629,比前代 Sol 的 1710 低 81 分,Fable 5.1 是 1853。

也就是說,把「整份知識工作交出去」這種用法,旗艦層裡目前是 Fable 5.1 的主場。

這段能帶走的判斷:旗艦層同價不同帳,先看你每題吐多少 token、重讀多少脈絡,再看分數;分數是最後一個看的東西。


中價層($1.25–$2):Muse Spark 1.3 用資料換折扣、Qwen3.8-Max-0902 快取先付建立費——便宜的條件是什麼

中價層的兩款——Meta 的 Muse Spark 1.3(標準檔 $1.25 輸入、$4.25 輸出)與阿里的 Qwen3.8-Max-0902($2 輸入、$6 輸出)——各自都有一個「更便宜」的入口,但兩個入口的條件都寫在價目表之外:Muse 是把你的資料交出去,Qwen 是先付一筆建立費。

這一層最容易讓人做錯決定,因為它的宣傳數字最漂亮。

Muse Spark 1.3:中價層每題 $0.96,但 Contributor 檔不是給公司程式碼用的

先講它真正強的地方。Artificial Analysis 9 月 5 日的 v4.2 給 Muse Spark 1.3 的智慧指數是 53.0(max 檔),全站排第 9,離 GPT-6 Astra 的 54.7 只差 1.7 分。

每題成本 $0.96,在有數字的四款裡只比 Gemini 3.8 Flash 貴;幻覺率 31.5%(AA 9 月 3 日文章)在有數字的四款裡最低。

以 $1.25 的輸入價拿到這個位置,中價層的名字它擔得起。

真正讓人心動的是 Contributor 檔:輸入 $0.10、快取 $0.002、輸出 $0.20。輸入便宜 12.5 倍,快取輸入便宜 75 倍。但代價有兩條,官方都寫了:Meta 可以用你的提示與輸出訓練未來模型;每分鐘請求上限只有標準檔的三十分之一。

我一個做外包開發的朋友差點踩到第一條。他看到 Contributor 檔的價格,第一個反應是把手上一個客戶專案的自動化測試全搬過去跑——跑了半天才想到,那份程式碼是簽過保密條款的,「拿去訓練」這四個字等於他單方面違反合約。他後來只敢把自己的開源側專案放在 Contributor 檔,客戶的東西一律走標準檔。

這就是中價層的規則:便宜檔的價格是給「你不在乎它被誰看到」的資料用的。接案、公司程式碼、任何簽過保密條款的東西,你能選的只有標準檔,那個折扣從一開始就跟你無關。三檔訂閱、速率牆怎麼撞,Muse Code 那篇我把價目表旁邊被縮小的那張表整個攤開過

還有一個小但書:Meta 的官方定價頁我這一輪沒有重新抓一次,上面的價格引的是 Artificial Analysis 與我先前查證過的官方數值,實際下單前請以 Meta 官方定價頁為準。

Qwen3.8-Max-0902:$0.17 的快取要先付 $2.5,8 次是分界線

Qwen 這一版的公告主打「顯式快取命中 $0.17」,這個數字是真的,但它的前提是:建立那份快取要先付 $2.5,比標準輸入價 $2 還貴 25%,而且快取只活 5 分鐘。

我算過那條線:同一段前綴在 5 分鐘內重複命中不到大約 8 次,開顯式反而比隱式快取($0.25、不用建立費、自動開、關不掉)更貴。也就是說,多數人該用的不是那個 $0.17 的模式,是什麼都不做的預設模式。Qwen 三種快取模式怎麼挑、8 次那條線怎麼算出來的,那篇有完整推導。

Qwen 這一版升級的是編碼、協作 agent 與原生視覺三項,1M 上下文和價格都沒動。已經在跑多工具 agent 的人才有換的理由;只做單次問答的人,先把快取模式選對,省的比換版多。

收一句:中價層的便宜都有條件——Muse 的條件是資料歸屬,Qwen 的條件是重複次數。條件不符,你付的就是標準價,而標準價在這一層並不特別便宜。


平價層($0.75):Gemini 3.8 Flash 三代同價,貴的是回合數,介紹價 12/31 到期

Gemini 3.8 Flash 的 API 價格是每 100 萬 token 輸入 $0.75、輸出 $3.75,和 3.7 Flash、3.6 Flash 逐格相同。

但它是五款裡唯一一款官方自己在公告裡寫「會多用 token」的模型,Artificial Analysis 9 月 3 日的評測(v4.1.1)量到每題成本比 3.7 Flash 多 43.4%($0.40 → $0.58),9 月 5 日改版的 v4.2 是每題 $0.74;而這個價格本身到 2026 年 12 月 31 日就到期。

平價層只有它一款,所以這一段講的其實是「這一週最便宜的入口,它的便宜有幾個附帶條件」。

第一個條件是回合數。官方公告原句:

These performance gains stem from a core design choice: 3.8 Flash works harder. On complex tasks, it exhibits greater diligence — executing extra reasoning steps, and calling tools iteratively. At times, the model might use more tokens to maximize performance, especially at higher effort levels.

翻成人話:它變聰明的方式是「更用力」,而更用力是要付錢的。多呼叫一次工具,就多把整段脈絡送一次——這是代理式流程的結構性成本,跟單價無關。

所以 Google 在同一段公告裡把退路也寫好了:效率優先的人可以降 effort 檔位,或繼續用 3.7 Flash。廠商在新模型公告裡主動寫退路,這種句子不會白寫。

第二個條件是到期日。$0.75/$3.75 是介紹價,2027 年 1 月 1 日起變成 $1.50/$7.50,輸入輸出直接翻倍;快取讀取現在是 $0.075。你現在跑的每一塊錢,明年一月都會變兩塊。

第三個條件是它強的地方很挑。輸出速度 AA 9 月 3 日的 v4.1.1 量到 397.6 token/秒,9 月 5 日的 v4.2 頁面速度欄暫列 N/A;智慧指數 v4.2 是 47.1,在平價層很夠用。

但 OpenAI 自家表上的 Terminal-Bench 4.0 它只有 19.1%——開放式的通用代理任務,這一層還撐不住,別為了省錢把整條 agent 流程搬過來。

那平價層怎麼用才對?我的做法是 low 檔跑一週真實流量,只把失敗的案例升檔。官方給的退路是降 effort,我把三檔的數字看過一輪之後,low 檔是這一週最實際的省錢位置——而且跟「追不追新」無關。

Gemini 3.8 Flash 三檔 effort 各花多少、輸入為什麼膨脹五成,我逐格拆過,要調旋鈕之前先看那篇。

還有一件只有走消費端才會遇到的事:Gemini 是這三家裡唯一有台幣定價的——AI Plus NT$165、AI Pro NT$650、Ultra 5x NT$3,300、Ultra 20x NT$6,500。

但官方公告在消費端只點名了 AI Pro 與 Ultra 訂閱者拿得到 3.8 Flash,免費方案與 AI Plus 沒被點名,本篇未確認它們拿不拿得到。

這段能帶走的判斷:平價層便宜是真的,但它的便宜有三個附帶條件——降檔才便宜、年底前才便宜、別拿它做開放式 agent 才便宜。


獨立評測把五款 AI 最新模型排成什麼樣:AA 智慧指數、每題成本、幻覺率、速度

用 Artificial Analysis 同一套指標(2026 年 9 月 5 日的 v4.2)把五款 AI 最新模型排一次,你會得到三個不同的第一名:智慧指數是 Claude Fable 5.1(56.8),每題成本是 Gemini 3.8 Flash($0.74),輸出速度是 Muse Spark 1.3(190 token/秒)。

有數字的四款裡沒有任何一款三項都贏,這正是「分三層」而不是「選最強」的理由。

先看表,數字是 2026 年 9 月 5 日查證的 v4.2 版本;Gemini 3.8 Flash 的速度欄該版暫列 N/A,我照實寫。

模型 智慧指數 每題成本 輸出速度
Claude Fable 5.156.8$6.1268.7 tok/s
GPT-6 Astra54.7$2.5787.5 tok/s
Muse Spark 1.353.0$0.96190 tok/s
Gemini 3.8 Flash47.1$0.74v4.2 未列(9/3 v4.1.1 量到 397.6)
Qwen3.8-Max-0902本篇未取得本篇未取得本篇未取得

(AA Intelligence Index v4.2,2026 年 9 月 5 日查證,各模型取最高 effort 檔;OpenAI 公告表引用的是 v4.1.1(Astra 61.2、Flash 58.7),兩版不可混讀。Qwen 三格本篇未取得該站數值,等補上再更新。)

幾件我看這張表時最在意的事。

❶ 幻覺率的排序跟智慧指數完全不同。AA-Omniscience 的幻覺率(AA 9 月 3 日文章,v4.1.1):Muse Spark 1.3 31.5% 最低,GPT-6 Astra 51.3%(前代 Sol 是 92.2%,這是 Astra 這一代最大的進步),Fable 5.1 卻是 72.6%。

最聰明的那一款,最常在不知道的時候硬答。做內容、做客服的人,這一格比智慧指數重要。

❷ 寫程式代理另有一張榜。Coding Agent Index(AA 9 月 3 日文章)是「模型+工具」的組合分:Fable 5.1 在 Claude Code 拿 70 分榜首,Astra 在 Codex 67,Muse Spark 1.3 在 Muse Code 也約 67。

這裡的 token 效率差距更誇張——Astra 的用量只有 Sol 的三分之一,所以每題成本跟 Sol 差不多、分數卻高 2 分。

❸ 另一家機構的尺會給出另一個第一名。Epoch AI 的 ECI 綜合指數給 Astra 169.23,史上最高,Fable 5 是 162.9、Fable 5.1 是 162.88——但信賴區間與 Fable 5 重疊,我不會用「碾壓」這種字。

同一顆模型 AA 排第 2、Epoch 排第 1,兩家都把它放前二,但差距與信賴區間重疊都不支持「碾壓」——同一顆模型三種讀法的差別我在對照篇拆過。你信哪把尺,取決於那把尺量的東西像不像你的工作。

還有一個「沒有數字」的事實也要放進來:發布兩天後,LMArena 上還沒有 GPT-6 Astra 的排名。所以現階段任何「Astra 在 Arena 上排第幾」的說法,都不是來自該站。

收一句:三把尺三個冠軍,這張表的正確讀法不是找最高分,是找「我的工作最像哪一列」——像 agent 的看 Coding Agent Index,像寫作客服的看幻覺率,像批次處理的看每題成本。


不寫程式的人這一週該注意什麼:ChatGPT、Claude、Gemini 三家訂閱端各自拿到哪一款

訂閱端這一週的實況是:ChatGPT 裡的 GPT-6 叫「GPT-6 Pro」、開給 Pro $100 以上;Claude 的 Fable 5.1 開給 Pro 與 Max、Free 不可;Gemini 3.8 Flash 官方只點名 AI Pro 與 Ultra——三家沒有一家是「付了錢就自動拿到最新款」。

這一週我反覆對三家選單的心得是:選單裡的名字跟公告上的名字常常對不上——ChatGPT 端找不到「Astra」三個字,找到的是「GPT-6 Pro」;Claude 端的 Fable 5.1 不是任何方案的預設,要自己去選。

訂閱端叫什麼 哪些方案拿得到 台灣價格
ChatGPTGPT-6 Pro(公告叫 GPT-6 Astra Pro)聊天:Pro $100 以上;Plus 在 Work 與 Codex 有限量;Free/Go 定價頁標 No美金計價:Go US$8、Plus US$20、Pro US$100 起
ClaudeClaude Fable 5.1(要自己選)Pro 走 usage credits;Max 內含、上限週額度 50%;Free 不可美金計價:Pro US$20 月繳(年繳折合 US$17)、Max US$100 起
Gemini3.8 Flash官方點名 AI Pro 與 Ultra;免費與 AI Plus 沒被點名唯一台幣定價:Plus NT$165、Pro NT$650、Ultra NT$3,300/NT$6,500
Muse/Qwen走 Muse Code 與 API不在三家訂閱裡按量計費,美金

三家各有一個坑,我一家講一個。

ChatGPT:介面裡叫 GPT-6 Pro,開給 Pro $100 以上。Plus 到底有沒有、Pro 的週額度怎麼跟 Sol Pro 共用,官方五處說法不一樣(繁中定價頁比較表 Plus 標「有限額」、英文版同一格是 Yes),官方五處說法我逐條並排對過的那篇有完整表。

這裡只給一句:截至 2026 年 9 月 5 日,聊天選單裡以 GPT-6 名義出現的只有 GPT-6 Pro。

台灣區 App Store 內購價是 Go NT$270、Plus NT$690、Pro 5x NT$3,300、Pro 20x NT$6,990,這是 Apple 內購價、不是官網結帳價。方案頁上的字才算數,報導上的字不算——包含這篇。

三檔差 US$12 到底買到什麼,ChatGPT Go、Plus、Pro 三檔我算過一輪,那篇的方案定位這一週沒變。

Claude:拿得到,但那個 50% 不是加碼。Max 方案可以把每週額度上限的至多 50% 花在 Fable 系列,它是同一個池子的使用上限,不是多給你 50%;Pro 則走 usage credits 另外計。

而且 Fable 在任何方案都不是預設模型,網頁版要在模型選單自己選,Claude Code 要更新到 2.1.257 以上再打 /model fable;thinking 永遠開著、關不掉,Claude 網頁版預設 effort 是 medium。

Gemini:只點名了兩檔。3.8 Flash 的公告在消費端只點名 Google AI Pro 與 Ultra 訂閱者,免費版與 AI Plus 沒被點名,本篇未確認它們拿不拿得到——要確認就自己開一次 Gemini App 看選單。它是三家裡唯一有台幣定價的。

如果你正在猶豫這 US$20 到底該花在哪一家,我的順序是:先確認免費層夠不夠用,再挑一家付。AI 免費版跟付費版的真實差距、$20 花在哪一家我實測過一輪

三家一起選的話,Claude、ChatGPT、Gemini 誰當主力、誰當副手的購買建議那篇的框架這一週依然適用。而不管你選哪家,付的都是美金,三家 AI 訂閱的海外刷卡手續費與回饋我實算過,長期付的人差一張卡就差好幾杯咖啡。

這段能帶走的判斷:這一週訂閱戶的功課只有一件——先確認你付的那一檔到底含不含新模型,公告上的字不算,方案頁的字才算。


開發者這一週該做的三件事:先查 272K、快取模式、effort 檔位,再決定換不換

開發者面對這五款 AI 最新模型,換不換的答案不在跑分表上,而在三個你自己帳號裡就查得到的欄位:長脈絡的計價門檻(272K)、快取的倍率與模式、effort 檔位的可用範圍——五款在這三格的規則全都不一樣。

我做自動化的習慣是:新模型出來先不改 model ID,先把上個月的 usage 資料拉出來,看這三格。因為換版最常見的災難不是「變笨了」,是「同樣的流程,帳單結構被換掉了」。

❶ 先查 272K 這條線:你的請求會不會跨過它。

GPT-6 Astra 超過 272K 是整筆請求翻倍計價,不是只算超出的部分;Claude Fable 5.1 送 900K 和 9K 同價;Gemini 3.8 Flash 是單一價 $0.75/$3.75,同家的 Gemini 3.1 Pro Preview 才有 200K 那條線($2/$12 跳到 $4/$18)。

常態在 30 萬 token 以上的人,旗艦層帳單划算的其實只剩一個,272K 那條線怎麼算錢我在對照篇逐格拆過

❷ 再查快取模式:五家五種倍率。

五家的快取讀取倍率全不一樣——Fable 5.1 降到輸入價的 0.025 倍、Astra 是 0.1 倍、Muse 兩檔差 75 倍、Qwen 顯式要先付建立費而隱式免建立費。你先去看自己回應裡的快取讀取 token 佔輸入幾成:佔比高的,Fable 5.1 那一格會壓過一切;佔比低的,這格根本不用看。

四種用法代進 Fable 5.1 新價目,有人省 0.6%、有人省 63% 的那張表,就是這一格的量化版。

❸ 最後查 effort 檔位:新版可能把你原本的檔位拿掉。

GPT-6 Astra 的 reasoning.effort 只有 low/medium/high/xhigh/max,不支援 none——GPT-5.6 有 none,原本用 none 跑便宜任務的人被迫升到 low,成本直接上升。

Fable 5.1 的 thinking 不能關。Gemini 3.8 Flash 是 low/medium(預設)/high 三檔,low 檔是這一週最好的降本位置。Muse Spark 1.3 在 xhigh 與 max 之間,AA 9 月 3 日的文章只量到 1 分的差距,沒必要開到最高。

順帶一提 Astra 的 Fast mode 是 2 倍價(輸出 $100)、歐盟資料落地不可用,別把它當預設。

三格查完,換不換的判斷就很機械了:三格裡有兩格對你有利才換;只有一格有利的,等下一版。不要因為單價同價、或者分數多兩分就動——這一週我看到最多人做的錯決定,就是拿旗艦層的分數去替中價層的帳單背書。

還有一件事跟錢無關但會卡流程:GPT-6 Astra 只接 Responses API 的工具呼叫、不接受 temperature 與 top_p、API 免費層不支援。你的現有程式碼如果還在 Chat Completions 上跑工具,換 ID 之前得先搬家。

收一句:換模型之前先查三格,查完你會發現「同價」這兩個字在開發者的帳單上幾乎沒有意義。


什麼情況先別動:11/21 Sol 促銷到期、12/31 Flash 介紹價到期、Astra 灰度未 GA

這一週的五款 AI 最新模型裡,有三個「還沒定案」的變數會在接下來四個月內改變排序:GPT-5.6 Sol 的促銷價至少保到 2026 年 11 月 21 日、Gemini 3.8 Flash 的介紹價 12 月 31 日到期、GPT-6 Astra 官方尚未宣告全面開放。

這三件事沒補齊之前,先別動的人不會吃虧。

做過採購的人都知道,報價單上寫著「到某日為止」的數字,跟沒寫到期日的數字,是兩種不同的東西。這一週剛好兩層都有到期日。

❶ 11 月 21 日:旗艦層的「2.5 倍」會重算。Astra 貴 2.5 倍是以 Sol 促銷價 $4/$20 計,促銷官方保證至少到 11 月 21 日,之後這個倍數要重算。你要是為了「Astra 太貴」而觀望,11 月 21 日之後這個理由可能變薄。

❷ 12 月 31 日:平價層會翻倍。Gemini 3.8 Flash 的 $0.75/$3.75 在 2027 年 1 月 1 日變成 $1.50/$7.50。如果你的年度預算是拿現在的價格乘出來的,明年一月的第一張帳單會直接打臉。年底前該做的不是換模型,是把非即時任務丟到 Batch/Flex 層(現在半價)、把重複脈絡改用快取。

❸ Astra 還在灰度。ChatGPT Release Notes 到我查證時(2026 年 9 月 5 日)最新條目仍是 9 月 3 日那則:

Astra is not yet generally available. Broader availability is planned over the coming days.

沒有 9 月 4 日、9 月 5 日的新條目。公司帳號還有另一層:公告頁另寫 Enterprise 是 "access is off by default at launch",管理員要手動開。你看不到它,多半不是你的問題。

❹ 補上的一格:Astra 的速度有數字了。Artificial Analysis 9 月 5 日的 v4.2 量到 Astra 87.5 tok/s,比 Fable 5.1 的 68.7 快、比 Muse Spark 1.3 的 190 慢;LMArena 上仍然沒有它的排名。

速度對 agent 流程是硬指標,這格補上之後,「換不換」少了一個不確定項。

還有一個變數屬於中價層:Meta 的官方定價頁我這一輪沒有重新抓,Muse Spark 1.3 的價格引的是 Artificial Analysis 與先前查證的官方值。價格層級沒有變動的跡象,但下單前請以官方頁為準。

那什麼人現在就該動?只有兩種:快取讀取佔帳單四成以上、而且已經在用 Fable 5 的人(Fable 5.1 對你是同價換折扣);以及原本跑 3.6 Flash 且覺得堪用的人——同價換到 3.8 Flash 之後把 effort 降到 low,才可能不多花錢;不降檔的話,AA 量到的是每題反而更貴。

其他人,等兩個到期日之後再排一次順序,你不會錯過任何東西。

這段能帶走的判斷:這一週的排序有效期只到 11 月 21 日,最晚到 12 月 31 日;把這兩個日期記進行事曆,比記住任何一個跑分數字都有用。


FAQ 常見問題

預算只有 US$20,這一週該訂哪家?

先問你要的是「聊天裡拿到最新款」還是「額度夠用」。US$20 在 ChatGPT 是 Plus,聊天選單裡目前以 GPT-6 名義出現的只有開給 Pro $100 以上的 GPT-6 Pro,Plus 拿到的是 Work 與 Codex 裡的限量 Astra,細節在前面連到的那篇。

US$20 在 Claude 是 Pro,Fable 5.1 拿得到但走 usage credits、另外計費。

Gemini 沒有 US$20 的檔,台幣 NT$650 的 AI Pro 是官方點名拿得到 3.8 Flash 的最低方案。三家都不是「付了就自動拿到旗艦」,所以我的順序是先看你現在最常用的那個介面,再看它有沒有把新模型放進你的方案。

每題成本只有 Claude 幾分之一的 Muse Spark 1.3,能取代 Fable 5.1 嗎?

看你的資料能不能交出去、以及你要的是哪一格。Muse Spark 1.3 的智慧指數 53.0 只比 Fable 5.1 的 56.8 低 3.8 分,每題成本 $0.96 對 $6.12(AA 9 月 5 日 v4.2)。

幻覺率 31.5% 還比 Fable 5.1 的 72.6% 低得多(AA 9 月 3 日文章);寫程式代理的組合分也接近(約 67 對 70)。

但那個最便宜的 Contributor 檔要讓 Meta 用你的資料訓練、速率只剩三十分之一,接案與公司程式碼只能走標準檔。標準檔跑得起你的任務、資料又不敏感,Muse 可以當主力;需要 1M 全窗同價、快取讀取降最多的長時 agent,還是 Fable 5.1 的主場。

五款裡哪一款免費就能用?

消費端的免費層這一週沒有一款拿得到最新款:ChatGPT 英文定價頁對 GPT-6 Astra 那列 Free 與 Go 標 No,免費版預設仍是 GPT-5.6 Luna;Claude Free 不含 Fable 5.1;Gemini 官方只點名 AI Pro 與 Ultra,免費方案沒被點名(本篇未確認,自己開 App 看選單最準)。

開發者這邊,GPT-6 Astra 的 API 免費層寫的是 Not supported;Gemini 開發者端另有免費層可以先摸手感;Qwen 新帳號有試用額度,細節在我的 Qwen 那篇。想不花錢先試,入口在開發者端,不在聊天 App。

GPT-6 Astra 是不是這五款裡最強的?

看你用哪把尺,而且我不會替你選那把尺。Artificial Analysis 9 月 5 日的 v4.2 智慧指數 Astra 54.7 排第 2,只輸 Fable 5.1 的 56.8;OpenAI 公告表引用的 v4.1.1(61.2)則排在三款 Claude 之後。

Epoch AI 的 ECI 綜合指數卻給它史上最高的 169.23,只是信賴區間跟 Fable 5 重疊。同一顆模型兩家機構一個第 2、一個第 1。

它真正壓倒性的地方是每題 token 用量少、幻覺率從前代的 92.2% 降到 51.3%(AA 9 月 3 日文章);退步的地方是知識工作(同一篇量到 GDPval-AA Elo 1629,比前代低 81 分)。「最強」這個問題在這一週沒有單一答案,所以我才用分層取代排名。

這一週的五款都不動,等下一波會不會錯過什麼?

以現在能查到的資訊,等到 11 月 21 日之前不會錯過任何不可逆的東西。GPT-6 Astra 還在分批開放、LMArena 上還沒有排名;Gemini 3.8 Flash 的價格年底前不變、3.7 Flash 官方也說仍完整支援;Fable 5.1 只降快取讀取那一格,你現在用 Fable 5 的話帳單不會變差。

唯一有「時間成本」的是快取讀取佔比高的長時 agent 使用者——你每多等一天,就多付一天快取讀取舊倍率的差價。其他人先把三格查清楚,等兩個到期日過了再排一次順序,那時候的表會比這一週的乾淨得多。


寫在最後:「最新」這個詞的保鮮期,這一週剩三天

追完這五款,我最大的感想不是哪一款強,而是「AI 最新模型」這五個字的保鮮期已經短到三天——9 月 1 日的最新到 9 月 3 日就不是最新了。用「最新」當選型標準的人,這一週會換三次主意。

所以我改用預算分層。分層的好處是它不會被下一封公告推翻:旗艦層永遠在比每題 token、中價層永遠在比條件、平價層永遠在比回合數。哪一款進哪一層會變,但你該看的那一格不會變。

這是我看報價單多年養成的習慣:價目表是用來讀的,不是用來信的。五家在同一週用五種方式證明了這句話——單價沒動,帳單全動。

如果你想把手上整套 AI 工具的成本結構重新盤一次,可以從 按需求挑 AI 工具的總整理 開始,那篇是這一整群文章的入口;想看 GPT-6 上一代的三個版本各自落到哪個方案,GPT-5.6 三個版本誰拿到哪一版、為什麼中階才是甜蜜點那篇的分層邏輯跟這篇是同一套。

11 月 21 日與 12 月 31 日之後這張三層表會再排一次,訂閱我的部落格會不定期收到信;想知道我為什麼老盯著價目表腳註,來歷在關於夜羽凌


參考資料

 

延伸閱讀