💡 核心結論速覽 (TL;DR)
- 官方公告裡有一句勸退:Google 自己寫「效率優先的話,可以用較低的 effort 檔位,或繼續用 Gemini 3.7 Flash,它仍完整支援」。廠商主動叫你可以不要換,這句話值得先讀懂。
- 三代 Flash 同一個價:3.8、3.7、3.6 在官方定價頁上逐格相同——每 100 萬 token 輸入 $0.75、輸出 $3.75,四種計費層一路對到底。所以「哪一版比較貴」這個問題問錯了,該問的是「它會跑幾趟」。
- 官方承認它會多吃 token:公告原文說 3.8 Flash「works harder」、會多做推理步驟並反覆呼叫工具,「有時可能用掉更多 token」。獨立評測 Artificial Analysis 量到的幅度是每題成本從 $0.40 到 $0.58。
- 今天先做一件事:如果你在跑 API,把 thinking level 從預設的 medium 降到 low 試跑一輪——那一檔的智慧分數仍與上一代 3.6 Flash 開到最高時相當,每題成本卻只有 high 檔的四成、耗時剩三分之一。
模型改版的公告我看多了,很少看到廠商在裡面勸你先別換。
Gemini 3.8 Flash 的公告裡有這麼一句:對運算效率是主要限制的應用,開發者可以「使用較低的 effort 檔位來降低 token 開銷」,或者「繼續使用 Gemini 3.7 Flash,它對效率優先的工作負載仍完整支援」。Google 自己把退路寫進發表文,這在一篇新模型公告裡是很少見的。
為什麼要寫這句?因為同一段公告的上一句已經先講了原因——這一版「更用力」,而更用力是有代價的。
我每天用 AI 超過 10 小時,ChatGPT 跟 Claude 的高階方案、Google AI Pro 同時養著,兩個部落格站的內容與自動化都自己扛。所以模型換代時我的第一個動作不是看跑分表,是去讀官方有沒有把代價寫出來。
做過產品的人都知道,這種句子不會白寫。這篇要做的就是把那句話翻譯成你看得懂的東西:它到底會多花多少、花在哪一格、以及你能怎麼把它調回來。
Gemini 3.8 Flash 是什麼?三件事先講完
Gemini 3.8 Flash 是 Google 在 2026 年 9 月 2 日發布的 Flash 系列新版本,model ID 是 gemini-3.8-flash,一上架就是正式版,沒有經過 preview 階段。官方把它定位成「最聰明的主力模型」,主打長時程軟體工程與自主代理。
三件事先講完,你就知道要不要往下看:
- ❶ 發布節奏快到不太正常:官方公告自己寫的——3.7 Flash 是三週前發的,這是「六週內第三次 Flash 發布」。如果你上個月才剛換過,你的疲勞是合理的。
- ❷ 規格幾乎沒動:輸入上限 1,048,576 個 token、輸出上限 65,536 個,和 3.7 Flash 一樣。輸入吃文字、圖片、影片、音訊與 PDF,輸出只有文字。
- ❸ 思考檔位剩三檔:low、medium(預設)、high。傳
minimal會直接回傳錯誤——這條規則從 3.7 Flash 就開始了,細節我在 上一版的遷移風險 那篇拆過,這裡不重複。
還有一格官方寫得很小聲但值得記:知識截止日是 2026 年 3 月,但官方同時但書「部分領域可能只到 2025 年 1 月」。問它今年的事情之前,最好先自己驗一題。
下一步:先確認你現在跑的是哪一版,再往下看第二段的價格對照。
Gemini 3.8 Flash 價格多少?三代同價,真正的漲價日在 2027 年
Gemini 3.8 Flash 的價格是每 100 萬 token 輸入 $0.75、輸出 $3.75,而這組數字和 3.7 Flash、3.6 Flash 完全一樣。我把 Gemini Developer API 官方定價頁 和 Google Cloud 的企業端定價頁 兩邊逐格對過,三代 Flash 在四種計費層上一路相同。
| 計費層 | 輸入(每 1M token) | 輸出(含思考 token) |
|---|---|---|
| Standard(一般) | $0.75 | $3.75 |
| Batch/Flex(非即時) | $0.375 | $1.875 |
| Priority(優先) | $1.35 | $6.75 |
(資料基準日:2026-09-03,單位為美元。快取讀取不是第五種計費層,是每一層各自都有的一格:Standard 是 $0.075、Batch 與 Flex 是 $0.0375、Priority 是 $0.135,另外都要加每 100 萬 token 每小時 $0.50 的儲存費。)
但這張表有個到期日。官方在公告註腳與定價頁都寫明:這是介紹價,2026 年 12 月 31 日到期,2027 年 1 月 1 日起變成 $1.50/$7.50——輸入輸出都直接翻倍。快取與儲存費同步加倍。
所以真正該進行事曆的不是「要不要換 3.8」,是年底那條線。你現在跑的每一塊錢,明年一月都會變成兩塊。
還有一格只有走企業端才會遇到:Google Cloud 那邊對「非全球區域」一律加價 10%。如果你為了資料落地把流量鎖在特定區域,實際單價是 $0.825/$4.125,不是 $0.75/$3.75——整篇文章的每一個成本數字,對你要再乘 1.1。
另外有一格特別容易漏:Google 搜尋 grounding 的計費列 每月 5,000 次免費,但那是整個 Gemini 3.x 家族共用的額度,不是每個模型各給 5,000。超出後每 1,000 次收 $14。要是你同時跑 Pro 和 Flash,這格會比想像中早見底。
🚨 一個中文讀者專屬的陷阱:官方定價頁的繁體中文版落後很多。我實際開過那一頁,頁尾更新日期停在 2026-08-11,整頁找不到 3.8 Flash,而且把 3.6 Flash 標成 $1.50/$7.50——那是 2027 年才生效的價。照著中文頁報價,你會把成本估成實際的兩倍。查價一律切到英文版。
下一步:把你上個月的 token 用量乘以 2,那就是明年一月的帳單起跳點。
Gemini 3.8 Flash 為什麼會多花錢?官方把原因寫成一句話
因為 Google 這次調的不是價格,是模型的做事習慣。官方公告裡有一段話,我認為是整篇文章最該被讀到的一段:
These performance gains stem from a core design choice: 3.8 Flash works harder. On complex tasks, it exhibits greater diligence — executing extra reasoning steps, and calling tools iteratively. At times, the model might use more tokens to maximize performance, especially at higher effort levels.
(這些效能提升來自一個核心設計選擇:3.8 Flash 更用力。面對複雜任務時,它會展現更高的盡責度——執行額外的推理步驟、反覆呼叫工具。有時候,模型可能會用掉更多 token 來把效能推到最高,在較高的 effort 檔位尤其明顯。)
這不是外界的推測,是官方自己把「會多花 token」寫成設計選擇。而且 官方模型卡 更直接——把「可能用更多 token」和「可能偶爾變慢或逾時」一起放進「已知限制」章節。
那多花多少?獨立評測機構 Artificial Analysis 用同一套指標跑了兩代,數字是這樣(2026-09-03 快照,high 檔):
| 項目 | Gemini 3.7 Flash | Gemini 3.8 Flash |
|---|---|---|
| 單價(輸入/輸出,每 1M) | $0.75/$3.75 | $0.75/$3.75 |
| 智慧指數 | 56 | 59 |
| 每題成本 | $0.40 | $0.58 |
| 每題輸出 token | 36,847 | 48,315 |
| 每題耗時 | 2.07 分 | 2.56 分 |
單價那一列一模一樣,每題成本卻從 $0.40 變成 $0.58,漲了 43.4%。(這裡的 $0.58 是「每題成本」,不是每百萬 token 的單價,兩個數字在該站上長得很像,別看混。)
我必須把來源分清楚,因為這關係到你要不要相信這個數字:「它會多用 token」這件事是官方三處自己講的;「多四成」這個幅度目前只有 Artificial Analysis 一家在量。機制可信度高,幅度請當成單一來源的快照看。
下一步:如果你有帳單後台,直接調出上週的平均每次請求 token 數當基準線,換版後再看一次。這比任何評測都準。
貴在哪一格?我把一題的錢拆成三份,最反直覺的是答案變短了
直覺會說「它想更久,所以思考的錢變多」。實際拆開來看,思考確實翻倍了,但它不是最大宗——最大宗是輸入。
同一份評測資料可以把每題的 $0.58 拆成三格:
| 成本組成 | 3.7 Flash | 3.8 Flash | 變化 |
|---|---|---|---|
| 輸入(重送脈絡) | $0.264 | $0.395 | +49.8% |
| 思考 token | $0.053 | $0.108 | +105% |
| 答案本體 | $0.085 | $0.073 | −14.4% |
三件事同時發生了:思考的錢翻了一倍,輸入的錢多了近五成,而你真正讀到的答案反而變便宜、也變短了 14.4%。
輸入為什麼會膨脹?跑完整套評測的輸入 token 從 14 億漲到 21.9 億,多了 56.8%。模型每多呼叫一次工具,就得把前面整段脈絡再送一次——這是代理式流程的結構性成本,官方那句「反覆呼叫工具」講的就是這件事。
要說明的是,評測方沒有公布平均呼叫次數。這是從輸入膨脹推回去最合理的解釋,不是實測到的回合數,我不想把推論寫成事實。
還有一個數字我看了三遍才相信。在 low 檔,3.8 Flash 的思考 token 比 3.7 Flash 少了 49.5%,每題成本卻還是貴 44.9%——因為輸入 token 多了 77.1%。想得更少、還是更貴,這幾乎是「回合數才是主因」的鐵證。
順帶一提,評測方對它的「囉嗦度」評語直接翻面:3.7 Flash 被評為「相當精簡」(同級排 43/196),3.8 Flash 變成「非常囉嗦」(掉到 74/196)。囉嗦的部分你還讀不到,因為那是思考不是答案。
如果你對「計價方式沒變、帳單卻變了」這類事有既視感,我之前 重算過 Claude 換斷詞器之後的帳單——那次變的是量尺本身,這次量尺沒動,是模型自己多跑了幾趟。兩種完全不同的成因,但踩起來一樣痛。
想把 Gemini 3.8 Flash 的帳單壓回去?官方自己寫了兩條路
很難得,Google 在同一段公告裡就把解方寫好了:調低 effort 檔位,或者乾脆不要換。原文是這樣寫的——對於運算效率是主要限制的應用,開發者可以「使用較低的 effort 檔位來降低 token 開銷」,或者「繼續使用 Gemini 3.7 Flash,它對效率優先的工作負載仍完整支援」。
官方叫你可以不要升級,這句話的份量比任何評測都重。
而且不是嘴上說說。我去翻了 官方的模型棄用清單,gemini-3.8-flash、gemini-3.7-flash、gemini-3.6-flash 三者的「退役日期」欄位現在都寫著「尚未公告」。同一張表上其他型號是有排定日期的,代表這頁有在維護、不是漏寫。你沒有被逼著換的時間壓力。
而三檔的實際差距長這樣:
| 思考檔位 | 智慧指數 | 每題成本 | 每題耗時 |
|---|---|---|---|
| high | 59 | $0.58 | 2.56 分 |
| medium(預設) | 57 | $0.41 | 1.74 分 |
| low | 52 | $0.24 | 0.77 分 |
最值得記住的是最後一列。3.8 Flash 開 low 檔拿到的 52 分,和上一代 3.6 Flash 開到 high 的分數相當——但每題只要 $0.24,是自己 high 檔的四成出頭,耗時也只剩三分之一。
換句話說:如果你原本就跑 3.6 Flash 而且覺得夠用,換到 3.8 Flash 再降一檔,是相當的智慧、更快的速度,而且你手上多了兩個可以往上加的檔位。這是我認為這次改版最實際的一個收穫,而且跟「要不要追新」無關。
⚠️ 一個我自己踩到的坑要先講:要拿 3.8 low 跟 3.6 high 比每題成本,別直接抄評測站給的那個差額。
我核對時發現,該站資料庫裡把 3.6 Flash 的快取讀取價記成 $0.15,但官方定價頁上 3.6 Flash 現在就是 $0.075、和 3.8 逐字相同。
快取那一格佔它每題成本的三分之一以上,用錯價會把差距算大。所以這裡我只說「相當」與「便宜」,不給那個百分比。(3.6 Flash 當時省下多少 我算過一次,那篇的基準線可以拿來對照。)
我自己在調這種旋鈕的時候有個習慣:先用 low 跑一週真實流量,把失敗的案例挑出來,只有那些才升檔。預設值是給所有人用的,你的工作負載通常沒那麼平均。
第三條路官方沒寫,但值得考慮——非即時的任務丟 Batch 或 Flex 層,直接對折($0.375/$1.875)。如果你的流程是排程跑批,這一刀比調檔位還乾脆。我在 免費 AI API 接自動化的兩道額度牆 那篇提過,自動化流程真正卡住的常常不是模型本身,而是你排程平台那邊的次數限制。
Gemini 3.8 Flash vs 3.1 Pro 怎麼選?答案取決於你用哪一把尺
Flash 的分數已經反超 Pro,單價也只有三分之一——但它每題花的錢比 Pro 多七成。三個數字都是真的,差別在你量的是什麼。這個對比每次改版都有人問,這一版的答案特別容易被帶偏。
看表之前有兩格要先講清楚。第一,Pro 到今天為止仍掛著 Preview——官方定價頁上的名字是「Gemini 3.1 Pro Preview」,model ID 是 gemini-3.1-pro-preview。要不要把生產流量放上去,這格得算進去。
第二,Pro 的單價有一道 20 萬 token 的門檻:prompt 超過 20 萬 token,輸入輸出直接跳到 $4.00/$18.00;Flash 這一側則不分級,多長都是 $0.75/$3.75。你的脈絡越長,這張表上的價差只會拉得更開。
| 項目 | Gemini 3.1 Pro Preview | Gemini 3.8 Flash |
|---|---|---|
| 智慧指數 | 48 | 59 |
| 輸入單價(每 1M) | $2.00 (>20 萬 token $4.00) | $0.75 |
| 輸出單價(每 1M) | $12.00 (>20 萬 token $18.00) | $3.75 |
| 輸出速度 | 103 token/秒 | 299 token/秒 |
| 每題成本 | $0.33 | $0.58 |
| 跑完整套評測實付總額 | $811.90 | $825.83 |
最後兩列是同一批資料的兩把尺,結論卻不一樣,這點必須講明白。用「每題成本」量,Flash 每題 $0.58、Pro 每題 $0.33,Flash 貴 72%;用「跑完整套評測實付總額」量,兩邊只差 1.7%。差別在加權方式——每題成本是九個評測的加權平均,實付總額是把所有題目的錢直接加起來。
我全篇其他地方一律用「每題成本」,所以這裡也以那把尺為準:Flash 每題比 Pro 貴七成,但它拿到的分數高 11 分。總額那一列放進來,只是要說明「為什麼有人會說兩邊差不多」。
更有意思的是錢流去了哪一格。直覺會說 Flash 吐更多字所以輸出比較貴——實際相反:Flash 的輸出 token 是 Pro 的 2.19 倍,但輸出單價只有 Pro 的 0.31 倍,兩者一乘之後它在輸出那一格反而比 Pro 省。真正把差距補回來的是輸入——Flash 跑完同一套評測吃掉的輸入 token 是 Pro 的八倍。
這正好呼應前面那一段:不管跟誰比,3.8 Flash 的成本重心都在輸入,不在它吐了多少字。(附註:Flash 的輸出 token 我引用的是原始欄位值 1.23 億,該站摘要卡片上顯示的是約 120M,兩者指同一件事。)
所以我會這樣選:要速度、要代理式工具鏈、能接受它多跑幾趟,選 Flash;要輸出可預測、單次請求成本要好抓、或流程裡人工要逐筆審的,Pro 反而比較好管。「便宜」在這裡不是一個模型屬性,是一個流程屬性。
如果你還在更前面的階段——連 Pro、Flash、Flash-Lite 該怎麼分工都還沒定,先看 Gemini 模型怎麼選的完整對比,那篇是這一整群文章的入口。想知道各方案的用量差別,Gemini 額度怎麼算 那篇拆過兩道牆的邏輯。
Gemini 3.8 Flash 評價別只看贏的那幾格,官方表上有幾格是勸退
官方公告附的比較表裡,Gemini 3.8 Flash 確實拿下不少第一,但也有幾格輸得很難看——而且是官方自己放上去的。我認為看懂輸的那幾格,比看贏的更有用。
贏的部分先講完:HLE-Verified(多學科專家推理)54.9% 全表第一、Vals Finance Agent v2(財務分析師任務)61.4% 第一、Harvey 法律流程 10.0% 第一、CharXiv 圖表推理 86.2% 第一,Terminal-bench 2.1 的 89.4% 也掛第一。
官方選的對照組是 Claude Opus 5、Claude Sonnet 5、GPT-5.6 Sol 與 GPT-5.6 Terra,單價從 Flash 的 2.7 倍到 6.7 倍不等,所以贏的那幾格確實有份量。
但有兩格的「第一」要打折看。Harvey 法律流程的第一名,絕對值只有 10.0% 的通過率——意思是最好的模型也有九成的複雜法律工作流過不了關,這一列與其說是誰贏,不如說是整個產業都還沒到。CharXiv 的 86.2% 則只贏第二名 GPT-5.6 Terra 的 85.9% 零點三個百分點,實質上是打平。
還有一格是官方沒放、但該一起看的:同一項 Terminal-bench 2.1,獨立評測方量出來的結果和官方表相反。他們量到 3.8 Flash 是 87.6%、Claude Opus 5 是 89.1%——在第三方的量測裡它不是第一。
同一個測驗兩個數字,代表 harness 與參數設定會大幅影響結果。別把任何一張跑分表當成定論,包括官方那張。
然後是勸退的那幾格:
- ❶ Terminal-bench 4.0(通用 agent 能力)只有 19.1%:同表的 Claude Opus 5 是 51.8%、GPT-5.6 Sol 是 37.3%。這一格差距大到不能忽略——它在「被框定的終端機任務」很強,在「開放式的通用代理任務」還差得遠。
- ❷ GDPVal-AA v2(知識工作)Elo 1545:Claude Opus 5 是 1824。要把整份知識工作交出去,這格還撐不住。
- ❸ DeepSWE v1.1 的 73.7% 有前提:官方評測方法論自己註明,那個分數是用 high thinking 跑出來的,不是預設的 medium。也就是說,你要複製那個成績,就得付前面算過的高檔價格。
還有一件更有意思的事。同一個「works harder」,官方在兩個地方寫得剛好相反。
公告寫的是「執行額外的推理步驟」(extra reasoning steps),開發者文件寫的卻是「採取更小的推理步驟」(takes smaller reasoning steps),而且開發者文件還多列了一項「沿途驗證自己的產出」。
兩種說法其實可以並存——步驟變小、但步數變多,總量還是往上。但這種官方自己口徑不一的情況,我一律當成「這個機制還在被描述中」的訊號,不會把任何一句當成規格保證。我做產品時也常這樣:文案先出去、定義後面才收斂。
正面消息也有一格:提示詞注入的防禦明顯進步。在 Gray Swan 的攻擊成功率指標上(越低越好),3.8 Flash 是 5.5%,前一代 3.7 Flash 是 9.2%。這格對要把模型接上外部資料的人很重要。
我不寫程式,Gemini 3.8 Flash 關我什麼事?先看你的方案
如果你只是用 Gemini App,別只靠模型選單下結論——官方自己就有兩種寫法。
說明中心那個叫「Gemini 模型下拉式選單」的段落,只列了 Gemini Flash-Lite、Gemini Flash、Gemini Pro 三個不帶版號的名字,同頁還註明「模型名稱、版本和適用情形可能會變更」。
但官方版本資訊頁 7 月 21 日那則卻明講「只要從模型下拉式選單選取『3.6 Flash』」,訂閱頁的免費欄到今天也還寫著「使用 3.6 Flash」。
選單到底帶不帶小數版號,官方沒有一致口徑。所以更穩的判斷起點,是先看你付的是哪一檔。
官方公告在消費端只點名了兩種人:Google AI Pro 與 Ultra 訂閱者,介面是 Gemini App、Google 搜尋的 AI Mode,以及 Google Sheets 裡的 Gemini。
這是一份列舉名單,免費方案與 Google AI Plus 不在上面。
我必須說清楚分寸:官方沒有寫過任何一句「免費版不能用」,它只是沒把免費版列進名單。這兩件事差很多,別把後者讀成前者。
台灣的方案價格與用量倍數目前是這樣(資料基準日:2026-09-03):
| 方案 | 月費 | 用量與脈絡窗口 |
|---|---|---|
| 免費 | NT$0 | 標準用量/32k token |
| Google AI Plus | NT$165 | 2 倍用量/128k token |
| Google AI Pro | NT$650 | 4 倍用量/100 萬 token |
| Google AI Ultra | NT$3,300 | Pro 的 5 倍用量/100 萬 token |
| Google AI Ultra(高階) | NT$6,500 | Pro 的 20 倍用量/100 萬 token |
有一格很有意思:台灣訂閱頁上,免費方案那一欄現在寫的還是「使用 3.6 Flash」,整頁找不到 3.8 Flash。消費端的官方版本資訊頁也停在 8 月 19 日,最近一次「新模型進下拉選單」的公告還是 7 月 21 日的 3.6 Flash。
這代表什麼?我只能說官方文件還沒同步,不能說消費端還沒上線——兩種解釋都跟我看到的頁面相容,官方沒有任何一頁能替我裁決。要確認就自己開一次 App 看選單,那比任何報導都準。方案怎麼挑我在 Gemini 四檔訂閱方案 那篇算過,結論到現在沒變:貴的通常不是 AI 本身。
還有一條路很多人不知道:就算你沒訂閱,開發者那邊的 Google AI Studio 是有免費層的——官方定價頁上 Standard 層的「免費方案」欄寫的是「免費」,代價是內容會被用於改善產品。想先摸一下新模型手感、又不想每月扣款的人,那才是入口。
下一步:打開你的 Gemini App 模型選單,把它現在寫的字記下來。官方所有消費端頁面目前最新只提到 3.6 Flash——如果你的選單真的出現「3.8」,那就是消費端已經上線的第一手證據,比任何報導都早。
Gemini 3.8 Flash Cyber 是什麼?為什麼你八成拿不到
Gemini 3.8 Flash Cyber 是同時發布的資安專用變體,只透過新的 Fairwind Program 開放給「受信任的防禦方」——官方點名的是政府機關、關鍵基礎設施營運者與軟體維護者。沒有自助註冊,一般開發者拿不到。
它的定位很明確:找漏洞和修漏洞,而且官方說有意把「修」的優先序放在「攻」前面。
幾個官方數字:CyberGym 的 C/C++ 漏洞挖掘 Pass@1 是 86.2%,而官方圖上拿來對照的前一款資安變體是 Gemini 3.5 Flash Cyber 的 77.5%——注意中間隔了 3.6 和 3.7 兩代,那兩代根本沒有 Cyber 版本。
資安變體不是每一代都會出,這件事本身就有資訊量。自動修補那邊,CWE-Bench 的 pass@1 是 47.2%——官方自己承認略低於某個領先前沿模型的 47.8%,主張的優勢是成本低很多。
Google 也放了幾個內部戰績。Chrome 安全團隊說,它在 Chrome 漏洞上產出的正確修補數,是那些體積大得多的頂尖商用模型的 2.6 倍。
資安廠商 Wiz 說,它在自家內部滲透測試基準上的召回率比其他領先前沿模型高 7.5%~9.7%(官方原文寫的是 %,沒有說是不是百分點),成本則低 2.3 到 5.2 倍。Google 的雲端漏洞研究團隊則說,用它在不到兩小時找到一個通常要數月才找得到的底層漏洞。
對一般人來說,這段的實際意義只有一句:資安變體正在變成大廠的選配,而它們一律是邀請制。在資安團隊又剛好符合資格的人值得去敲門,不是的話知道有這條線就夠了。
這個模式不是 Google 獨有,我寫過 另一家的 Cyber 版本贏 Claude 是真的嗎,那篇的結論是「它贏的那個模型你根本買不到」——邀請制的門檻長什麼樣,那邊看得更清楚。
Gemini 3.8 Flash 適合誰?三種情況值得動,三種先按兵不動
先講結論:這一版沒有「所有人都該換」的理由,而且官方自己也沒這樣主張。我把讀者分成兩邊。
這三種情況值得現在就動:
- 你原本跑 3.6 Flash 而且覺得堪用:換到 3.8 Flash 再把檔位降到 low,分數相當、速度快得多,而且往上還有兩個檔位可加。成本=改一行參數加一輪回歸測試。
- 你在做財務分析或法律流程:這兩格官方表上是第一名——財務分析 61.4% 領先第二名 2.4 個百分點、也贏 Claude Opus 5 的 58.6%;法律流程 10.0% 比 Opus 5 的 6.7% 高出近五成。值得實測一輪,但別忘了法律那格全表最高就是 10.0%。圖表推理則不建議為它換版,那格只贏 0.3 個百分點。
- 你把模型接上外部資料或網頁:提示詞注入的攻擊成功率從 9.2% 降到 5.5%,這個改善對安全邊界的價值高於分數。
這三種人我建議先不要動:
- 成本已經吃緊的自動化流程:官方明說效率優先就繼續用 3.7 Flash。與其換版再回頭省,不如先把非即時任務丟到 Batch 層對折。
- 做開放式通用代理的人:Terminal-bench 4.0 的 19.1% 說明它還沒準備好,換過去反而會多繞路、多燒 token。
- 上個月才剛換過 3.7 的人:六週三版,你的回歸測試預算不該被這個節奏綁架。等一版再一起處理,通常更划算。
不管你屬於哪一邊,有一件事我會建議所有人做:把年底那個日期記進行事曆。2026 年 12 月 31 日之後,這整篇文章的價格數字全部要乘以二——那才是真正會動到你預算的一天。
我用同樣的算法算過別家:DeepSeek V4-Pro 的每題成本 那次的結論是「它不再是最便宜的」;Claude Fable 5.1 只降快取讀取 那次是官方說省 25%、實際有人只省 0.6%。同一個教訓一直重複:單價是廣告,用量才是帳單。
FAQ 常見問題
Gemini 3.8 Flash 和 3.7 Flash,哪一個比較划算?
單價完全一樣,所以要看任務型態。跑複雜的多步驟代理任務,3.8 Flash 分數更高、每題成本也更高。任務本來就不難、或成本敏感的,3.7 Flash 目前仍完整支援,官方自己就把它列為效率優先的選擇。判斷依據是你上個月的平均每題 token 數,不是跑分表。
我可以把版本鎖在某一版,不要被自動換掉嗎?
官方模型頁的版本區塊目前只列一條穩定版,就是 gemini-3.8-flash 本身,沒有列出日期快照版。務實的做法是在程式裡寫死具體的 model ID 字串、不要用會自動指向最新版的別名,並在部署流程加一個模型版本的檢查點。這樣至少換版是你決定的,不是某天早上發現的。
免費帳號有沒有 Gemini 3.8 Flash?
官方公告只點名 Google AI Pro 與 Ultra 訂閱者,免費方案與 AI Plus 不在名單上,但官方也沒明文說免費版不能用。開發者 API 那邊另有免費層,代價是內容會被用於改善產品。要確認就自己開一次 App:官方消費端頁面目前最新只提到 3.6 Flash,選單真的出現「3.8」才算數。
2027 年價格翻倍之後,我該怎麼準備?
三件事按順序做:先把非即時任務移到 Batch 或 Flex 層(現在就對折);再把重複的長脈絡改用快取,讀取只要輸入價的十分之一;最後才是調降 thinking 檔位。前兩項不影響輸出品質,第三項才需要重新測。年底前把這三層都試過一輪,明年一月的漲幅就不會全額吃下去。
為什麼我的實測結果和這篇的數字不一樣?
因為每題成本高度依賴任務型態。這篇引用的每題成本來自一套包含九個評測的標準指數,其中三個代理型評測就佔掉超過九成的花費。如果你的用途是短問答或摘要,成本增幅會比 43% 小很多;如果你在跑長時程的工具鏈,可能比 43% 更大。用自己的流量算一次基準線,永遠比引用別人的平均值準。
寫在最後:這一次真正該盯的不是價目表
Gemini 3.8 Flash 最值得記住的一課,是「同樣的單價」和「同樣的成本」從來不是一回事。當模型開始自己決定要跑幾趟、想幾步、呼叫幾次工具,價目表就只剩下一半的解釋力。
我現在評估任何模型改版,都會多問一句:它變聰明的方式,是變得更有效率,還是變得更用力?前者是免費的,後者要你付錢——而且帳單來的時候,價目表上一個字都沒改。
這一版的官方態度其實很誠實:把代價寫在公告裡、把限制寫進模型卡、還告訴你可以不要升級。誠實的供應商值得肯定,但誠實不等於免費。看懂那一句「works harder」,你才知道自己買的是什麼。
如果你要順手重新盤點整套 AI 工具的成本結構,可以從 我每天在用的那套工具箱怎麼組 開始,先算清楚每個環節「換掉的成本是多少」,再決定要為哪一個模型付錢。近期同型的算法我也用在 快取到底要重複幾次才划算 和 便宜 21 倍但速率只剩三十分之一 這兩篇,判斷邏輯是同一套。
參考資料
- Introducing Gemini 3.8 Flash and 3.8 Flash Cyber(Google 官方發布公告,2026-09-02)
- Gemini 3.8 Flash 官方模型規格頁(Gemini API 文件)
- Gemini Developer API 官方定價頁(英文版,含 2027 年新價)
- Google Cloud 企業端 Gemini 定價頁(第二個官方定價來源)
- What's new in Gemini 3.8 Flash(官方開發者遷移指南與 thinking level 說明)
- Gemini 3.8 Flash 官方模型卡(含知識截止日與已知限制)
- Gemini 3.8 Flash 官方評測方法論
- Artificial Analysis:Gemini 3.8 Flash 獨立評測(每題成本與 token 用量)
- Google Gemini 訂閱方案(台灣定價頁)
- 關於夜羽凌