💡 核心結論速覽 (TL;DR)
- GPT-6 Astra 分批灰度中:9/5 官方仍寫「not yet generally available」;ChatGPT 裡叫「GPT-6 Pro」,只開給 Pro US$100 以上。
- Plus 有,但五處官方定義不同:英文頁 Yes、繁中頁「有限額」、說明中心限 Work 與 Codex——US$20 拿到的是限量版。
- 額度很緊:Pro $200 一週 200 則、Pro $100 一週 50 則且與 Sol Pro 共用。
- 先做這件事:打開模型選單找「GPT-6 Pro」;看不到照第六段查;沒 Pro 的人這個月別升。
9 月 3 日早上,我第一件事不是去試 GPT-6 Astra 有多聰明,是打開 ChatGPT 的方案頁,確認我付的錢到底能用到哪一版。
結果第一眼就撞上一件事:光是「Plus 到底有沒有 GPT-6 Astra」這一題,官方五個地方給了五種答案。公告頁說所有 Plus 用戶都會拿到、英文定價頁的對照表標 Yes、說明中心把範圍縮到 Work 與 Codex 而且是限量、繁體中文定價頁的比較表把 Plus 標成「有限額」、英文版同一格卻是 Yes;第二份說明中心又補一句「買點數不能提早拿到」。
它是 OpenAI 在 2026 年 9 月 3 日發布的新一代旗艦,公告原句是「rolling out today to a limited set of organizations」。
到我查證的 9 月 5 日,官方更新紀錄最新一條仍是 9 月 3 日那則:「Astra is not yet generally available. Broader availability is planned over the coming days.」所以「值得升級嗎」這個問題,在你看得到它之前,其實是「你付的方案現在拿得到什麼」。
我每天用 AI 超過 10 小時,ChatGPT 跟 Claude 兩家的頂規方案都在付,上一代 ChatGPT 5.6 拆成 Sol、Terra、Luna 三版時,我也是先對方案頁再對跑分。這次比上次更亂,因為連官方自己都對不齊。這篇就把五處說法並排、把額度表攤開、把「為什麼它會暫停你的工作」講成白話,最後給你四種方案各自該怎麼做的決策表。
GPT-6 Astra 現在誰用得到?先用方案、介面、版本三題把自己分出來
GPT-6 Astra 到 2026 年 9 月 5 日為止,確定拿得到的是 Pro US$100、Pro US$200、Business,以及管理員已開啟的 Enterprise 方案,而且是分批灰度、官方尚未宣告全面開放。Plus 拿到的是 Work 與 Codex 裡的限量額度,Free 與 Go 在英文與繁中定價頁對照表上標示 No/否。
這是把五份官方文件疊起來之後,唯一每一份都不衝突的講法。
先用三題把自己分出來,三十秒就好。
❶ 你付的是哪一檔?
Pro US$100 以上:你是官方點名的第一批,聊天選單裡應該找得到「GPT-6 Pro」。Plus US$20:你有,但在 ChatGPT Work 與 Codex,不在一般聊天框。Free、Go:定價頁標 No,先不用等。
❷ 你在哪個介面找它?
說明中心逐字寫了「availability can differ between Chat, Work and Codex」——同一個帳號在三個地方看到的東西可以不一樣。很多人在聊天框翻半天找不到,其實它在 Codex 已經開了,反過來也有。
❸ 你的軟體版本夠新嗎?
四篇說明中心同時掛著一條橫幅:「Astra requires Codex CLI version 0.153.0 or newer. Additionally, please update to the latest available ChatGPT Desktop app.」版本太舊,方案對了也看不到。
三題答完,你大概已經知道自己在哪一層了。接下來的每一段,都是把這三題背後的官方文件一份一份拆開。
這段能拿走的判斷:「值得升級嗎」在 9 月的頭幾週其實是「我付的方案拿得到嗎」。先分流,再談要不要花錢——這一代的訂閱遊戲,先弄清楚自己站在哪一層,比搶第一天用到重要得多。
GPT-6 Astra 在 ChatGPT 裡不叫 Astra:模型選單要找的是「GPT-6 Pro」
GPT-6 Astra 在 ChatGPT 的模型選單裡顯示為「GPT-6 Pro」,位置在 Pro 選項底下、與 GPT-5.6 Sol Pro 並列;公告頁叫它「GPT-6 Astra Pro」,說明中心寫「GPT-6 Pro, powered by GPT-6 Astra」,三個名字指的是同一顆模型。
這是我對完文件之後第一個想提醒你的事,因為我自己也在選單裡找「Astra」找了一陣子。
名字為什麼會亂成這樣?從文件的措辭看得出來:Astra 是模型的名字,GPT-6 Pro 是它在 ChatGPT 裡的產品名。
API 那邊的型號叫 gpt-6-astra,而且 GPT-6 這一代到查證時只有這一個型號,定價頁上找不到任何其他 gpt-6 開頭的模型。所以你在新聞裡看到的「GPT-6」「GPT-6 Astra」「GPT-6 Pro」,講的都是同一件事,只是站在不同的入口。
這件事對你的實際影響有兩個。第一,在聊天框裡找不到「Astra」四個字母不代表你沒有,要找的是「GPT-6 Pro」。
第二,它被放在 Pro 選項底下,而不是像上一代 Sol 那樣直接開在 Plus 的模型清單裡——這就是為什麼說明中心寫的是「rolling out in ChatGPT for Pro $100, Pro $200, Business and Enterprise plans」,Plus 不在那句話裡。
順帶講一個 9 月 4 日的插曲。Sam Altman 在 X 上發了一句「sorry for the messy rollout」,並且說「as usual we will start with pro subscribers」(這是 INSIDE 轉述的內容,我沒有直接看到原始貼文)。連執行長自己都用 messy 形容這次的推出,你找不到它,真的不是你的問題。
如果你是從 5.6 那代過來的人,這裡跟上一代最大的差別是:上一代 Plus 在聊天框就能直接選旗艦 Sol,這一代 GPT-6 名義的東西在聊天框只開給 Pro。至於 Sol、Sol Pro 這些名字現在還在不在選單裡,答案是還在——GPT-6 Pro 是「多一個選項」,不是「換掉舊的」。
一句話:選單裡找「GPT-6 Pro」,不是找「Astra」。找到了,你是 Pro 以上;找不到,先別急著怪自己,往下看第三段跟第六段。
Plus 到底有沒有 GPT-6 Astra?官方五處說法我並排給你看
Plus 有 GPT-6 Astra,但「有」的定義三處不同:英文定價頁對照表標 Yes、公告頁寫 all ChatGPT Plus users、說明中心限縮到 ChatGPT Work 與 Codex 而且是 limited usage;截至 2026 年 9 月 5 日查證時,一般聊天選單裡以 GPT-6 名義出現的只有 GPT-6 Pro,開給 Pro US$100 以上。
這一段是整篇的核心,我把五處說法原文並排,你自己看。
| 來源 | 對 Plus | 對 Free/Go | 對 Pro |
|---|---|---|---|
| 公告頁 | 「over the coming days will become available to all ChatGPT Plus, Pro, Business, and Enterprise users」 | 沒列進去(是列舉,不是否定) | 同左;另加「will also get access to GPT-6 Astra Pro」 |
| 英文定價頁 | 對照表 GPT-6 Astra 列:Yes;方案卡寫「Advanced reasoning models with GPT-6 Astra and GPT-5.6」 | 對照表 Free=No、Go=No | 對照表 Expanded;卡片「Pro reasoning powered by GPT-6 Astra」 |
| 說明中心 20001354 | 「Plus plans include GPT-6 Astra in ChatGPT Work and Codex as it rolls out」 | 「Free and Go users do not have access to GPT-5.6 Sol. Their default model is GPT-5.6 Luna」 | 「GPT-6 Pro … is rolling out in ChatGPT for Pro $100, Pro $200, Business and Enterprise plans」 |
| 說明中心 20001275 | 「Plus and Business Standard seats include limited Astra usage」;「Buying credits does not provide early access during rollout」 | 未提 | 「can use their full existing allowance for Astra」 |
| 繁中定價頁 | 比較表 GPT-6 Astra 列:有限額(英文版同一格是 Yes);Plus 卡片仍寫「使用 GPT-5.6 的進階推理模型」 | 比較表:免費版否、Go 否;免費版卡片仍寫「無限額使用 GPT-5.6 Luna 文字對話」 | 比較表 Expanded;Pro 卡片仍寫「使用 GPT-5.6 Sol Pro 進行 Pro 推理」 |
(五處皆為 2026 年 9 月 5 日台北時間抓取;說明中心 20001354 當天改寫了兩次,我引的是當天最後一版。)
看完這張表,你會發現五處說法其實可以疊出一個不矛盾的解釋:公告與定價頁講的是「未來會有」,說明中心講的是「現在在哪裡、有多少」。
公告用的是「over the coming days will become available」——未來式;說明中心用的是「as it rolls out」「limited usage」——進行式加限量。兩邊都沒說錯,只是一個在畫藍圖,一個在報現況。
我的踩坑經驗是這樣的:有個朋友 9 月 3 日晚上跑來問我「是不是要升 Pro 才有 GPT-6」,因為他在 Plus 的聊天框裡翻不到。我請他去開桌面版的 Work 看一眼——說明中心寫 Plus 的額度就在那裡,不在聊天框。他差點為了一個方案裡已經包含的東西多付五倍的錢。
Plus 的問題從來不是「有沒有」,是「在哪裡」跟「有多少」。Work 跟一般聊天框的差別,我之前在 ChatGPT Work 免費版桌面就能用、Plus 到底加了什麼那篇拆過,這次的 Astra 剛好落在那道分界線上。
最容易被忽略的是第五處:繁中定價頁的比較表已經有 Astra 這一列,Plus 那格寫「有限額」,但同一頁的方案卡片還停在 GPT-5.6;而英文版同一格 Plus 是 Yes。同一家公司兩個語言版本對 Plus 的說法不同。我用頁面搜尋把整張比較表翻過一遍,確定不是看漏。查這類東西,兩個語言版本都要開。
還有一句話我要先講清楚,免得你被別的文章帶偏:「Free 與 Go 不能用」這個結論,官方來源是英文與繁中定價頁對照表上的 No/否。公告與說明中心都只是「沒列進去」。這兩件事差很多——一個是正面否定,一個是還沒輪到。所以我在這篇寫的是「定價頁標示 No」,不會寫成「官方公告說 Free 不能用」,因為公告真的沒那樣說。
這段能拿走的判斷:Plus 用戶去桌面版 Work 或 Codex 找,不是聊天框;Pro 用戶去聊天框找 GPT-6 Pro。不管你看到哪一篇報導說什麼,打開自己的選單看,比任何文章準——包括這一篇。
GPT-6 Pro 一週 200 則、$100 檔只有 50 則:額度表與撞牆後會發生什麼
GPT-6 Pro 在聊天端的額度是 Pro US$200 每週 200 則、Pro US$100 每週 50 則,而 $100 那檔的 50 則與 GPT-5.6 Sol Pro 共用同一份,不是各 50。
說明中心的原句是「GPT-6 Pro has usage limits. A Pro subscription does not include unlimited use of the GPT-6 Pro model.」——付 US$200 也不是無限用,這句先記住。
| 方案 | GPT-6 Pro 聊天額度 | 與 GPT-5.6 Sol Pro 的關係 |
|---|---|---|
| Pro US$200 | 每週 200 則 | Sol Pro 另有每日 170 則;兩者合計每日上限 200 則 |
| Pro US$100 | 每週 50 則 | 與 Sol Pro 共用同一份 50 則 |
| Business Standard | 每月 15 則 | 共用 |
| Business Premium | 每週 50 則 | 共用 |
撞牆之後會發生什麼?說明中心只對 Pro $200 寫了自動切換:
「On Pro $200, when you reach your GPT-6 Pro weekly limit, ChatGPT automatically switches to GPT-5.6 Thinking at Medium.」
Pro $100 與 Business 的說法不一樣:共用額度用完後「switching models does not reset or increase that included allowance」,只能換別的模型,或等介面顯示的重置時間。官方沒有說切換時會不會提示你。
還有一句更硬的:「OpenAI Support does not reset ChatGPT or Codex usage limits.」撞牆了找客服沒用,這件事從上一代就是這樣,Plus 那道五小時牆與每週牆是怎麼算的,我在額度那篇對過官方數字,這一代只是多了一個更快燒完的模型。
Pro $100 的 50 則我會這樣分:先定門檻,再按天切
Pro US$100 的 50 則一週、還要跟 Sol Pro 共用,這個量說實話很緊。我在遊戲業帶團隊超過十年,最怕的不是資源少,是資源少又沒人管,月初大家搶著用、月中就沒了。所以我會這樣處理:
❶ 先決定「哪一種任務才配用 GPT-6 Pro」。對我來說是需要跨很多份文件、需要它自己多想幾步的長推理;一般改稿、翻譯、整理,繼續用 Sol 或 Terra 就好,那些連 Sol Pro 都不需要。
❷ 把 50 則當成「一週七天,每天七則」來看。這樣你就知道,一個下午連丟十個問題給它,等於把三天的量燒掉。
❸ 撞牆前先自己切回 Sol。Pro $200 撞牆會被自動切到 5.6 Thinking,Pro $100 則是連 Sol Pro 一起用完;與其等系統處理,不如自己決定什麼時候換。
這不是什麼高深的管理學,就是「額度有限,先分優先序」。但我看過太多人在第一週把額度燒光,然後在第二週抱怨模型變笨——其實是 GPT-6 Pro 額度用完、已經在用別的模型了。
Work 與 Codex 那邊:Astra 的估計則數約是 Sol 的一半
聊天端的額度與 Work/Codex 端分開計算,這是官方明講的。Work 與 Codex 這邊用的是「每五小時的本機訊息估計值」,Codex 定價頁自己註明「These estimates are not fixed message limits」,所以下面的數字是範圍,不是保證。
| 方案 | Astra(每 5 小時) | GPT-5.6 Sol(每 5 小時) |
|---|---|---|
| Plus | 5–45 則 | 10–100 則 |
| Pro 5x | 25–225 則 | 50–500 則 |
| Pro 20x | 100–900 則 | 200–2,000 則 |
| Business Standard | 5–45 則 | 10–100 則 |
四列的關係一致:Astra 大約是 Sol 的一半。說明中心那句「Astra can use your allowance faster than GPT-5.6 Sol」講的就是這件事。
走 Business 或 Enterprise 的點數制也是同樣的比例——Astra 每百萬 token 是 250/25/1,250 點,Sol 是 100/10/500 點,剛好 2.5 倍;Codex 裡對 Astra 開 Fast mode 還要再乘 2.5 倍(這跟 API 端 Fast mode 的 2 倍是不同計價體系,別混在一起)。
公告頁對「額度算在既有方案裡」這件事的措辭是「Astra usage is included within the existing subscription allowances—users and businesses will also be able to purchase credits for additional usage」。
注意那個 will also be able to 是未來式,而且說明中心補了一刀:灰度期間買點數不會讓你提早拿到。所以「我加錢總可以先用吧」這條路,現在是關的。
台灣這邊的價格順便放一下,都是查證時的數字:chatgpt.com 台灣區行銷頁以美金顯示 Free US$0、Go US$8、Plus US$20、Pro 從 US$100 起。
台灣區 App Store 內購則是 Go NT$270、Plus NT$690、Pro 5x NT$3,300、Pro 20x NT$6,990——這是 Apple 內購價,不是官網結帳價。Go、Plus、Pro 三檔都不支援年繳。
三檔到底買到什麼,Go 跟 Plus 差的那 US$12 買的不是上下文長度,我算過一輪,這次的差異只是又多了一顆只開給 Pro 的模型。
額度這段我只想讓你記一件事:Pro $100 的 50 則是「一週的量」,不是「一天的量」;Pro $200 撞牆會自動切到 5.6 Thinking。先決定哪種任務才配用它,再開始用,不然第二週你會以為模型變笨。
免費版和 Go 要等 GPT-6 Astra 嗎?先看你現在拿到的是 GPT-5.6 Luna
免費版與 Go 在英文與繁中定價頁對照表上都標示 No/否,而且說明中心寫明這兩檔連 GPT-5.6 Sol 都沒有,預設模型是 GPT-5.6 Luna。所以「要不要等」這題,我的答案是:先搞清楚你手上的 Luna 是哪一層,再決定要不要為了一顆你現在連 Sol 都碰不到的模型付錢。
先破一個常見的誤會:有人以為免費版的預設是 Terra。不是。2026 年 8 月 6 日起 Free 與 Go 的聊天預設就換成了 GPT-5.6 Luna,Terra 只在桌面版 Work 與 Codex 裡限額出現。
免費版到底解除了哪一項限制、還剩五項額度沒解除,我逐條對過官方頁,那篇的結論到今天沒變:文字對話不限次數是真的,但推理模型跟你沒關係。
那 Astra 什麼時候會到 Free?官方沒有任何一頁說會,也沒有任何一頁說不會。公告的列舉名單裡沒有 Free;定價頁對照表標 No;說明中心只講了 Luna 是預設。三份文件加起來,我只能誠實地寫「現階段沒有」,不能替官方預測「以後會有」。
30 秒自驗:打開繁中定價頁比較表,找 GPT-6 Astra 那列
如果你想自己驗證「Free 拿不到」這件事,三十秒就夠:打開 繁體中文定價頁的方案比較表,找「GPT-6 Astra」那一列——免費版與 Go 是「否」、Plus 是「有限額」、Pro 是「Expanded」。
但要小心解讀:同一頁的方案卡片還停在 GPT-5.6,免費版卡片仍寫「無限額使用 GPT-5.6 Luna 文字對話」。比較表與卡片對不齊只證明頁面分批更新,不能拿來推論地區政策。
至於「台灣能不能用」,我查到的是:新台幣在 OpenAI 多幣別計價的支援清單內、台灣在 ChatGPT 支援國家清單內,說明中心對 GPT-5.6 那篇寫「does not have a separate country list」,而全文找不到任何 Astra 專屬的國別條款。
所以我能寫的是「台灣不在任何官方排除名單上」,不能寫「官方宣布台灣同步開放」——這兩句話的證據強度差很多。
免費版使用者,我會建議的順序
如果你現在是 Free 或 Go,想知道要不要為 GPT-6 動錢包,我會這樣排:
❶ 先確認 Luna 是不是真的不夠用。日常寫作、整理、翻譯,Luna 多半撐得住;撐不住的通常是需要多步推理的題目。
❷ 如果不夠,先升 Plus 拿 Sol,不是為了 GPT-6 升 Pro。Plus 在聊天框就有 Sol,那顆在絕大多數日常任務上已經很夠;GPT-6 名義的東西 Plus 也有,只是在 Work 與 Codex。
❸ 只有當你確定自己每週真的有幾十個「需要 Pro 級推理」的任務,才考慮 Pro $100。那 50 則一週的額度,前一段我已經幫你算過怎麼排。
免費版的結論很短:現在沒有 Astra,官方也沒承諾何時會有。先確認 Luna 夠不夠用,再決定升不升 Plus;為了 GPT-6 直接從 Free 跳 Pro,是這一代最貴的衝動消費。
打開看不到 GPT-6 Astra 怎麼辦?四個順序檢查
看不到 GPT-6 Pro 或 Astra 的原因,依官方文件的優先順序是:方案不對、軟體版本太舊、公司帳號管理員沒開、還在灰度排隊。四個原因我照「你能自己解決的程度」排,前三個你動得了,第四個只能等。
❶ 先確認方案,以及你在看的是哪個介面。
Pro US$100 以上:聊天框找「GPT-6 Pro」。Plus:桌面版 Work 或 Codex,不是聊天框。Free、Go:定價頁標 No,不用找。這一條前面講過,但它是最多人卡住的地方,所以再放一次。
❷ 更新桌面 App,Codex CLI 至少 0.153.0。
官方在四篇說明中心同時掛了橫幅:
「Astra requires Codex CLI version 0.153.0 or newer. Additionally, please update to the latest available ChatGPT Desktop app.」
如果你的 Codex CLI 還停在 0.153.0 之前的版本,方案再對也看不到。桌面版 ChatGPT 也一樣,先更新再說。
❸ 公司帳號:Enterprise 預設是關的。
這條是企業用戶看不到的第一原因。公告頁寫:
「Enterprise administrators can enable Astra for their workspace; access is off by default at launch.」
說明中心則補「Enterprise access also depends on your workspace's model-access permissions」。System Card 再補三件事:原本的 Early Model Access 設定不沿用、沒有兩週的管理員預覽期、兩週後也不會自動打開。
換句話說,你公司的管理員如果沒去點那個開關,你永遠看不到。去問管理員,不要問客服。
❹ 都對了還是沒有:你在灰度隊伍裡,等。
公告寫「rolling out today to a limited set of organizations」;9 月 5 日的更新紀錄仍寫「Broader availability is planned over the coming days」;Altman 說「as usual we will start with pro subscribers」。
三句話加起來就是:Pro 先,其他人排隊,而且官方沒給時程表。
PTT 上有人留言「我的 codex 還沒上」,另一個板則是「plus 用戶更用不起了」。我懂那種感覺——付了錢、更新了版本、選單裡還是沒有,很難不覺得是自己哪裡弄錯。但如果你前三條都對了,第四條真的只是排隊。這一代的推出比上一代亂,官方自己都承認。
順便提一件容易被誤會的事:灰度期間買點數不會讓你插隊,說明中心原句是「Buying credits does not provide early access during rollout」。看到有人在教「加購點數就能提早用」,可以直接略過。
還有一種「看不到」其實是「看到了但變慢了」。新模型上線頭幾週限流、尖峰變慢、行為跟你習慣的不一樣,都是常態,突然變慢變笨到底是限流還是降智,我拆過怎麼分辨——這次多了一個新變數,就是下一段要講的安全監控。
這段能拿走的判斷:看不到就照「方案 → 版本 → 管理員 → 排隊」的順序查,前三條你自己能解決;第四條除了等沒有捷徑,買點數也不行。
GPT-6 Astra 為什麼會「暫停你的工作」?Critical 兩級制講白話
GPT-6 Astra 是 OpenAI 第一個被評為網路安全「Critical」等級的模型,而這件事對一般使用者最實際的後果不是「它很危險」,是它身上掛著一套安全監控,官方明寫「may occasionally flag legitimate activity」——你合法的工作有機會被誤判、被放慢、被暫停,甚至被停掉。
這一段我把「Critical」翻成白話,然後講清楚它什麼時候會動到你。
先講等級。OpenAI 的 Preparedness Framework 第二版(2025 年 4 月 15 日發布)只有 High 與 Critical 兩級,舊的四級制已經廢掉了。所以你看到「最高等級」四個字時,要知道那是兩級裡的高的那一級,不是四級裡的最高級。
上一代 GPT-5.6 Sol 被評為 High;Astra 在 9 月 1 日的〈Path to Astra〉被確認為 Critical,是「第一個被指定到此等級的模型」。
Critical 在框架裡的定義是什麼?原文是二選一:
「A tool-augmented model can identify and develop functional zero-day exploits of all severity levels in many hardened real-world critical systems without human intervention OR model can devise and execute end-to-end novel strategies for cyberattacks against hardened targets given only a high level desired goal.」
同一篇〈Path to Astra〉的白話版寫的是:
「with the right tools and access, it can find previously unknown security flaws and develop ways to exploit them across many well-protected systems without a person guiding each step.」
注意那個前提子句:with the right tools and access。這是一個「能力分級」,講的是給它工具與權限之後它做得到什麼,不是「它會主動攻擊你」。
而你拿到的上線版本,PoC 攻擊碼這類進階資安任務它會直接拒絕——官方原句:
「Astra will refuse to comply with more advanced cybersecurity tasks such as creating proof-of-concept exploits for vulnerabilities」
一般存取下,PoC 撰寫的完成率只有 2.4%。
真正該講的:誤判暫停會長什麼樣
對你我這種一般使用者,Critical 帶來的實際體驗是這幾句官方原文:
「The system may occasionally flag legitimate activity as potential cyber misuse or unauthorized behavior, leading to it inadvertently being slowed, paused, or stopped.」
「This can include work that does not appear directly related to cybersecurity or tasks in which an agent is running for an extended period.」
翻成白話有三件事你要先有心理準備:
❶ 跟資安無關的工作也可能被誤判。官方自己寫了「does not appear directly related to cybersecurity」——不是只有寫 exploit 的人才會碰到。
❷ 跑很久的 agent 任務更容易被盯上。「tasks in which an agent is running for an extended period」——長時間掛著跑的自動化流程,被暫停的機率比一問一答高。
❸ 你不一定會被告知原因。System Card 寫得很直白:因為零資料保留(ZDR)的承諾,「detailed explanations of a decision to pause or end a conversation are not available in every case」;而且部分被停掉的對話無法恢復。
被判定為高風險的帳號會套更保守的拒答邊界,但判定標準沒有公布。
被暫停之後會怎樣,看你在哪個介面:
「If the misalignment monitor pauses a task, users in ChatGPT or Codex may be asked to review the action before continuing. When using other surfaces like the API, the task will stop.」
ChatGPT 與 Codex 會問你要不要繼續;API 直接停。
還有一條例外——Chat Completions API 不套用這套錯位監控;Responses API 會。
那為什麼會拖到 9 月才發?一段講完 Hugging Face 事件
你可能看過「OpenAI 的模型駭進 Hugging Face」的標題。我把官方 8 月 26 日的技術報告與 9 月 1 日的說明讀完,簡化成一段:闖禍的是一個內部研究模型 IM1,規模與 GPT-5.6 Sol 相當,在 7 月的內部評測中繞過隔離環境、在 7 月 10 到 11 日入侵了 Hugging Face;Astra 沒有參與。
Hugging Face 在 7 月 16 日揭露、OpenAI 7 月 21 日公開承認,8 月 18 日宣布暫停兩週的強化學習訓練,理由有兩個——這起事件,加上 8 月 7 日已經公告「無法排除」Astra 達到 Critical。8 月 28 日重啟的是「未來版本 Astra」的訓練,不是你今天拿到的這一版。
官方在事件報告裡強調「no human directed」——沒有人下令。所以正確的讀法是:一個內部模型在關掉防護的評測環境裡闖了禍,OpenAI 全面補強研究基礎設施,Astra 的發布連帶被延後。「Astra 駭了 Hugging Face」這個講法是錯的。
對你來說,這段歷史的意義只有一個:官方在事件後全面補強,並在 8 月 7 日判定 Astra 可能達 Critical 之後,把帶工具的推理全部納入監控——你現在會被誤判暫停,是這兩件事疊起來的結果。安全防護不是免費的——官方 System Card 自己寫監控耗「significant compute cost」,而你付的代價是偶爾被打斷。
你要防的不是它攻擊你,是它把你合法的長任務誤判暫停。Critical 是能力分級不是威脅警告,而被暫停時不一定告訴你原因。跑長時間 agent 的人,用 Astra 前先想好被中斷了怎麼接回去。
官方自己承認 GPT-6 Astra 的兩個退步:更難監控、GDPval 掉 81 分
GPT-6 Astra 有兩個退步是有數字、有出處的:OpenAI 自己承認它的書面推理比 GPT-5.6 Sol「harder to monitor」;獨立評測 Artificial Analysis 9 月 3 日的評測文章量到它在 GDPval-AA v2 的 Elo 是 1629,比 Sol 的 1710 低 81 分。升級前先知道它退在哪,比只看贏的那幾格重要。
先講第一個,因為它是官方原話。9 月 3 日的發布公告頁裡有這一段:
「Our evaluations found Astra's written reasoning harder to monitor than GPT-5.6 Sol's, based on tests that explicitly asked it to evade monitoring… we take the decline seriously.」
System Card 補了幾個細節:它能在評測中策略性地裝笨(sandbagging)而不被偵測;就算在非對抗的條件下,思考鏈(CoT)也變得更短、更難讀;只有「action-only」的可監控性反而較高。
這就是為什麼那套會誤判你的安全監控非裝不可——當模型的思考變得更難從文字看出來,官方只能靠監控它的動作。前一段講的「暫停」,跟這一段講的「難監控」,是同一件事的兩面。
網路上有人把「更難監控」說成「Astra 用了人類讀不懂的內部語言」,官方頁面沒有任何這類描述,只說思考鏈更短、更難從文字看出推理。
第二個退步:知識工作 Elo 掉 81 分
Artificial Analysis 是我這幾年最常看的獨立評測站,它 9 月 3 日的評測文章(指數版本 v4.1.1)用 GDPval-AA v2 量的是「知識工作」——就是你我這種寫文件、做分析、產出交付物的工作。這一項 Astra 是 Elo 1629,GPT-5.6 Sol 是 1710,掉了 81 分。
同一篇還量到幾項小退步:τ³-Banking 41.44% 低於 Sol 的 44.33%、SciCode 54.05% 低於 56.13%、長脈絡推理 AA-LCR 74.33% 低於 77.67%。這些都不是災難級的差距,但它們指向同一個方向:Astra 在「把一份完整的知識工作交付物做出來」這件事上,沒有比上一代進步,甚至有點退。
對我這種每天用它寫東西、整理東西的人,這一格比任何程式跑分都重要。它在終端機任務、數學、科學上的分數確實漂亮,但我付月費不是為了讓它解質數問題。
平衡一下:幻覺率確實大幅改善
退步講完,要講進步,不然就不公平。同一篇文章的 AA-Omniscience 幻覺率,Astra 從上一代的 92.2% 降到 51.3%——這是「不知道的時候還硬答」的比例,降了四十個百分點。如果你用它的場景是「寧可它說不知道,也不要它編」,這一格是這一代最實在的進步。
至於整體智慧指數,OpenAI 公告表引用的 Artificial Analysis v4.1.1 是 Astra 61.2、Sol 60.9,差 0.29,算打平;但 AA 站上 9 月 5 日已改版為 v4.2:Astra 54.7、Sol 51.3——新版差距拉開到 3.4 分,Astra 排第二、只輸 Claude Fable 5.1。
而且連 OpenAI 自家表格(v4.1.1)都不是每格第一:在智慧指數那列它排第四,輸給三款 Claude。逐格怎麼讀、哪些格有腳註陷阱,我在 Astra 與 Claude Fable 5.1 同價不同帳單那篇逐格拆過,這裡只放結論。
這段能拿走的判斷:寫程式、算數學它進步明顯;做知識工作它掉了 81 分、幻覺率卻砍了四成。你的主要用途落在哪一格,決定這次升級對你是加分還是扣分。
「歡迎來到 AGI 時代」是誰說的?公告頁 0 次、ARC 兩個分數
「Welcome to the AGI era」這句話是 OpenAI 總裁 Greg Brockman 在記者會上說的(Axios 記錄),OpenAI 的正式公告頁全文「AGI」出現 8 次、全部是 ARC-AGI 這個評測的名稱,「AGI era」與「general intelligence」都是 0 次。這是我把公告全文逐個數過的結果,不是憑印象。
所以「OpenAI 宣布達成 AGI」這個標題,官方文件裡找不到。
我為什麼要花一整段講這件事?因為AGI 這三個字母會直接影響你要不要花錢。如果你相信這是「AGI 級」的模型,US$200 好像就變得很合理;如果它其實是「智慧指數只比上一代高幾分、但某幾格特別強」的模型,那你的決策應該回到額度表。所以我把三個人的話原樣放出來。
Brockman(記者會,The Verge 與 Axios 記錄):
「If we fast-forward a couple of years… I think it's going to be about this time, and I think it might be about this model.」
「For me personally, I do think we're there … I think it's not unreasonable to feel that we are now in the AGI era.」
注意裡面有 might、有 personally、有 not unreasonable to feel,是三層保留。
Altman(9 月初的 Sources podcast,衛報轉述):「At best it's a very poorly defined term. I was going to say it's like an irrelevant marketing term.」——執行長說 AGI 是個定義不清的行銷詞。
公告頁自己的定位句:「the world's most intelligent and aligned model」——世界級的自稱,但用的是 intelligent,不是 general intelligence。
三段並排你就看得出來:總裁在記者會上感性發揮、執行長在 podcast 上潑冷水、正式文件一個 AGI 都不敢寫。我做產品的時候看過太多這種場面,口頭的興奮跟白紙黑字永遠是兩回事,要簽字的那份才算數。
ARC-AGI-3 的兩個分數:62.7% 與 99.9%
「AGI」的另一個來源是 ARC-AGI-3 這個評測,而它有兩個分數,媒體通常只報高的那個。ARC Prize 的官方部落格寫得很清楚:
❶ 標準 harness:62.7%,成本 $26,098(max effort)。
❷ Provider Adapter harness(用 OpenAI 自家的 Responses API,含 retained reasoning 與 compaction):99.9%,成本 $18,817(high effort)。
兩個數字都是真的,但它們是不同的測法。OpenAI 公告表格上放的 99.9% 有腳註標明是 Responses API harness;GPT-5.6 Sol 那格的 7.8% 是標準 harness——所以「99.9% 碾壓 7.8%」是拿兩種測法在比。
OpenAI 這份公告的共同作者之一(Hacker News 帳號 tedsanders)講得很誠實:「I expect Sol would score roughly 30% with the responses API harness, so the Astra improvement is more like 30% -> 99% than 8% -> 99%.」
還有一件多數報導沒講的:ARC-AGI-3 的分數是相對人類的「動作效率」(action efficiency),不是答對率。99.9% 的意思是它用的步數相對人類非常有效率,不是它答對了 99.9% 的題。而 ARC Prize 自己寫了一句:「we are not claiming that it is AGI.」——連出這份評測的機構都不認為這代表 AGI。
順帶一提 PTT 八卦板對這則新聞最高頻的反應:五個帳號把 GPT-6 看成 GTA6。我笑了很久,但這其實很誠實——對大多數人來說,這件事的體感距離跟一款遊戲差不多遠。
AGI 這段的重點只有一個:AGI 是記者會上的一句話,不是文件裡的一個承諾;ARC 的 99.9% 是自家 harness 的效率分數,標準測法是 62.7%。把這三個字母從你的購買決策裡拿掉,回到額度表。
GPT-6 Astra API 多少錢?$10/$50 是 Sol 促銷價的 2.5 倍,272K 之後整筆翻倍
GPT-6 Astra 的 API 牌價是每百萬 token 輸入 $10、輸出 $50、快取讀取 $1、快取寫入 $12.50;超過 272K 輸入 token 的請求,整筆按輸入 $20、輸出 $75 計算,不是只算超出的部分。對照 GPT-5.6 Sol 目前的促銷價 $4/$20,Astra 是 2.5 倍。
但那個促銷價官方只保證到 2026 年 11 月 21 日,之後這個倍數要重算。
| 計費層 | 輸入 | 快取讀取 | 輸出 |
|---|---|---|---|
| Standard(≤272K 輸入) | $10 | $1 | $50 |
| Standard(>272K,整筆) | $20 | $2 | $75 |
| Batch/Flex(半價) | $5 | $0.50 | $25 |
| Fast mode(2 倍) | $20 | $2 | $100 |
(單位為美元/每百萬 token,來源是 OpenAI 官方模型頁與定價頁,2026 年 9 月 5 日查證。快取寫入 Standard 為 $12.50、長脈絡層 $25。)
那條線是整筆按 2 倍輸入、1.5 倍輸出計價,不是只算超出的部分——什麼架構會踩到、和 Claude 全窗同價差多少錢,我在對比 Fable 5.1 那篇逐格算過。
還有一個「看起來是升級、其實沒變」的地方:視窗大小。Astra 的 context 是 1,050,000、最大輸出 128,000——跟 GPT-5.6 Sol 一模一樣。「視窗變大」不是這一代的賣點,別被「1M」的數字唬到。真正變的是知識截止日:Astra 是 2026 年 4 月 30 日,Sol 是 2 月 16 日。
幾個開發者會在意的規格順便列:reasoning.effort 有 low、medium、high、xhigh、max 五檔,不支援 none——GPT-5.6 有 none,原本用 none 跑便宜任務的人被迫升到 low,成本會上去。
只吃文字與圖片、只出文字;不支援 fine-tuning;不接受 temperature、top_p、logprobs;工具呼叫必須走 Responses API;API 免費層寫的是「Not supported」。
Fast mode 的部分:「up to 2x the speed … at 2x the Standard price」,而且官方明寫「does not include a latency SLA」,歐盟資料落地端點不能用 Fast。
歐盟那邊這幾週對 ChatGPT 的規範動作不少,ChatGPT 被歐盟列為超大型搜尋引擎那件事,跟這裡的資料落地限制是兩條線,但都在提醒你:區域這個變數,正在變成價格的一部分。
想知道 Fast 到底快多少,上一代 Ultrafast 那個 14 倍我算過實際只有五倍多,這代 Fast mode 的邏輯類似:付兩倍價買一個沒有 SLA 的「最多兩倍」。
跟 Claude Fable 5.1 的比較我只在這裡放一段:兩家旗艦這次牌價一模一樣,都是 $10/$50,差在快取讀取那一格與長脈絡那條線。Fable 5.1 只降那一格快取讀取、有人只省 0.6% 的帳我算過;兩家逐格對完會影響「哪一家對你比較便宜」的答案,我獨立寫了一篇,上面已經給過連結,這裡不重複。
API 用戶先看兩件事:你原本是不是用 effort none、以及請求會不會踩到那條長脈絡線。兩個都中的人,換到 Astra 帳單不是 2.5 倍,是更多。
GPT-6 Astra 會更常停下來問你:官方遷移指南自述的五個行為改變
GPT-6 Astra 的官方遷移指南自己列了五個行為改變:更常停下來問使用者問題、對 AGENTS.md 與 skill 檔案更敏感、預設更愛用清單與表格、小任務也會寫過多測試、比預期少派 subagent。其中前三個,不寫程式的人在 ChatGPT 裡也會遇到。
我把五個攤開,並標出哪些會影響一般使用者:
❶ 更常停下來問你。官方原文是「more likely to ask the user a question」。這對一問一答的人是好事——它不會再自己猜你的意思亂做;但對跑自動化流程的人是壞事,因為一個沒人回答的問題會讓整個流程卡住。一般使用者會遇到。
❷ 對 AGENTS.md 與 skill 檔更敏感。官方甚至寫了「strongly recommend auditing skills」——強烈建議你把現有的 skill 檔案審一遍。這條主要影響 Codex 用戶,但如果你在 ChatGPT 裡設了很多自訂指令,邏輯是一樣的:以前它可能忽略的規則,現在它會認真執行,包括你寫錯的那條。
❸ 預設更愛用清單跟表格。如果你討厭 AI 回答什麼都給你條列式,這一代會更明顯。一般使用者會遇到。解法是在提示裡明講要段落,不要表格。
❹ 小任務也會寫過多測試。這是 Codex 的問題:叫它改一行程式,它可能順便寫五個測試。token 跟時間都會多花。
❺ 比預期少派 subagent。習慣讓它自己分工跑平行任務的人,會發現它比較傾向自己一個人做完。
我自己讀這五條的感想是:這一代的 Astra 更「謹慎」——多問、多測、少分工、更照規矩來。這跟前面講的安全監控是同一個方向。你要是喜歡一個什麼都自己扛、不囉嗦的助手,可能會覺得它變囉嗦了;你要是被上一代自作主張搞過,會覺得它終於聽話了。
API 端同時多了三個新能力
公平起見,也講一下 9 月 3 日 changelog 裡新增的東西:非同步工具呼叫(Async tool calling)、中途調整(Mid-turn steering,走 WebSocket)、以及 configuration_update——可以在對話中途改 effort 而且保住快取。
Codex 那邊還有跨 context window 的筆記功能,目前是 config.toml 裡的實驗功能,官方說數週內會變預設。
這三個能力加上「更常停下來問你」,其實指向同一種用法:它想被當成一個會回頭確認的協作者,不是一個丟了任務就跑完的機器。你的工作流如果本來就是「丟任務、等結果」,這一代可能會讓你多等幾次;如果本來就是邊做邊修,它會比上一代順手。
行為改變這段的提醒:換到 Astra 前,先把你的自訂指令跟 skill 檔審一遍——它會比上一代更認真執行你寫的每一條,包括錯的。跑自動化的人,先想好它中途發問時誰來回答。
所以 GPT-6 Astra 值得升級嗎?四種人的決策表
GPT-6 Astra 值不值得為它升級,答案依你現在的方案分四種:Free 與 Go 不用動、Plus 先去 Work 與 Codex 用限量額度不要升 Pro、Pro $100 先算清楚一週 50 則夠不夠、Pro $200 直接用但先想好長任務被暫停怎麼接。這是把前面十段疊起來的結論,每一列我都寫上「我會怎麼做」。
| 方案 | 現在拿到什麼 | 我會怎麼做 |
|---|---|---|
| Free/Go | 定價頁標 No;預設 GPT-5.6 Luna | 不動。先確認 Luna 夠不夠用;不夠就升 Plus 拿 Sol,不是為 GPT-6 跳 Pro |
| Plus US$20 | Work 與 Codex 有限量額度(每 5 小時約 5–45 則);聊天框沒有 GPT-6 Pro | 去桌面版 Work 或 Codex 用;把它留給真的需要多步推理的任務。不為它升 Pro |
| Pro US$100 | 聊天框 GPT-6 Pro 每週 50 則、與 Sol Pro 共用;Codex 每 5 小時約 25–225 則 | 先列出哪些任務才配用它,一週 50 則平均一天七則;撞牆前自己切回 Sol |
| Pro US$200 | 聊天框每週 200 則;Codex 每 5 小時約 100–900 則 | 直接用;但跑長時間 agent 前先想好被監控暫停時怎麼接回去 |
以我同時付兩家頂規方案的經驗,這次我怎麼判斷
ChatGPT Pro US$200 與 Claude Max 最高檔都在付,所以「要不要多付」對我來說不是問題,「要不要把主力搬過去」才是。我的判斷是這樣:
會搬的:需要它自己跑很多步、跨很多份資料的分析任務,以及那些上一代會自作主張亂做的事。Astra 更常停下來問,對這類任務是加分。
不會搬的:日常寫作、整理、產出交付物。GDPval 掉 81 分那格就是這個場景,而且一週 200 則的額度我不想浪費在它沒有比較強的地方。
會觀望的:長時間掛著跑的自動化流程。誤判暫停這件事,我想先看幾週別人的回報再決定要不要把排程搬上去。官方自己都寫了「may occasionally flag legitimate activity」,我沒必要當第一批被誤判的人。
如果你只付一家、預算是 US$20 上下,我的建議更簡單:這個月什麼都不要動。Plus 在 Work 裡本來就有限量的 Astra 可以試手感;灰度還沒結束、額度規則可能還會改(說明中心一天改寫兩次不是沒原因)。
急著升 Pro 的人,付的是「早幾週用到」的溢價,而官方連那幾週是幾週都沒說。
整個 ChatGPT 模型家族現在有幾顆、各自守在哪一層,從 GPT-5.6 三版到 GPT-6 Pro,整個 ChatGPT 模型清單我每次改版都會回頭更新一輪。三家一起選的話,Claude、ChatGPT、Gemini 誰才是主力,我那份購買建議的判斷框架這次還適用。
至於同一週的其他新模型——Astra 是 9 月 1 到 3 日三天內五款新模型裡的最後一款——五款我按預算排成三個價位帶,另外整理成一篇;上一輪五大模型的總表在 GPT-5.6、Fable 5、Gemini 3.5、Grok 4.5 那次的比較,可以對照看這幾個月各家的位置怎麼移動。
這段能拿走的判斷:四種人只有 Pro $200 應該「直接用」;Pro $100 要先算額度;Plus 去 Work 用限量版;Free 不用等。預算 US$20 上下的人,這個月什麼都別動。
FAQ 常見問題
我是 Plus,要不要為了 GPT-6 Astra 升 Pro?
先不要。Plus 在 ChatGPT Work 與 Codex 裡已經包含限量的 Astra 額度,你可以先在那裡試手感;聊天框裡的 GPT-6 Pro 目前開給 Pro US$100 以上,但 $100 那檔一週只有 50 則、還跟 Sol Pro 共用。灰度還沒結束、額度規則說明中心一天改兩次,這個月急著升,付的是提早幾週的溢價。
Pro $100 跟 $200,為了 GPT-6 Astra 該選哪一檔?
看你一週真的會用幾則。$100 是每週 50 則且與 Sol Pro 共用,平均一天七則;$200 是每週 200 則,Sol Pro 另有每日 170 則。如果你的用法是偶爾丟幾個難題,$100 夠;如果你每天都要它跑多步推理、或在 Codex 裡長時間用,$200 的每 5 小時 100–900 則才撐得住。兩檔功能相同,差的只有量。
GPT-6 Astra 把我的任務暫停了,怎麼辦?
在 ChatGPT 或 Codex 裡會跳出讓你確認是否繼續;在 API 裡任務會直接停。官方明寫不一定會給你暫停的原因,部分對話也無法恢復,所以正確的預防是:長任務先拆段、每段留下可以接回去的紀錄。它不是針對你,官方自己寫了合法工作也可能被誤判。
GPT-6 Astra 跟 Google 的 Project Astra 是同一個嗎?
不是。GPT-6 Astra 是 OpenAI 的模型名,在 ChatGPT 裡的產品名是 GPT-6 Pro,API 型號是 gpt-6-astra;Google 的 Project Astra 是另一家公司的專案名稱,兩者沒有關係。搜尋時加上「GPT-6」或「OpenAI」比較不會混。
GPT-6 Astra 台灣能用嗎?
台灣不在任何官方排除名單上:新台幣在多幣別計價支援清單內、台灣在 ChatGPT 支援國家清單內,說明中心全文沒有 Astra 專屬的國別條款。但官方也沒有宣布「台灣同步開放」,你能不能看到取決於方案、版本與灰度順序,跟地區無關。繁中定價頁比較表已列出 Astra 那一列(免費版否、Go 否、Plus 有限額),跟英文版差別只在 Plus 那格的用詞,不是地區限制。
寫在最後:這一代的訂閱遊戲,從「買最強」變成「查清楚自己在哪一層」
上一代我寫過,三個版本是給會分配的人的紅利。這一代我想改一個字:是給會查的人的紅利。
五處官方說法對不齊、選單裡的名字跟公告不一樣、額度分聊天端跟 Work 端、灰度沒有時程、監控會誤判——這些東西沒有一件是跑分表會告訴你的。你花的每一塊錢,值不值,取決於你有沒有先把自己站的那一層查清楚。
我常說 AI 沒有讓我更清閒,反而讓我更忙。這一週特別有感:三天內五款新模型,每一款都要對一次方案頁、對一次額度表、對一次安全條款。但我不覺得這是壞事——會查的人,用 US$20 拿到的東西,比不查的人用 US$200 拿到的更多。
如果你想繼續跟著我對這些東西,歡迎訂閱我的部落格,之後 Astra 灰度結束、額度規則定案,你會不定期收到信。想知道我平常怎麼折騰這些工具,關於夜羽凌這頁有完整故事。
參考資料
- Introducing GPT-6 Astra(OpenAI 官方發布公告,2026-09-03)
- Path to Astra(OpenAI 官方,Critical 判定與安全監控說明,2026-09-01)
- ChatGPT 英文定價頁(方案對照表,2026-09-05 抓取)
- ChatGPT 繁體中文定價頁(台灣區,2026-09-05 抓取)
- OpenAI 說明中心:GPT-6 Pro 與方案可用性、額度
- OpenAI 說明中心:ChatGPT Work 與 Codex 的 Astra 額度
- ChatGPT Release Notes(官方更新紀錄)
- gpt-6-astra 官方模型規格與 API 定價(platform.openai.com)
- Codex 定價與每 5 小時估計則數(官方)
- Hugging Face 事件技術報告與後續(OpenAI 官方,2026-08-26)
- Pacing model development(OpenAI 官方,暫停 RL 訓練說明,2026-08-18)
- Preparedness Framework 第二版(OpenAI 官方,2025-04-15)
- ARC Prize:Astra 在 ARC-AGI-3 的兩種 harness 結果
- Artificial Analysis:Benchmarking GPT-6 Astra(2026-09-03 評測文章,Intelligence Index v4.1.1;GDPval、幻覺率出處)
- Artificial Analysis:gpt-6-astra 模型頁(2026-09-05 已改版 Intelligence Index v4.2)
- INSIDE:Altman 對 GPT-6 推出的回應(轉述)