GPT-6 Sol、Luna vs Opus 5.5 怎麼選?我兩家都付

目錄

💡 核心結論速覽 (TL;DR)

  • 寫程式:難題交給 Claude Opus 5.5,終端機任務 53% 對 48%;規格清楚、量大的交給 GPT-6.1 Sol,每題成本不到 Opus 的六分之一。
  • 長文:讀長資料兩邊打平(84% 對 83%),寫成報告 Opus 5.5 較強;GPT-6 Sol 只在 ChatGPT 的 Work、Codex,聊天框沒有。
  • 雜事:GPT-6 Luna 每題約 0.02 美元,適合整理格式、分類,但終端機任務只有 3%,別拿它寫程式。
  • 只訂一家:寫程式為主選 Claude Pro,文件和雜事為主選 ChatGPT Plus,月繳都是 20 美元,先挑你最常做的那件事。

兩家撞期出新模型,麻煩的是分工得重排。我的結論:寫程式的難題交給 Claude Opus 5.5,規格清楚、量又大的交給 GPT-6 Sol,重複性的雜事才丟給 Luna。

這個分法有前提:你兩家都付得起。只訂一家、每月預算 20 美元的人,要反過來看自己最常做哪一種工作,我在後面會另外講。

我自己是兩家都付高階方案的那種人:ChatGPT Pro 200 加 Claude Max 20x,每個月各 200 美元。

9 月 22 日兩家同一天發表新模型,TechCrunch 和 SiliconANGLE 都當天就報了;9 月 29 日 OpenAI 又把 Sol 升級成 6.1 版。

這篇把我 10 月 4 日查到的兩家方案表、Artificial Analysis 的第三方評測,跟我自己的分工習慣放在一起。你最常拿 AI 做的是哪一件事?先想好再往下看,每一段都會給一個能直接照做的結論。


GPT-6 Sol、Luna vs Opus 5.5 先看結論:三種工作各交給誰

GPT-6 Sol、Luna 和 Claude Opus 5.5 不是同一級的比較:Opus 5.5 是 Anthropic 建議多數工作先用的主力模型,Sol 是 OpenAI 的日常主力,Luna 則是便宜的雜事層。

拿 Luna 跟 Opus 5.5 比分數沒有意義,該比的是「同一件工作交給誰比較划算」。

版本要先講清楚。GPT-6 Sol 在 9 月 29 日的 DevDay 升級成 GPT-6.1 Sol,API 單價不變,ChatGPT Work 和 Codex 現在建議寫程式用的也是 6.1 版,所以下面的分數都拿 6.1 Sol 來比。

6.1 跟 6 到底差在哪,6.1 Sol 同價卻只便宜了快取,我把帳拆開算過。

模型我會交給它的工作在哪用得到10/4 查到的依據
Claude Opus 5.5寫程式的難題、要交出去的報告Claude Code、Claude App(Pro 以上)終端機任務 53% 對 48%;專業工作評分 1,586 對 1,433
GPT-6.1 Sol規格清楚的程式、讀長資料Codex、ChatGPT Work(Plus 以上)每題 0.21 美元,Opus 5.5 要 1.34 美元;長文推理 83% 對 84%
GPT-6 Luna整理格式、分類、改寫Codex、Work(免費版限電腦版,分批開放)每題約 0.02 美元;終端機任務 3%

表裡的數字都是 Artificial Analysis 用「中等推理」跑的,也就是兩家 API 的預設檔位。

我刻意不拿最高檔來比,因為大部分人根本不會去調;開到最高檔,Opus 5.5 是 58 分、6.1 Sol 是 52 分,差距更大。

我把每題成本相除,預設檔位下 Opus 5.5 是 6.1 Sol 的 6.4 倍,開到最高檔變成 8.3 倍。分數差幾分、價錢差好幾倍,這就是分工的理由。

Luna 在 Claude 那邊對應的是 Sonnet、Haiku 這一層,不是 Opus 5.5。兩家最貴的那一層怎麼選,同樣 10/50 美元的 Astra 和 Fable 5.1,快取差了 4 倍,這裡就不重複。

一句話:難的、要交出去的給 Opus 5.5,量大的給 Sol,雜事給 Luna。下面每一段,我把每一格為什麼這樣排講清楚。


聊天框找不到 GPT-6 Sol?每個價位各拿得到哪個模型

GPT-6 Sol(含 6.1 版)和 Luna 在 ChatGPT 裡只開在 Work 和 Codex,聊天框裡還是 GPT-5.6;Claude Opus 5.5 則是 Pro 以上在一般對話就能選,免費版只有 Sonnet 和 Haiku。

如果你在聊天框找不到 Sol,就是卡在這一格。

價位ChatGPTClaude
免費Free:沒有 Sol;電腦版 App 的 Work、Codex 可用 Luna(分批開放)Free:Sonnet、Haiku,沒有 Opus 5.5
每月 8 美元Go:跟免費版一樣,Luna 限電腦版沒有對應方案
每月 20 美元Plus:Work、Codex 有 6.1 Sol、6 Sol、Luna,聊天框沒有Pro(年繳每月 17 美元):Opus 5.5 加 Claude Code
每月 100 美元起Pro 100/200/500:Codex 目前沒有 5 小時上限Max 5x/20x:Pro 的 5 倍或 20 倍額度

我 10 月 4 日查證的結果

✅ 已確認:6.1 Sol、6 Sol、Luna 都不在聊天框;Free 和 Go 的 Luna 標著分批開放;Claude 免費版方案表的 Opus 那格是 No。

⏳ 待確認:聊天框哪天開放 Sol,OpenAI 沒給日期;Claude Pro、Max 每 5 小時能用幾則,Anthropic 只公布倍數。

我比對兩家方案表時最想提醒的是 GPT-5.5 的退場日:10 月 14 日起,它會從 ChatGPT、Work、Codex 下架,存過的模型設定要記得換。

Sol 和 Luna 本身差在哪、Plus 用 Sol 能跑幾則,我拿 Plus 的 5 小時額度算過一輪,這裡只講跨兩家的部分。

走 API 的人只要記一句:6.1 Sol 每百萬 token 2/10 美元,Opus 5.5 是 4/20 美元,剛好一半;超過 272K 的長請求兩邊會拉近,那筆帳在Opus 5.5 只降價 20% 的評價文裡。


寫程式用 GPT-6 Sol 還是 Opus 5.5?我的分工看要不要碰圖

寫程式的難題我會開 Claude Opus 5.5:兩邊都用預設的中等推理,終端機任務(Terminal-Bench 4.0)Opus 5.5 是 53%、6.1 Sol 是 48%。

這是 Artificial Analysis 10 月 4 日的數字。可是 6.1 Sol 每題只花 0.21 美元,Opus 5.5 要 1.34 美元。

我拿這兩個數字算了一下:同樣跑 100 題,Opus 5.5 是 134 美元、6.1 Sol 是 21 美元,差 113 美元,用 10 月 2 日台銀即期賣出 31.895 換算約 NT$3,604。

那 5 個百分點值不值這筆錢,要看你的題目有多難。

我自己的分工一直是看任務要不要碰圖:要做圖、看截圖的,先丟 Codex 打粗胚,再交給 Claude Code 細修;不用碰圖的,直接開 Claude Code。

這樣排是為了省 Claude 的額度,貴的那支只花在最後一哩。

這一代換上來,兩頭的預設剛好對上:Codex 建議複雜程式用 6.1 Sol,Claude Code 在 Pro、Max 的預設就是 Opus 5.5。所以這套分工我不用改,只是兩頭的模型都換了一代。

我在 9 月底各做過一次修 bug 測試:題目都是我自己出、推理都開「中」、每個模型各跑 1 次。兩題不同,不能直接比誰強。

Opus 5.5 那題跟 Sonnet 5.5 一起跑,3 個 bug 全抓到;6.1 Sol 那題跟 OpenAI 另外 2 個模型一起跑,也是 3 個全對。

兩次測試的共同點反而更有意思:修好的程式都一字不差,差別全在說明。Opus 5.5 會把驗算一條條寫出來,還多檢查一個看起來像打錯的價格;6.1 Sol 則會寫出「從多少改成多少」,改前改後一眼對得上。

上一代 6 Sol 在同一題只寫改後的值,我得自己回頭找原本寫多少,核對時多花了一道工。這種小摩擦,正是新版值得換的地方。

所以我的判斷是:規格寫清楚、有驗收條件的小 bug,交給 6.1 Sol 就夠;要它自己找問題、在終端機裡跑很多步的長任務,那 5 個百分點我願意付。

Opus 5.5 那次的完整題目和截圖在同一段帳單程式,Sonnet 和 Opus 差在多檢查一步。

訂閱制的人不看每題幾美元,看的是額度。在 Artificial Analysis 的測驗裡,Opus 5.5 平均每題輸出 2.6 萬 token、6.1 Sol 約 8 千,我算下來是 3.25 倍,它想得多、寫得也多。

兩家一起用、想讓 Claude Code 直接叫 Codex 的人,先看Claude Code 接 Codex 會不會付兩份錢,有個開關先別開。

想對照上一代 GPT-5.5 和 Opus 4.7 當時怎麼搭,那篇的 5 種情境搭配還能當參考,只是模型名稱要換成這一代。


長文用 GPT-6 Sol 還是 Claude Opus 5.5?讀資料打平,寫成品差一截

讀長資料這件事,GPT-6.1 Sol 和 Claude Opus 5.5 幾乎打平:Artificial Analysis 的長文推理測驗(AA-LCR)是 83% 對 84%,只差 1 個百分點。

差距出在「寫成品」:專業工作產出評分 GDPval-AA,Opus 5.5 拿 1,586 分,6.1 Sol 是 1,433 分。

讀複雜 PDF 再回答問題的 GDP.pdf,反而是 6.1 Sol 高,30% 對 26%。這幾格放在一起看,我的解讀是:丟一堆資料進去問重點,兩邊差不多;要它交出一份能直接給人看的報告,Opus 5.5 比較穩。

在哪裡用也要先想好。長文要在 ChatGPT 用 Sol,得切到 Work 模式,聊天框裡的還是 GPT-5.6;Claude 這邊 Pro 以上,一般對話就能選 Opus 5.5。

兩邊 API 的上下文都在 100 萬 token 上下,6.1 Sol 最多吃 92.2 萬輸入,Opus 5.5 是 100 萬。

我比較在意的是等。預設檔位下,Artificial Analysis 量到 6.1 Sol 從送出到答完平均 16.7 秒,Opus 5.5 要 33.5 秒,我算了一下剛好 2 倍;Opus 5.5 光是開始吐字前就想了 26.6 秒。

它打字其實比較快,每秒 72 對 45 個 token,慢在先想很久。

所以我會這樣分:先丟給 Sol 讀完、整理重點,便宜又快;要交出去的成品再交給 Opus 5.5 寫。

Opus 5.5 的預設推理是 medium,長報告不夠深可以往上調,effort 五檔差在哪、調高會多燒多少額度我另外寫過。


雜事交給 GPT-6 Luna 划算嗎?每題 0.02 美元,但別拿它查事實

GPT-6 Luna 適合整理格式、分類、改寫這種重複性的雜事:Artificial Analysis 算它每題約 0.02 美元,Claude Sonnet 5.5 是 0.59 美元,我算下來差了約 30 倍。

OpenAI 自己的模型說明也寫,Luna 用在聚焦、可重複的任務。

便宜是有代價的。同樣用中等推理,Luna 的終端機任務只拿 3%,Sonnet 5.5 是 30%;知識可靠度(AA-Omniscience)Luna 是 −5、Sonnet 5.5 是 20。

這個指標 0 分代表答對和答錯一樣多,負分就是錯的比對的多。

但讀長文 Luna 不差:長文推理 78% 對 76%,還贏 Sonnet 5.5 一點。所以要用 Luna 的話,我會挑丟一份長會議記錄叫它整理成條列、把一堆檔名改成同一個格式,這種有標準答案、錯了一眼看得出來的事。

額度也差很多。拿 Codex 給 Plus 的額度表算,Luna 每 5 小時 350–3,000 則,6.1 Sol 是 15–160 則,我算下來多了 19 到 23 倍。

先用便宜的那支把粗胚做完,貴的只留給要判斷的部分,這是我寫程式時就有的習慣,這次只是多了一層可以分。

免費版的人要注意:Free 和 Go 的 Luna 只在 ChatGPT 電腦版 App 的 Work、Codex 裡,而且還在分批開放;Claude 免費版在網頁、手機都能用 Sonnet 5.5。

以分數看 Sonnet 5.5 的 41 分比 Luna 的 30 分高,免費想先用比較聰明的那個,我會先開 Claude。

Claude 那邊最便宜的 Haiku 還停在 4.5 版,API 每百萬 token 1/5 美元,是 Luna 的 10 倍價。只想找免費能用的工具,我每天在用、免費額度就夠的 8 款 AI 工具可以先翻。


只訂一家選 ChatGPT(GPT-6 Sol)還是 Claude(Opus 5.5)?20 美元這樣選

只訂一家、每月 20 美元的話:主要在寫程式選 Claude Pro,Opus 5.5 和 Claude Code 都含在裡面。

主要處理文件、資料、雜事選 ChatGPT Plus,Work 和 Codex 裡同時有 6.1 Sol 和 Luna 可以分層用。

兩邊月繳都是 20 美元,我用 10 月 2 日台銀即期賣出 31.895 換算約 NT$638,還沒算刷卡的海外手續費。Claude Pro 年繳是一次付 200 美元、平均每月 17 美元,我算下來一年約 NT$6,379。

選 ChatGPT Plus 的人:每天要讀很多文件、整理資料,偶爾寫點小程式;想用 Luna 把大量雜事吃下來。

選 Claude Pro 的人:每天寫程式,要 Claude Code 在終端機裡幫你跑長任務;或交出去的報告品質比速度重要。

兩個都先別買的人:一天只問幾題、不寫程式。免費版先用,碰到天花板再決定。

我兩家都付高階方案,說穿了是受不了工作做到一半被額度喊停;被打斷再接回來的時間,比兩個方案的價差還貴。可是如果你一個月只用十幾次,這種焦慮根本不會出現,20 美元的方案就夠了。

兩家各自的方案細節,ChatGPT 這邊看Go 升 Plus 多付的 12 美元買到什麼,Claude 這邊看多付 80 美元升 Max,上下文其實沒變大。

👉 查看 ChatGPT 各方案內容

👉 查看 Claude 各方案內容


GPT-6 Sol 加 Opus 5.5 兩家都付值得嗎?我每月 400 美元,10/30 後要重算

兩家都付值不值得,看你是不是每天都碰到額度上限:我付 ChatGPT Pro 200 加 Claude Max 20x,每月 400 美元,用 31.895 換算約 NT$12,758。

一般人用不到這個量,Plus 加 Claude Pro 每月 40 美元、約 NT$1,276,就能照這篇的分工把兩邊強項都用到。

我把兩份方案拆成「每 1 倍額度多少錢」算了一次。Claude Max 20x 是 Pro 的 20 倍額度,200 除以 20,每 1 倍 10 美元,比單買 Pro 便宜一半。

ChatGPT 這邊不一樣。OpenAI 寄給 Pro 200 舊訂戶的通知信寫,10 月 30 日起 Work 和 Codex 的額度從 Plus 的 20 倍降到 10 倍,月費不變,每 1 倍變成 20 美元,跟直接買 Plus 同價。

Pro 200 現在也重新開放新訂閱,但新訂戶拿到的就是比較低的那份額度。

遇到這種額度變少、月費不變的調整,我第一個想的不是「還要不要留」,而是另一份已經在付的能不能把它吃下來。10 月 30 日之後這筆帳我會重算一次,你如果也是 Pro 200 舊戶,可以先把這個日期記下來。

Max 20x 到底夠不夠用,週額度一天就燒光的那種用法我拆過;想把 Gemini 也排進來的人,可以看三家 AI 的 5 種實戰分工對照。


換模型前先改這 4 個地方:Codex、Claude Code、ChatGPT、Claude App

分工排好之後,真正會卡住你的是設定:Codex、Claude Code、ChatGPT 電腦版、Claude App 各有自己的模型選單,舊設定不會自己換。照下面 4 步走一遍就好。

❶ Codex:CLI 裡打 /model 切換,或用 codex --model gpt-6.1-sol 直接指定;GPT-5.5 會在 10 月 14 日退場,存過的設定和排程記得先換掉。

❷ Claude Code:Pro、Max 的預設已經是 Opus 5.5,但要 v2.1.280 以上;打 /model 確認現在跑的是哪一個。

❸ ChatGPT 電腦版:切到 Work 或 Codex,輸入框下方可以選模型和推理強度;先用預設,不夠再往上調。

❹ Claude App:點送出鍵旁的模型名稱就能換 Opus 5.5、調 effort,每個模型建議的檔位會標「Default」。

換完遇到限流、硬碟爆掉、成本突然變高這類怪狀況,Codex 和 Claude Code 的 5 大坑我整理成一篇,先去那裡對一下。


FAQ 常見問題

寫程式用 GPT-6 Sol 還是 Opus 5.5?

要它自己找問題、在終端機跑很多步的長任務,選 Opus 5.5,預設檔位終端機任務 53% 對 48%。規格清楚、有驗收條件的程式交給 6.1 Sol,每題成本約 Opus 的六分之一。

長文用 GPT-6 Sol 還是 Claude Opus 5.5?

讀長資料兩邊幾乎打平,83% 對 84%,6.1 Sol 答完只要一半時間;要寫成報告交出去,Opus 5.5 的專業工作評分較高。Sol 要在 ChatGPT 的 Work 模式才用得到。

免費版選 GPT-6 Luna 還是 Claude?

免費版兩邊都碰不到 Sol 和 Opus 5.5。ChatGPT 的 Luna 只在電腦版 App 分批開放;Claude 免費版網頁和手機都能用 Sonnet 5.5,分數 41 比 30 高,我會先用 Claude。

只訂一家選 ChatGPT(Sol)還是 Claude(Opus 5.5)?

寫程式為主選 Claude Pro,Opus 5.5 和 Claude Code 都在裡面;文件、資料、雜事為主選 ChatGPT Plus,可以用 6.1 Sol 和 Luna 分層。兩邊月繳都是 20 美元。


寫在最後:GPT-6 Sol 和 Opus 5.5 不必二選一,看你的工作能不能切開

這次兩家同一天出新模型,我最大的感想是:與其問誰比較強,不如問你的工作能不能切開。能切開,兩家都付反而省;切不開,只訂一家、把那一家用到底就好。

新模型大概每隔幾週就會再來一輪,我的分工表也會跟著重排。想在下一輪出來時收到我重排的結果,可以訂閱我的部落格,會不定期收到信;想知道我平常怎麼用 AI 工作,可以看夜羽凌的自我介紹。


參考資料

 

延伸閱讀