OpenAI 正式推出 GPT-6 Sol 與 GPT-6 Luna 兩款新模型,補齊 9 月 3 日發表的旗艦 GPT-6 Astra 之後,GPT-6 家族在中階與輕量兩個等級的空缺。這兩款新模型最大的賣點不是能力大躍進,而是價格直接砍半:Sol 從舊版的每百萬 token 4/20 美元降到 2/10 美元,Luna 更是從 0.2/1.2 美元降到 0.1/0.5 美元,官方還罕見地在發表文中直接拿多項 Benchmark 跟 Anthropic Claude Opus 5、Fable 5.1 對打比較。

Sol 與 Luna 是什麼?GPT-6 家族補完
OpenAI 在官方發表文中把三款 GPT-6 模型的分工講得很直白:Astra 負責「最重要、最吃緊的專案」,Sol 與 Luna 則是把同一套前沿智慧「用更低的成本分散出去」。兩者都承接前一代 GPT-5.6 Sol、GPT-5.6 Luna 的定位與訓練方法,只是把重點從「拚到最強」調整成「拚性價比」。值得留意的是,這次改版並沒有對應的 Terra 後繼版本——原本介於 Sol 與 Luna 之間的中間選項,在這一波 GPT-6 陣容裡似乎沒有被延續下來,官方公告本身也沒有特別說明 Terra 的去留,實際狀況仍待 OpenAI 進一步說明。
定價砍半:$2/$10 與 $0.1/$0.5
價格是這次更新最直接的變化。GPT-6 Sol 每百萬 token 輸入 2 美元、輸出 10 美元,較前代 GPT-5.6 Sol 的 4 美元/20 美元整整少了一半;GPT-6 Luna 輸入 0.1 美元、輸出 0.5 美元,同樣是前代 0.2 美元/1.2 美元的一半。官方將這波降價歸功於快取(caching)與推論架構的效率改善,並同步把快取讀取折扣拉高到 90%,開發者現在也能在不破壞快取的前提下,直接調整 reasoning 強度與可用工具範圍,對於需要大量重複呼叫、對成本敏感的應用來說是實用的細節升級。
| Model | Input | Output | 價格變化 |
| GPT‑6 Sol vs. GPT‑5.6 Sol | $4 → $2 | $20 → $10 | 降價 50% |
| GPT‑6 Luna vs. GPT‑5.6 Luna | $0.20 → $0.10 | $1.20 → $0.50 | 降價 50% |
Benchmark 直接對打 Claude:Sol 逼近 Fable 5.1、贏過 Opus 5
這次發表文比較罕見的地方,是 OpenAI 大方把測試結果直接拿去對比 Anthropic 的模型。在職場任務測試 AutomationBench 上,GPT-6 Sol(xhigh 模式)拿下 33.2% 分數、每個任務成本僅 0.27 美元,官方表示這個表現超越 Claude Opus 5 的 26.9%,而且成本只要對方的十一分之一。

在另一項多步驟職場流程測試 Agents’ Last Exam 上,Sol(max 模式)拿下 56.4%,成本比 Opus 5 低 60%。程式撰寫能力測試 DeepSWE v1.1 方面,Sol(max 模式)拿下 68.8%,只落後 Claude Fable 5 的 69.9% 約 1.1 個百分點,但成本卻低了約八成。

至於電腦操作測試 OSWorld 2.0,Sol(xhigh 模式)拿下 60.5%,追平 Claude Opus 5 中等強度模式的 60.3%,同樣是靠低成本取勝。

更便宜的 Luna 也沒有缺席比較——官方表示 Luna 在 DeepSWE v1.1(max 模式)拿下 66.6%,成本比 Opus 5 低 93%、比 Fable 5 低 96%。在事實準確度方面,官方表示 GPT-6 Sol 的錯誤率比前代 GPT-5.6 Sol 減少約一半、已經接近 Astra 的可靠度,Luna 在拉高推理強度後甚至能以約百分之一的成本追平 GPT-5.6 Sol 的表現。
哪裡可以用到
GPT-6 Sol 與 GPT-6 Luna 已經在 ChatGPT 的 Work 與 Codex 情境中,對 Plus、Pro、Business、Enterprise 與 Edu 用戶逐步開放;ChatGPT 桌面版的 Free 與 Go 用戶則可以直接使用 Luna,一般 Chat 對話模式目前尚未開放這兩款新模型。開發者端則可以直接透過 OpenAI API 以模型代號 gpt-6-sol 與 gpt-6-luna 呼叫。對已經在用 GPT-5.6 Sol/Luna 的團隊來說,這波「效能提升、價格砍半」的組合,加上官方主動對比 Claude 的自信喊話,預期會是接下來一段時間 OpenAI 與 Anthropic 中階、輕量模型市場競爭的重要看點。





