
OpenAI 於週二推出兩款新模型:GPT-6 Sol 與 GPT-6 Luna。這距離 Anthropic 發布其全新旗艦模型 Claude Opus 5.5 僅過了幾分鐘。
Sol 與 Luna 的定位低於 GPT-6 Astra;OpenAI 在 9 月 3 日推出 Astra 時,稱其為「全球最聰明且最對齊的模型」。Astra 仍是 OpenAI 在高難度任務上的首選;Sol 與 Luna 則是為日常工作打造、更便宜也更快速的選項。
因此,這與 Anthropic 採用的策略非常相似。Astra 相當於 Fable,Sol 相當於 Opus,Terra 相當於 Sonnet,而 Luna 則相當於 Haiku(在其升級後)。
OpenAI 也調整了價格,以維持競爭力。兩款模型的 API 成本,相較於 GPT-5.6 促銷期間的每 token 費率,皆下調了 50%。Token 是模型讀取與輸出的文字片段,通常略小於一個完整單字;企業通常以每百萬 token 計費,因為 AI 在大規模使用下的帳單就是這樣累積起來的。
請歡迎 GPT-6 Sol 與 GPT-6 Luna 加入 GPT-6 宇宙。
GPT-6 Sol 與 Luna 建立在 GPT-6 Astra 背後的技術進展之上,將其許多優勢帶入更快、也更具價格可負擔性的模型,以支援大規模工作。
我們也讓快取與推論更有效率,而且…… pic.twitter.com/5LiVE4rbFt
— OpenAI (@OpenAI) 2026 年 9 月 22 日
Sol 現在的價格為每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,低於原本的 4 美元與 20 美元。Luna 則降至 0.10 美元與 0.50 美元,原本為 0.20 美元與 1.20 美元。整體而言,若與 Anthropic 相比,OpenAI 在各個級距的報價都更便宜。
效能方面的主張主要依據 AutomationBench。這是一項由 Zapier 建立的基準測試,用來檢驗 AI 代理是否能利用涵蓋銷售、行銷、營運、客服、財務與人資等 47 種工具,完成完整的商業工作流程,並以通過率評分。GPT-6 Sol 在最高推理設定下,取得 33.2% 的成績,每項任務成本為 0.27 美元。
根據 OpenAI 自行提供的數據,Claude Opus 5 在其最高設定下得分為 26.9%,但每項任務成本高出超過 11 倍。在同一項測試中,GPT-6 Sol 也略勝 Anthropic 更昂貴的旗艦模型 Claude Fable 5.1。
在 Agents' Last Exam 測試中,該測試會針對 AI 代理於 55 個子產業中的長時程、高經濟價值工作進行評估,並以完成百分比計分;GPT-6 Sol 在最高 effort 設定下取得 56.4%。OpenAI 表示,這一成績超越 Claude Opus 5 的最佳分數,同時每項任務成本低 60%。
推理 effort 是 OpenAI 新增的一個調節旋鈕:把它調高後,模型會在回答前花更多時間與算力反覆檢查自己,通常也會同時提高準確率與成本。
在電腦操作方面——也就是 AI 代理像人類一樣點擊、輸入並操作軟體介面——GPT-6 Sol 在 OSWorld 2.0 上幾乎追平 Claude Opus 5 的中等 effort 分數,分別為 60.5% 與 60.3%,但成本約低 80%。OSWorld 測試的是長時程、貼近真實情境的電腦任務,並根據工作正確完成的比例給出部分分數。
GPT-6 Sol 與 Luna 現已在 ChatGPT Work 與 Codex 上線,開放 Plus、Pro、Business、Enterprise 與 Edu 訂閱用戶使用;Luna 也透過桌面應用程式向免費版與 Go 用戶提供。
這兩款模型目前都尚未進入一般版 ChatGPT 應用程式;OpenAI 表示,為了維持服務穩定,將在一整天內逐步完成部署。