OpenAI 推出 GPT-6 Sol 與 Luna,價格比前代砍半
OpenAI 22 日發表 GPT-6 Sol 與 GPT-6 Luna,把本月稍早推出的旗艦模型 GPT-6 Astra 延伸成更快、更便宜的版本,兩款模型的 API 價格比 GPT-5.6 同級模型的促銷價低 50%。據 Decrypt 報導,發布時間就在 Anthropic 推出 Claude Opus 5.5 之後幾分鐘,兩家實驗室同一天都以降價為主軸。
快取與推論效率改善,省下的成本直接反映在定價
OpenAI 表示,Sol 與 Luna 用與 Astra 相似的方法訓練,把 Astra 在專業工作、事實正確性、寫程式、電腦操作與對齊上的進展帶到更快、更便宜的模型上。官方寫道,快取與推論的改善讓它們能以更低成本提供服務,這些省下的成本「直接回饋給使用者與客戶」,做法就是把 API 價格砍半。
快取本身也做了調整。OpenAI 說明,GPT-6 的提示快取命中率預設提高,讓代理重複使用更多脈絡、回應更快,快取過的輸入 token 讀取有 90% 折扣。開發者可以用快取儀表板看有多少輸入被快取,也能在不破壞快取的情況下調整推理強度與工具開關。OpenAI 引述 GitHub 的說法,過去幾個月這些改善讓數十億次請求中需要重新處理的提示 token 比例降低超過 50%,讓 Copilot 回應更快。
官方評測拿來和 Claude 比,主打同等表現但成本低得多
OpenAI 公布的評測把新模型與 Anthropic 的模型並列比較。在測試跨應用商業流程的 AutomationBench 上,GPT-6 Sol 以 xhigh 強度的表現勝過 Claude Opus 5 的最高強度,每項任務成本只有後者的 9%。在評估複雜專業工作流程的 Agents’ Last Exam,GPT-6 Sol 最高強度得 56.4%,高於 Claude Opus 5 在該評測的最佳成績,每項任務成本低 60%。
在測試真實程式庫任務的 DeepSWE v1.1,GPT-6 Sol 最高強度得 68.8%,與 Claude Fable 5 的最佳成績 69.9% 相差 1.1 個百分點,每項任務成本約低 80%。OpenAI 也註明,競爭對手模型的分數取自公開報告,Claude Fable 5.1 沒有數據時以 Claude Fable 5 的分數替代。
事實正確性方面,OpenAI 以使用者標記過錯誤的去識別化對話做內部評測,GPT-6 Sol 的錯誤數約為前代的一半。官方也說明,這類會誘發錯誤的對話並不代表一般使用情境。
今天起在 ChatGPT Work 與 Codex 上線,Chat 還沒開放
兩款模型即日起提供給 ChatGPT Work 與 Codex 的 Plus、Pro、Business、Enterprise 與 Edu 用戶,免費與 Go 用戶可以在桌面版使用 GPT-6 Luna,但目前還沒有在 Chat 開放。API 上的模型代號是 gpt-6-sol 與 gpt-6-luna。OpenAI 表示會在一天之內分批推送,沒看到新模型的人可以稍後再試。
對齊方面,OpenAI 表示 Sol 與 Luna 延續 Astra 的對齊工作,在內部評測中都比 GPT-5.6 的對應模型進步,包括降低對自己寫程式成果做出誤導性陳述的比率。官方也註明,這些評測刻意測試困難情境,不代表一般使用下的失誤率。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。




