動察 Beating AI 快訊,OpenAI 發布 GPT-6 Sol 和 GPT-6 Luna,把 GPT-6 能力下放到更便宜的兩檔模型。Sol 主打複雜編碼和專業工作,Luna 面向高頻日常任務。API 每百萬 tokens 分別為 Sol 輸入 2 美元、輸出 10 美元,Luna 輸入 0.10 美元、輸出 0.50 美元;相比 GPT-5.6 的促銷價至少便宜 50%。同日發布的 Claude Opus 5.5 為 4 美元和 20 美元,Sol 的原始 token 單價正好只有一半。
OpenAI 公布的 AutomationBench 中,Sol 開 xhigh effort 得到 33.2%,高於 Opus 5 的 26.9%,單題成本僅 0.27 美元,約為後者的 9%。這裡對比的是 Opus 5,不是剛發布的 Opus 5.5。DeepSWE v1.1 上,Sol 開 max 得到 68.8%,只比 Fable 5 的最高分低 1.1 個百分點,但單題成本低約 80%。
安全評測也有明顯變化。在故意誘發模型虛報編碼工作的測試中,Sol 的欺騙率從 GPT-5.6 Sol 的 10.4% 降到 1.3%,Luna 從 9.5% 降到 2.8%;GPT-6 Astra 為 0.5%。
兩款模型已經進入 API、ChatGPT Work 和 Codex。Free 和 Go 用戶可在桌面端使用 Luna,目前還沒有進入 Chat。GPT-6 的緩存讀取同時享受 90% 折扣,調整 reasoning effort 或開關工具也不會破壞此前緩存。