header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

一夜兩條路線:Opus5.5衝到第一,GPT-6把同檔成本砍半

動察 Beating AI 快訊,Artificial Analysis 完成對昨夜幾款新模型的第三方實測。Claude Opus 5.5 max 在 Intelligence Index v4.3 拿到 58 分,目前排名第一。GPT-6 Astra 和 Fable 5.1 都是 53 分,Opus 5 為 51 分。Opus 5.5 在 10 項評測裡拿下 6 項最高分。


但這個最高分也用了更多 token。Opus 5.5 max 每項任務平均輸出約 11.9 萬 tokens,比 Opus 5 的 7.3 萬多約 60%。靠 API 降價 20% 和快取讀取降價 60%,單任務成本最終為 5.98 美元,和 Opus 5 的 5.86 美元基本持平。更實用的 medium 檔拿到 51 分,已經追平 Opus 5 max,單任務成本只有 1.34 美元。


OpenAI 走的則是另一條路。GPT-6 Sol 和 Luna 的 Intelligence Index 表現與 GPT-5.6 前代接近,但價格明顯下降。Sol max 每項任務成本從 1.99 美元降到 1.06 美元,Luna 從 0.18 美元降到 0.07 美元。編碼 Agent 評測裡,Sol 從 55 分升到 57 分,成本也下降約一半;Luna 從 43 分降到 41 分,但單任務成本低約 60%。


兩家的路線已經開始出現分化:Opus 5.5 用更多推理把能力上限推到新高,GPT-6 Sol 和 Luna 則主要把原有能力做得更便宜。 在 Artificial Analysis 的效能/成本圖上,兩家的新模型都佔據了新的 Pareto 前沿。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成