header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

Google重回第一梯隊:Gemini 4 Argon追平GPT-6 Astra

動察 Beating AI 快訊,Artificial Analysis 完成 Gemini 4 Argon 第三方評測。在最高推理檔位下,Argon 的 Intelligence Index 得到 53 分,追平 GPT-6 Astra,比 GPT-6.1 Sol 高 1 分。相比 Google 上一款非 Flash 模型 Gemini 3.1 Pro Preview,分數提高了 23 分。


按目前 API 首發半價計算,Argon 每個 Intelligence Index 任務平均花費 1.99 美元,只有 GPT-6 Astra 的約 60%。但它並沒有少生成內容,平均每個任務輸出約 6.2 萬 tokens,Astra 只有 2.7 萬。優惠結束後,Argon 單任務成本預計升至 3.98 美元,反而約為 Astra 的 1.2 倍。


Argon 一個比較突出的變化是更少瞎猜。在 AA-Omniscience 中,它的幻覺率只有 15%,是 Intelligence Index 得分 45 以上模型中最低的。GPT-6 Astra 和 GPT-6.1 Sol 分別為 51% 和 54%。不過 Argon 的答案準確率只有 50%,低於 Astra 的 63%。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成