header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

谷歌发布Gemini 3.1 Flash-Lite,輸入價格為Pro的1/8,6項基準超GPT-5 mini和Claude 4.5 Haiku

據 1M AI News 消息,3 月 4 日,Google 發布 Gemini 3.1 Flash-Lite 預覽版,定位為 Gemini 3 系列中速度最快、成本最低的模型。該模型基於 Gemini 3 Pro 架構,採用混合專家(MoE)設計,僅啟動部分參數以降低推理成本。API 定價為輸入 $0.25/百萬 token、輸出 $1.50/百萬 token,分別為 Gemini 3.1 Pro($2/$18)的約 1/8。


性能方面,相比 Gemini 2.5 Flash,首個 token 延遲縮短 2.5 倍,輸出速度提升 45%,達到每秒 363 token。支持最大 100 萬 token 輸入和 6.4 萬 token 輸出,接受文本、圖片、音頻和視訊輸入。在 11 項內部基準測試中,Flash-Lite 在 6 項上超過 GPT-5 mini 和 Claude 4.5 Haiku,GPQA Diamond(博士級科學問答)達 86.9%,MMMU-Pro(多模態推理)76.8%,LiveCodeBench(程式碼生成)72.0%。


該模型內建可調「思考級別」(thinking levels),開發者可在 AI Studio 和 Vertex AI 中控制模型推理深度,在高頻場景中平衡品質與成本。目前通過 Gemini API(Google AI Studio)和 Vertex AI 提供預覽版訪問。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成