動察 Beating AI 快訊,法國 AI 公司 Mistral 發布新旗艦模型 Mistral Large 4,內部暱稱「Le Chonk」。它採用 MoE 架構,總參數達到 1.05 萬億,但每次推理只激活 490 億參數。模型原生支持圖文輸入,上下文最長 100 萬 token。API 已開放預覽,模型權重計劃在 10 月 27 日公開。
Mistral 稱,Large 4 是目前美國和歐洲開發的綜合表現最強開放權重模型。官方給出的 DeepSWE v1.1 軟件工程評測為 62%,其對比表中 GLM-5.3 為 61%、DeepSeek V4 Pro 為 57%、Qwen 3.8 Max 為 51%。金融評測 Finch 得到 67%,與 DeepSeek V4 Pro 持平;衛星圖目標定位 DIOR-RSVG 得到 73%,高於 GPT-6 Astra 的 68%。
不過,這批成績目前主要來自 Mistral 自測,並非統一標準。智譜發布 GLM-5.3 時,在同一個 DeepSWE v1.1 上公布的成績是 66.9%,Kimi K3 則達到 67.5%,都高於 Large 4 的 62%。不同團隊使用的測試配置和運行方式可能不同。
Large 4 從零訓練,Mistral 用約 4000 塊 Nvidia Grace Blackwell GPU,在歐洲自己的數據中心訓練約兩個月。Mistral 也把「歐洲自主」作為賣點,模型從訓練、API 服務到未來自主部署,都可以留在歐洲基礎設施上。