動察 Beating AI 快訊,JetBrains 發布開源編程模型 Mellum2.1。與今年 6 月推出的 Mellum2 相比,新版總參數仍為 120 億,每次生成只激活 25 億,但更擅長查找代碼問題、修改文件並檢查結果。
JetBrains 沒有改動模型架構,主要靠強化學習提升能力。團隊在數千種環境中運行了數百萬次沙盒任務。訓練時,模型在真實代碼倉庫中調用終端和文件編輯工具,成功通過測試便能獲得獎勵。
JetBrains 自測顯示,SWE-bench Verified(真實軟件問題修復測試)的成功率從舊版 2% 升至 47%,略低於 Qwen3.5-9B 的 50%。但在 LiveCodeBench v6 編程測試中,Mellum2.1 得分 82%,超過 Qwen 的 75.4%。JetBrains 還稱,在單張 H200 上高負載運行時,新模型的輸出吞吐量接近 Qwen3.5-9B 的兩倍。
模型權重及 GGUF 量化版已在 Hugging Face 開放,採用 Apache 2.0 許可,可供開發者本地部署。