人工智能開源生態迎來又一強勁選手。根據 Arena.ai 公佈的最新測評數據顯示,小米旗下的全新全模態旗艦大模型 MiMo-V2.6-Pro 在 Code Arena: WebDev(網頁開發測試場)中表現亮眼,首次亮相便成功重返總榜前十,並在採用 MIT 許可證的開源權重模型中高居前三。
在具體的評分表現方面,MiMo-V2.6-Pro 在早期自動評估(AutoEval)中斬獲了1628分的高分。這一成績不僅與 Claude Fable5(High)持平,還略微領先於得分1624分的 Hy4-preview。與上一代產品 MiMo-V2.5-Pro 此前取得的1475分相比,單次迭代實現了高達153分的顯著跨越。

在開源權重模型的橫向對比中,該模型的表現同樣表現優異。目前其積分僅落後排名第二的 Qwen3.8Flash Next 約7分,距離榜首的 Kimi K3Max 也僅有46分的差距。
需要指出的是,該成績目前基於由人類偏好數據訓練的獎勵模型進行自動投票得出。隨着後續更多真實人類投票數據的不斷累積與收斂,模型的最終排名與表現仍將持續得到驗證。此次 MiMo-V2.6-Pro 的強勢登場,再次印證了小米在強化學習與全模態大模型研發領域的持續深耕與技術突破。
VIP會員