开源大模型格局重塑!小米 MiMo-V2.6-Pro 强势杀回 Code Arena 前十,性能直逼国际第一梯队

   发布时间:2026-09-28 21:13 作者:CHINAZ

人工智能开源生态迎来又一强劲选手。根据 Arena.ai 公布的最新测评数据显示,小米旗下的全新全模态旗舰大模型 MiMo-V2.6-Pro 在 Code Arena: WebDev(网页开发测试场)中表现亮眼,首次亮相便成功重返总榜前十,并在采用 MIT 许可证的开源权重模型中高居前三。

在具体的评分表现方面,MiMo-V2.6-Pro 在早期自动评估(Autoeval)中斩获了1628分的高分。这一成绩不仅与 Claude Fable5(High)持平,还略微领先于得分1624分的 Hy4-preview。与上一代产品 MiMo-V2.5-Pro 此前取得的1475分相比,单次迭代实现了高达153分的显著跨越。

在开源权重模型的横向对比中,该模型的表现同样表现优异。目前其积分仅落后排名第二的 Qwen3.8Flash Next 约7分,距离榜首的 Kimi K3Max 也仅有46分的差距。

需要指出的是,该成绩目前基于由人类偏好数据训练的奖励模型进行自动投票得出。随着后续更多真实人类投票数据的不断累积与收敛,模型的最终排名与表现仍将持续得到验证。此次 MiMo-V2.6-Pro 的强势登场,再次印证了小米在强化学习与全模态大模型研发领域的持续深耕与技术突破。

 
 
更多>同类内容
全站最新
热门内容