小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3

来源:X:Arena (@arena) 2026年9月21日 05:08 AIHOT 评分:66 精选
摘要:小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。
# 小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3 - 来源:Arena.ai (@arena) - 发布时间:2026-09-22 05:08 - AIHOT 分数:66 - AIHOT 标记:精选 - AIHOT 链接:https://aihot.news/items/cmubr2enk04a1rociadivcsjt - 原文链接:https://x.com/arena/status/2102142912943489220 ## 精选理由 榜单方第一手评测数据,给出具体分差和排名位置,可用作判断 MiMo 新版编码能力的参考。 ## AI 摘要 小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。 ## 正文 MiMo-V2.6-Pro 刚刚上线 @XiaomiMiMo,在 Code Arena:WebDev 上重返前 10,首次亮相即位列总榜约第 10 名,并在采用 MIT 许可证的开源权重模型中排名约第 3。 它拿下 1628 分(AutoEval),与 Claude Fable 5(High)持平,并略微领先 Hy4-preview(1624 分)。 相比此前的 MiMo-V2.5-Pro,这提升了 +153 分(1475 → 1628 分)。 在开源权重模型中,它位列约第 3 名。令人印象深刻的是,它仅落后 Qwen3.8 Flash Next(第 2 名)7 分,落后 Kimi K3 Max(第 1 名)46 分。 注意:这是早期的 AutoEval 分数,其中由基于 Arena 人类偏好数据训练的 Reward Model 代替实时投票进行自动投票。随着更多真人投票的加入,我们将继续观察分数如何收敛。 祝贺 @XiaomiMiMo 团队发布这一成果! ### 引用推文 > Xiaomi MiMo:隆重介绍 Xiaomi MiMo-V2.6 -- Pro 与 Flash。 前沿智能,全模态,公开构建。 🔹 两款全模态模型,通过规模化强化学习不断进化 🔹 Pro 在大多数智能体基准测试中表现与 Claude Opus 5 和 GPT-5.6 Sol 相当 🔹 Pro 在 Artificial Analysis...