|
小米全新全模态旗舰大模型MiMo-V2.6-Pro,首次登上Arena.ai的Code Arena: WebDev榜单就冲进总榜前十,在MIT许可开源权重模型中拿下第三名。它的自动评估得分达1628分,和Claude Fable5(High)持平,比上一代版本高出153分,仅落后榜首的Qwen3.8Flash Next约7分。 这背后是小米对齐人类偏好的奖励模型训练路线的直接成果,目前该成绩待真实人类投票验证,直接把国内开源大模型的代码能力抬到国际第一梯队门槛,后续同赛道竞品很难靠常规迭代追上这个差距。 |
AI INSIGHT
小米新大模型杀入Code Arena前十 性能直逼国际第一梯队
AI 摘要
小米全新全模态旗舰大模型MiMo-V2.6-Pro,首次登上Arena.ai的Code Arena: WebDev榜单就冲进总榜前十,在MIT许可开源权重模型中拿下第三名。它的自动评估得分达1628分,和Claude Fable5(High)持平,比上一代版本高出153分,仅落后榜首的Qwen3.8Flash Next约7分。这背后是小米对齐人类偏好的奖励模型训练路线的直接成果,目