小米新AI模型MiMo-V2.6成为行业标杆
在9月22日,小米发布了其最新的MiMo-V2.6系列AI模型,意外地在开源模型排行榜上超越了众多行业巨头,取得了显著成绩。其中Pro版在Artificial Analysis综合智能指数中得分46,领先于GLM-5.3和Qwen3.8 Max等模型,成为首位。这与上代MiMo-V2.5-Pro的26分相比,得分提升了20分。而在定价方面,MiMo-V2.6的API调用价格却低至海外同类模型的1/20到1/60,保持了与上一代一致的低廉定价。
小米于2023年4月成立大模型核心团队,在不到一年半的时间里取得了如此成就,令人瞩目。虽然不少人仍将小米与手机和汽车相提并论,但如今小米在大模型领域的表现正迎头赶上,打破了公众的期待。
小米的MiMo不仅是开源模型的佼佼者,其在软件工程能力和工具调用任务中的表现也与GPT-5.6 Sol和Claude Opus 5相当。在多步骤的软件能力测试DeepSWE v1.1中,MiMo-V2.6-Pro获得71.9分,与其他大模型相距不远。此外,在跨工具协作的Toolathlon-Verified测试中,它以76.9分领先GPT-5.6 Sol;而在通过图形界面操作的OSWorld-Verified测试中则获得82分,表现可圈可点。 龙8头号玩家国际
更引人注目的是,在Artificial Analysis的任务成本统计中,MiMo-V2.6-Pro在执行一万次任务的费用约为1300美元,远低于Claude和GPT系列的费用。这意味着小米在提供功能和性价比上具有显著优势,媒体因此称之为新一代大模型的“斩杀线”。
小米取得如此成绩的原因之一是强化学习方法,类似于培养程序员的实习过程。通过大量的任务提示和执行路径,模型在实践中不断学习并调整策略,从而提高解决复杂问题的能力。
总的来看,小米在短时间内实现了技术上的跃升,未来在大模型市场的表现值得期待。 龙8头号玩家国际