众力资讯网

小米开源 MiMo-V2.6 近日,小米发布并开源MiMo-V2.6系

小米开源 MiMo-V2.6


近日,小米发布并开源MiMo-V2.6系列。Pro版1.02万亿参数,在Artificial Analysis智能指数中拿下46.32分,登顶全球开源第一。较前代26分高出20分。同步开源的还有强化学习任务环境、训练框架和技术报告。整轮RL后训练在直播间全程公开,6天花费约347万美元。
一、Pro和Flash:一个冲上限,一个管性价比
MiMo-V2.6-Pro总参数1.02万亿,每词元激活420亿,384个路由专家每次激活8个,70层架构。MiMo-V2.6-Flash总参数3090亿,激活150亿,48层。两个版本都是原生全模态,文本、图像、视频、音频进入同一个模型,支持100万Token上下文。Flash的FP8权重数据172.9GB,分布在65个分片中。
二、20分跨越从哪来?RL后训练
DeepSWE v1.1长程软件工程评测中,Pro从58.4提升至72.57,Flash从48.8提升至65.68。这项测试是样本外的,没参与过训练的任务也在提升,说明模型学到了通用长程执行能力。训练规模远超常见后训练:30个Step、约75万条轨迹、Pro累计处理810亿到1110亿训练Token。小米采用了完全异步的GRPO流程,通过多条成功轨迹相互比较,奖励更准确、更简短、更省Token的解法。
三、性能:跟闭源旗舰有来有回
Terminal Bench 2.1拿到89.9分,略高于Claude Opus 5的89.1。AutomationBench拿下53.1分,超过Claude Opus 5的50.3。Toolathlon-verified拿到76.9分,高于GPT-5.6 Sol的74.9。DeepSWE v1.1拿到71.9分,接近DeepSeek V4.1 Flash的74.2。但在Terminal Bench 4.0上仅得34.9分,与GPT-6 Astra的59.6仍有明显差距。
四、开源:MIT协议,直接商用
两个版本均采用MIT许可证——可商用、可微调、可再分发,没有营收门槛和研究条款。权重已在Hugging Face发布。API定价延续上一代:Flash每百万输入1元、输出2元,Pro每百万输入3元、输出6元,缓存命中折扣超99%。Pro完成一项智能指数任务的平均成本仅0.13美元,约合人民币0.9元。
罗福莉评价MiMo-V2.6的训练:“背后的研究创新和工程挑战,超过了我曾参与其中的DeepSeek-R1。”当开源模型在多项Agent基准上逼近闭源旗舰,当训练过程和任务环境一起公开,小米做的已经不只是“开源一个模型”——是把“怎么造模型”这件事,也教给了全行业。