ITCOW牛新网 9月22日消息,小米今日凌晨发布并开源MiMo‑V2.6系列,包含Pro、Flash两款原生全模态大模型,是小米探索RSI递归自我改进技术路线的重要版本,大幅扩充强化学习RL算力规模。

测评方面,MiMo‑V2.6‑Pro在AA综合智能指数v4.3.2拿到46分,超越Kimi K3、GLM‑5.3,成为该榜单得分最高的开源权重模型,对比上一代V2.5‑Pro提升20分;不过和Claude Fable 5.1、GPT‑6 Astra等顶级闭源模型还有差距。两款模型RL训练耗时不到6天,分别完成30步迭代,累计75万条轨迹,软件工程等多项评测指标获得明显提升。

能力层面,新增3D空间推理、多模态感知、计算机操作能力;可以完成3D游戏场景搭建、控制仿真机械臂执行抓取放置;科研上能够辅助筛选MOF材料设计方案,完成数学定理Lean形式化证明。

API服务沿用V2.5定价,Flash每百万输入1元、输出2元;Pro每百万输入3元、输出6元,附带99%缓存折扣。同步上线Windows/Mac端MiMo Desktop客户端,Pro支持UltraSpeed超高速模式,推理最高提速20倍,开放平台同步更新模型,原有邀测通道一周后关闭。


小米完整开源Pro、Flash权重、技术报告,同时放出蒸馏版MiMo‑V2.6‑Distill‑Qwen‑9B、7000+RL高质量任务环境、端到端RL训练框架与可组合Harness组件,面向社区开放完整训练研究资源。
