事件专题 ·多源确认

Xiaomi 发布 MiMo-V2.6,将开源 RL 训练全程

Xiaomi 发布 MiMo-V2.6 Pro 和 Flash 两个版本,此前公开了强化学习(RL)训练阶段的进展,并计划将训练过程全部开源,供外部研究者继续探索。基准测试显示,MiMo-V2.6 Pro 超过 Qwen3.8 Max、GLM-5.3、Kimi K3 等开源模型,但仍落后于 Claude Opus 5、OpenAI GPT 6 Astra 等闭源模型。定价上,Flash 为 0.14/0.28 美元每百万 token,Pro 为 0.435/0.87 美元每百万 token,维持此前与 DeepSeek 竞争时的降价,而 DeepSeek 已经涨价。按 Artificial Analysis 指数,MiMo-V2.6 是运行成本低于 1 美元每任务组中性价比靠前的模型。

当前结论

Xiaomi 把 RL 训练全开源,Pro 版跑赢 Qwen3.8 Max,价格比涨价后的 DeepSeek 更低。

11 个信源64° AI 热度最后更新 2026/9/22 01:30:57

证据链

11 个信源
相关来源 5歸藏(guizang.ai)
查看原文
相关来源 6VnExpress Số hóa
查看原文
相关来源 10掘金本周最热
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。