模型多源确认

Xiaomi 发布 MiMo-V2.6,将开源 RL 训练全程

Xiaomi ปล่อย MiMo-V2.6 หลังฝึกแบบ RL โชว์ออกอินเทอร์เน็ต เน้นราคาประหยัดคุ้มราคา

精选理由

Xiaomi 把 RL 训练全开源,Pro 版跑赢 Qwen3.8 Max,价格比涨价后的 DeepSeek 更低。

Xiaomi 发布 MiMo-V2.6 Pro 和 Flash 两个版本,此前公开了强化学习(RL)训练阶段的进展,并计划将训练过程全部开源,供外部研究者继续探索。基准测试显示,MiMo-V2.6 Pro 超过 Qwen3.8 Max、GLM-5.3、Kimi K3 等开源模型,但仍落后于 Claude Opus 5、OpenAI GPT 6 Astra 等闭源模型。定价上,Flash 为 0.14/0.28 美元每百万 token,Pro 为 0.435/0.87 美元每百万 token,维持此前与 DeepSeek 竞争时的降价,而 DeepSeek 已经涨价。按 Artificial Analysis 指数,MiMo-V2.6 是运行成本低于 1 美元每任务组中性价比靠前的模型。

图片来源 · Blognone
原文 · Blognone

Xiaomi ปล่อย MiMo-V2.6 หลังฝึกแบบ RL โชว์ออกอินเทอร์เน็ต เน้นราคาประหยัดคุ้มราคา

Xiaomi ปล่อย MiMo-V2.6 หลังฝึกแบบ RL โชว์ออกอินเทอร์เน็ต เน้นราคาประหยัดคุ้มราคา Body Xiaomi ปล่อยโมเดลปัญญาประดิษฐ์ MiMo-V2.6 รุ่น Pro และ Flash ออกมาพร้อมกันหลังจาก โชว์การฝึกในช่วง reinforcement learning (RL) ให้อินเทอร์เน็ตได้เห็นถึงพัฒนาการ ผลทดสอบแสดงให้เห็นว่า MiMo-2.6 ทั้งสองรุ่นอยู่ในกลุ่มนำ รุ่น Pro แซงหน้าโมเดลเปิดอื่นๆ เช่น Qwen3.8 Max, GLM-5.3, Kimi K3 แม้จะเป็นกลุ่มนำในกลุ่มโมเดลเปิด แต่ผลทดสอบก็ยังแสดงว่า MiMo-2.6 ทั้งสองรุ่นยังมีความสามารถตามหลังโมเดลปิดอย่าง Claude Opus 5, Fable 5.1, หรือ OpenAI GPT 6 Astra แม้ว่าผลทดสอบหลายตัวจะไล่ตามมาใกล้เคียงกันมากแล้วก็ตาม ความพิเศษของโมเดลทั้งสองรุ่น คือ Xiaomi โชว์การฝึกช่วง reinforcement learning ซึ่งทาง Xiaomi ระบุว่าจะโอเพนซอร์สออกมาทั้งหมด เพื่อให้นักวิจัยภายนอกสามารถสำรวจการฝึก RL ต่อไปในอนาคต ค่า API ของ MiMo-V2.6-Flash อยู่ที่ 0.14/0.28 ดอลลาร์ต่อล้านโทเค็น และ MiMo-V2.6-Pro อยู่ที่ 0.435/0.87 ดอลลาร์ต่อล้านโทเค็น เป็นราคาเดิมที่ Xiaomi เคยปรับลงสู้กับ DeepSeek แม้ว่าฝั่ง DeepSeek จะปรับราคาขึ้นไปแล้วก็ตาม ทำให้ตอนนี้ MiMo-V2.6 กลายเป็นโมเดลคุ้มราคาตามดัชนีของ Artificial Analysis ในกลุ่มโมเดลที่ต้นทุนการทำงานต่ำกว่า 1 ดอลลาร์ต่องาน ที่มา - Xiaomi lew Tue, 22/09/2026 - 08:30