精选理由
万亿参数模型首次达到千 tokens/s 输出,做大规模推理或实时 AI 应用的团队可以直接申请体验,看看能否真正落地到生产环境。
小米 MiMo 与 TileRT 联合发布 MiMo-V2.5-Pro-UltraSpeed 模式,首次在 1 万亿参数模型上实现超过 1000 tokens/s 的输出速度。该模式 API 已上线,定价为原版的 3 倍,但输出速度提升约 10 倍。由于高速推理资源有限,该模式采取申请制限时开放,申请通过的用户可在 2026 年 6 月 9 日至 6 月 23 日期间免费体验 Chat 功能,每日最多 10 次会话,每次最长 30 分钟。这一突破标志着万亿参数模型在实时推理场景中的实用化迈出关键一步。
AI 翻译 · 中文
小米 MiMo 与 TileRT 联合发布 MiMo-V2.5-Pro-UltraSpeed 模式,首次在 1 万亿参数模型上实现超过 1000 tokens/s 的输出速度。该模式 API 已上线,定价为原版的 3 倍,但输出速度提升约 10 倍。由于高速推理资源有限,该模式采取申请制限时开放,申请通过的用户可在 2026 年 6 月 9 日至 6 月 23 日期间免费体验 Chat 功能,每日最多 10 次会话,每次最长 30 分钟。这一突破标志着万亿参数模型在实时推理场景中的实用化迈出关键一步。
IT之家 6 月 9 日消息,小米 MiMo 官方昨日宣布, 与 TileRT 联合发布 Xiaomi MiMo-V2.5-Pro 的 UltraSpeed 模式 。MiMo-V2.5-Pro-UltraSpeed API 同步上线,采用限时体验价, 定价为 MiMo-V2.5-Pro 的 3 倍,同时提供输出速度约 10 倍的提升 。 小米创办人、董事长兼 CEO 雷军今日发文介绍,MiMo 昨晚发布 V2.5-Pro-UltraSp…