8月5日
02:48
02:48官方一手marktechpost@Asif Razzaq
Cursor Research开源了MoK,这是支撑Composer模型的MoE训练内核。MoK将专家混合的全部通信与计算融合进单个确定性内核。在GB300 NVL72机架上,MoK比最强公开基线快2.37倍。它需要Blackwell SM100或SM103 GPU,没有NVL72算力的用户无法使用。
事件专题

推荐理由:Cursor把训练内核MoK开源了,在GB300 NVL72上比最强公开基线快2.37倍,但得先有NVL72机器才能跑。
01:32
01:32官方账号Cursor@cursor_ai
精选
Cursor 宣布其 MoK 方案已投入训练任务,覆盖数万张 GPU。相比此前基于 DeepEP 的技术栈,端到端训练吞吐提升至 1.41 倍。MoK 已在生产环境验证,用于 Cursor 的大规模训练基础设施。
事件专题

推荐理由:Cursor 说 MoK 已在数万 GPU 上跑生产,比旧 DeepEP 栈端到端快 1.41 倍,搞大规模训练的可以看。
01:31
01:31官方账号Cursor@cursor_ai
72°
Cursor AI 开源了 Mixture-of-Kittens (MoK) 训练内核。该内核面向 NVIDIA NVL72 平台,将全部 MoE 通信与计算融合为单个确定性内核。相比最强公开基线,MoK 的训练速度最高可提升 2.37 倍。开发者现在可以获得完整代码并用于自己的训练任务。
事件专题

推荐理由:Cursor 把 NVL72 上的 MoE 训练内核开出来了,比公开方案快 2.37 倍,想省训练成本直接用。