8月5日
05:12
05:12eric zakariasson@ericzakariasson
精选72°
Cursor宣布开源Mixture-of-Kittens (MoK),这是一个面向NVL72的MoE训练megakernel。MoK将专家混合的所有通信与计算融合进单个确定性内核,相比最强公开基线提速最高2.37倍。该内核专为NVL72集群设计,用于提升大规模MoE训练效率。
事件专题

推荐理由:Cursor开源了MoK内核,把MoE训练的通信和计算合成一个内核,跑得比公开基线快2.37倍,搞NVL72训练的可以看看。
01:31
01:31官方账号Cursor@cursor_ai
72°
Cursor AI 开源了 Mixture-of-Kittens (MoK) 训练内核。该内核面向 NVIDIA NVL72 平台,将全部 MoE 通信与计算融合为单个确定性内核。相比最强公开基线,MoK 的训练速度最高可提升 2.37 倍。开发者现在可以获得完整代码并用于自己的训练任务。
事件专题

推荐理由:Cursor 把 NVL72 上的 MoE 训练内核开出来了,比公开方案快 2.37 倍,想省训练成本直接用。