模型精选13:51LLMs写单GPU内核快,多GPU就崩溃新基准ParallelKernelBench发现,LLM写单GPU代码还行,但多个GPU一起就瞎了。想看看AI编程到底卡在哪?#ParallelKernelBench#Megatron-LM#DeepSpeed#多GPU官方账号Together AI@togethercompute原文稍后读已读值得跟进有用关注 ParallelKernelBench