ByteDance Seed 研究者将在 PyTorch Conference 介绍 LLM 训练调试工具 OpGuard
训练 LLM 时 loss 突然炸了却找不到原因?OpGuard 能逐比特比对两次训练,直接定位出错的那个算子。
训练 LLM 时 loss 突然炸了却找不到原因?OpGuard 能逐比特比对两次训练,直接定位出错的那个算子。
这是关于如何让AI训练更节能的研究,作者通过大量实验数据,提出了一个叫PFI的指标,能帮助在功率受限时优化训练效率,挺实用的。
做LLM微调的团队终于有了一个更系统的设计框架——Target-SFT直接告诉你如何选择目标分布,而不是盲目拟合每个token。做推理模型优化的开发者建议试试,效果在多个数据集上都有提升。
做LLM推理强化学习的团队终于有了一个兼顾计算和样本效率的方案——BASIS用单次采样就达到多采样的效果,训练成本大幅降低,建议做RLHF或推理优化的开发者点开看看。
数值预测是数学推理和代码生成的基础能力,DEL直接改进了LLM对数字的学习效果。做数学推理或代码生成模型训练的团队,值得关注这个新损失函数,它简单有效且开源可用。
做 LLM 部署优化的工程师终于有了一个高精度模拟器来验证“如果…会怎样”的假设,Charon 能帮你快速找到最佳配置,避免盲目调参,建议直接看论文实验部分。
训练 LLM 的团队终于有了一个不改变模型、不调优化器的加速方案——直接插进去就能省 2.5 倍时间,做预训练或资源受限的开发者值得一试。