论文精选76°20:20Nous Research 提出 Token Superposition Training,LLM 预训练速度提升 2.5 倍训练 LLM 的团队终于有了一个不改变模型、不调优化器的加速方案——直接插进去就能省 2.5 倍时间,做预训练或资源受限的开发者值得一试。#预训练加速#Token Superposition Training#Nous Research#LLM训练官方账号AlphaSignal@AlphaSignalAI原文稍后读已读值得跟进有用关注 预训练加速