10:27官方一手Pandaily@contact@pandaily.com (Pandaily)精选MindLab发布Macaron-V1,一种基于混合LoRA的后训练方法,应用于GLM 5.2。该方法包含4个专门的1B参数专家适配器,支持2M token上下文扩展。通过RL训练,748B参数的Venti变体仅用64块GPU即可完成训练,显著降低万亿参数模型的后训练成本。AI模型Macaron-V1GLM 5.2MindLab推荐理由:MindLab用Macaron-V1在64块GPU上训出748B模型,比传统RL省资源,适合想低成本强化大模型的人原文稍后读已读值得跟进有用关注 Macaron-V1