GLM 5.3与5.2同基座 后训练带来大幅提升
智谱用同一个756B基座靠后训练把GLM 5.3调强这么多,DeepSeek V4 Flash 304B参数就干翻GLM 5.2,后训练真值得琢磨。
GLM 5.3与GLM 5.2共享同一个756B规模的基座,仅通过后训练实现了明显的能力跃升。DeepSeek V4 Flash以304B参数在部分表现上超过了GLM 5.2。智谱方面认为该基座仍有很大的后训练挖掘空间。有推测称OpenAI的Luna参数量约为500B,后训练同样被认为是关键环节。
智谱不愧是后训练之神 GLM 5.3 的能力提升这么多,基座竟然和 GLM5.2 是同一个 这个 756B 的基座要被智谱薅秃噜皮了 他们的文章里说,不,其实还有很大的后训练空间... 再结合 DeepSeek V4 Flash 的情况,304B 的参数干掉了 GLM5.2 后训练确实伟大 我现在猜测 Luna 也就 500B 左右,OpenAI 也是后训练的神 💬 2 🔄 0 ❤️ 13 👀 3273 📊 4 ⚡