精选理由
智谱用同一个756B基座靠后训练把GLM 5.3调强这么多,DeepSeek V4 Flash 304B参数就干翻GLM 5.2,后训练真值得琢磨。
GLM 5.3与GLM 5.2共享同一个756B规模的基座,仅通过后训练实现了明显的能力跃升。DeepSeek V4 Flash以304B参数在部分表现上超过了GLM 5.2。智谱方面认为该基座仍有很大的后训练挖掘空间。有推测称OpenAI的Luna参数量约为500B,后训练同样被认为是关键环节。
原文 · orange.ai
智谱不愧是后训练之神 GLM 5.3 的能力提升这么多,基座竟然和 GLM5.2 是同一个 这个 756B 的基座要被智谱薅秃噜皮了 他们的文章里说,不,其实还有很大的后训练空间... 再结合 De...
智谱不愧是后训练之神 GLM 5.3 的能力提升这么多,基座竟然和 GLM5.2 是同一个 这个 756B 的基座要被智谱薅秃噜皮了 他们的文章里说,不,其实还有很大的后训练空间... 再结合 DeepSeek V4 Flash 的情况,304B 的参数干掉了 GLM5.2 后训练确实伟大 我现在猜测 Luna 也就 500B 左右,OpenAI 也是后训练的神 💬 2 🔄 0 ❤️ 13 👀 3273 📊 4 ⚡