事件专题 · 多源确认

GLM 5.3与5.2同基座 后训练带来大幅提升

GLM 5.3与GLM 5.2共享同一个756B规模的基座,仅通过后训练实现了明显的能力跃升。DeepSeek V4 Flash以304B参数在部分表现上超过了GLM 5.2。智谱方面认为该基座仍有很大的后训练挖掘空间。有推测称OpenAI的Luna参数量约为500B,后训练同样被认为是关键环节。

当前结论

智谱用同一个756B基座靠后训练把GLM 5.3调强这么多,DeepSeek V4 Flash 304B参数就干翻GLM 5.2,后训练真值得琢磨。

11 个信源67° AI 热度最后更新 2026/8/15 00:25:52

证据链

相关来源 3深度求索 DeepSeek
查看原文
相关来源 5歸藏(guizang.ai)
查看原文
相关来源 8阮一峰的网络日志
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情