智谱发了GLM-5.3,没重新预训练就靠后训练把安全和长程任务拔高一大截,搞智能体或代码修复的值得看看。
智谱发布GLM-5.3,基于743B基础模型仅做后训练,未重新预训练。新版本重点提升安全能力,针对模型防御场景做了优化。长程任务执行显著增强,包括终端操作、工具调用及大型代码库修复。在开源模型中,其网络安全能力达到新水平。
GLM-5.3 发布了,看了一下,着重提升的主要是两部分: 1. 安全能力:看来 Hugging Face 在拿 GLM-5.2 防御了 OpenAI 的模型入侵以后,智谱也看到了这方面的价值,尤其...
GLM-5.3 发布了,看了一下,着重提升的主要是两部分: 1. 安全能力:看来 Hugging Face 在拿 GLM-5.2 防御了 OpenAI 的模型入侵以后,智谱也看到了这方面的价值,尤其是大家最近都在聊这块,他们针对性地做了一些优化。 2. 长程任务的执行: 比如终端里的任务、工具调用,以及大代码库的修复任务,都有非常大的提升。 这个模型依然是只进行了后训练,没有重新进行预训练。这都几个版本了,还能有这么大的提升,确实猛啊! Z.ai @Zai_org Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved through post-training on the 743B base model - A major leap in cybersecurity, setting a new standard among open models Tech Blog: z.ai/blog/glm-5.3 🔗 View Quoted Tweet 💬 5 🔄 1 ❤️ 9 👀 4382 📊 4 ⚡