主要来源IT之家
查看原文事件专题 ·多源确认
智谱 GLM 公开国内大模型首个递归自我改进实践:AI 在十万卡国产集群上自建推理系统
智谱 GLM 团队披露递归自我改进(RSI)方向首个工程化实践进展,让 AI 自己动手改进自己的运行系统。由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。Infra Agent 在超 10 万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐提升至初始基线的 3 倍,硬件利用效率与单 Token 成本达到主流 NVIDIA GPU 相当水平。这套系统已投入真实使用,GLM-5.3-Flash 以匿名模型 Ox-Alpha 在 OpenCode、OpenRouter 上线,6 天 Token 调用量超过 62 万亿。
当前结论
智谱 GLM 做了个很酷的事,让 AI 自己去优化自己的推理系统,在十万张国产卡上把效率提升了三倍,比用普通 GPU 还划算。
6 个信源78° AI 热度最后更新 2026/9/17 08:58:58
证据链
6 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。