2026-09-17

智谱 GLM 团队于 9 月 17 日公布了递归自我改进(RSI)方向的首个工程化进展,这一成果让 AI 能够自主改进其运行系统。具体而言,由 GLM-5.3 驱动的 Infra Agent 负责设计、调试并优化了 GLM-5.3-Flash 的推理基础设施,实现了模型对自身运行系统的反向改进。

根据官方博客,Infra Agent 在超过 10 万张国产芯片组成的集群上从零开始搭建了生产级推理服务,在不到两周时间内将端到端吞吐量提升至初始基线的 3 倍,硬件利用效率与单个 Token 成本均达到主流 NVIDIA GPU 的同等水平。该系统已投入实际使用,GLM-5.3-Flash 以匿名模型 Ox-Alpha 在 OpenCode 和 OpenRouter 上发布,6 天内 Token 调用量超过 62 万亿。

这是国内大模型厂商首次公开将“AI 自我改进”应用于生产环境,表明 AI 不仅能够编写代码,还能通过开云平台参与整个推理系统的工程闭环。