ithome
科技
采集 2026-09-17T10:12:04+00:00
智谱披露国内大模型首个递归自我改进实践
原始标题:智谱 GLM 公开国内大模型首个递归自我改进实践:AI 在十万卡国产集群上自建推理系统
来源
ithome
发布时间
2026-09-17T08:58:58
采集批次
2026-09-17-10
字数
399
URL 指纹
8baea84d4cf1fbd0
📌 AI 总结(307 字)
智谱GLM团队公开了国内大模型领域首个递归自我改进(RSI)工程化实践:由GLM-5.3驱动的Infra Agent自主设计、调试并优化了GLM-5.3-Flash的推理基础设施,在超过10万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐量提升至初始基线的3倍,硬件利用效率与单Token成本达到主流NVIDIA GPU相当水平。该系统已投入真实使用,GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode和OpenRouter上线,6天内Token调用量超过62万亿。这是国内大模型厂商首次将AI自我改进应用于生产环境,标志着AI从写代码扩展到参与整个推理系统的工程闭环。
📄 正文(399 字)
智谱GLM团队披露递归自我改进(Recursive Self‑Improvement,简称RSI)方向首个工程化实践进展,也就是让AI自己动手改进自己的运行系统。 具体来说,由GLM-5.3驱动的Infra Agent完成了GLM-5.3-Flash推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。 据官方博客,Infra Agent在超10万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐提升至初始基线的3倍,硬件利用效率与单Token成本达到主流NVIDIA GPU相当水平。这套系统已投入真实使用,GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线,6天Token调用量超过62万亿。 这是国内大模型厂商首次公开将AI自我改进用于生产环境,意味着AI不再只是写代码,还能参与整个推理系统的工程闭环。