智谱GLM实现国内首次AI自我改进工程落地:Infra Agent完成自身推理系统全栈优化
SmartHey9月21日消息,近日,智谱GLM团队正式公布递归自我改进(Recursive Self-Improvement,RSI)方向的首个工程化突破——让大模型真正“动手优化自己”的运行基础设施。
具体而言,由GLM-5.3驱动的Infra Agent,独立完成了GLM-5.3-Flash推理系统的架构设计、端到端调试与性能调优,实现了模型对自身推理栈的闭环反向增强。
据智谱官方技术博客披露,Infra Agent在超10万张国产AI芯片构成的大规模集群上,从零搭建起生产级推理服务平台;仅用不到两周时间,便将端到端吞吐量提升至初始基线的3倍,硬件资源利用率与单Token推理成本已逼近主流NVIDIA GPU方案的水平。目前该系统已投入实际服务——优化后的轻量版模型GLM-5.3-Flash以匿名代号Ox-Alpha形式上线OpenCode与OpenRouter平台,上线6天内Token调用量突破62万亿次。
此举标志着国内大模型厂商首次将‘AI自我改进’能力规模化应用于真实生产环境,AI角色正从辅助编程者,跃升为具备系统级工程决策与执行能力的‘自主基础设施工程师’。
