智谱GLM公布大模型递归自我改进实践,在国产十万卡集群构建推理系统

智谱GLM团队称,GLM-5.3驱动的Infra Agent在超10万张国产芯片集群上完成GLM-5.3-Flash生产级推理系统的设计、调试与优化,两周内将端到端吞吐提升至初始基线3倍。该模型以匿名模型Ox-Alpha上线OpenCode、OpenRouter,6天Token调用量超过62万亿。

来源:IT之家