AI 与智能体
Z.ai 称 GLM 智能体自建了自家推理基础设施
- 发布日期
- 来源
- Z.ai 博客
摘要
Z.ai 在 9 月 17 日的技术博客中表示,由 GLM-5.3 驱动的 Infra Agent 在超过 10 万张中国产 AI 加速器组成的集群上,搭建了 GLM-5.3-Flash 的生产推理服务。据该公司介绍,从模型适配到生产就绪不到两周,端到端吞吐量约为初始基线的 3 倍,硬件效率和单 token 成本达到与主流 NVIDIA GPU 相当的水平。Z.ai 将此定位为递归自我改进的早期形态,同时强调目标设定、边界和风险评估仍是人类的责任。原文博客采用 JavaScript 渲染,无法直接读取全文,细节已通过专业媒体报道交叉核实。
与我们工作的关联
作为模型优化运行该模型的系统的案例,它显示 AI 智能体已从编码辅助走向大规模基础设施工作。不过吞吐量约为三倍等数字出自 Z.ai 自己的发布,尚无外部验证。
本文译自韩文原文。 摘要可能经过翻译和编辑。评论是我们的解读,未来预测代表来源的观点。