一、案例背景
1.1 企业简介
智谱AI(北京智谱华章科技有限公司)是中国领先的人工智能大模型企业,孵化自清华大学知识工程实验室(KEG),由唐杰教授团队创立。公司以GLM(General Language Model)系列大模型为核心产品线,是中国最具代表性的大模型”独角兽”企业之一。2026年9月,智谱AI发布GLM-5.3-Flash模型(匿名测试期间代号”Ox-Alpha”),该模型在发布一周内即成为全球使用最广泛的模型之一,短短六天内处理超过62万亿个Token,引发行业广泛关注。
1.2 行业背景:算力困局与国产替代
2022年以来,美国对中国AI芯片出口实施多轮管制,英伟达高端GPU(如A100、H100)的对华供应受到严格限制。在此背景下,中国AI企业面临严峻的算力约束:一方面,大模型训练和推理对算力的需求呈指数级增长;另一方面,国产芯片在底层软件生态、算子兼容性、通信效率等方面与英伟达存在显著差距。
行业普遍认知是:国产芯片”能用”但”不好用”。底层软件栈不成熟、关键算子缺失、运维文档匮乏、大规模集群稳定性差等问题,使得多数企业仍倾向于依赖英伟达生态。据行业估算,中国头部AI企业每年在算力方面的投入高达数百亿元,其中相当比例用于适配和优化国产芯片。
1.3 事件来龙去脉
2026年9月17日,智谱AI首席科学家唐杰罕见地发布了一条长推文,首次系统披露了公司在RSI(Recursive Self-Improvement,递归式自我改进)领域的最新进展。核心信息包括:
第一,RSI已落地Infra层面。 智谱AI已将RSI理念应用于推理基础设施(Infrastructure)层面,构建了一套由GLM-5.3驱动的推理Infra系统。这套系统的核心特征是:AI模型深度参与自身运行基础设施的优化过程,形成”模型优化系统、系统反哺模型”的闭环。
第二,十万张国产芯片的里程碑。 GLM-5.3-Flash的全部推理负载运行在十万张国产芯片组成的集群上。这一规模在国产芯片部署史上前所未有。唐杰透露,在这样的集群中,”每天都可能有几百张卡发生硬件故障、网络掉线或数据丢包”。
……