2026年8月31日,智谱(02513.HK)发布2026年中期业绩。财报显示,公司上半年实现收入9.54亿元,同比增长近400%,半年收入已超过2025年全年水平;其中MaaS开放平台及API服务收入8.25亿元,同比增长2736%,占总收入比例由2025年末的26.3%跃升至86.5%,收入结构完成从本地化部署向云端MaaS服务的历史性切换。
业绩发布会上,智谱董事长刘德兵表示,智谱将持续最优的模型轨迹,保持SOTA。在过去一年行业对SOTA的理解正在被改写,榜单的领先不再是最重要的,重要的是更快的节奏,持续把更强的模型推向市场。单点冠军只是转瞬即逝的点,持续最优才是不断向上的轨迹。GLM系列在约11个月内完成了六次迭代,智能指数从32提升至60,单任务完成稳定在0.2美元档,GLM‑5.3‑Flash以0.045美元的单任务成本进入到智能成本前沿。
模型能力持续迭代
过去11个月,智谱连续迭代GLM‑4.6、GLM‑4.7、GLM‑5、GLM‑5.1、GLM‑5.2及GLM‑5.3六代旗舰模型,智能指数由32提升至60。模型能力从早期的氛围编程,逐步扩展至代码文件生成、工具调用、自主执行及工程级项目交付。
2026年8月发布的GLM‑5.3在第三方评测机构Artificial Analysis综合智能指数中取得60分,进入全球前沿模型区间,与Claude Fable 5、GPT‑5.6 Sol等闭源旗舰处于同一水平,并与Kimi K3并列开源模型第一。该模型擅长复杂编码、防御性网络安全与长程任务。值得注意的是,GLM‑5.3与GLM‑5.2采用相同架构、总参数及激活参数,主要通过扩大长程任务环境和后训练规模,使端到端任务完成率提升超过50%——验证了Scaling的对象正从单纯增加参数扩展至训练深度、有效计算深度和真实任务环境。
公司业务重心正处于Chat—Coding—Co‑work—Autonomous AI能力阶梯中Coding向Co‑work演进阶段,在网络安全、法律、金融等方向已进入Co‑work落地。
推理成本大幅优化
自2026年初实施“All‑in‑Infra”战略以来,智谱将国产芯片纳入前沿模型主力推理算力。目前,公司已形成10万级国产芯片规模化推理能力,单位Token推理成本较年初下降80%,端到端服务性能较初始基线提升3倍,单位算力(含训练和推理)所对应的收入提升14倍。
2026年8月发布的轻量旗舰模型GLM‑5.3‑Flash,采用新一代架构及30T级多模态预训练语料,在能力超过GLM‑5.2的同时,将单任务成本降至0.045美元,调用价格降至GLM‑5.2的约十分之一。正式发布前,该模型以匿名身份“Ox‑Alpha”在OpenCode与OpenRouter接受真实调用检验,上线首日即登上OpenRouter榜首;6天内Token调用量超过62万亿,并带动平台整体调用量提升超20%。8月26日,智谱面向全球开源GLM‑5.3‑Flash模型。
MaaS业务迎来放量
模型能力上探与推理成本下探形成合力,共同推动智谱MaaS平台迎来历史性放量。
报告期内,MaaS平台及API服务收入达8.25亿元,同比增长2736%;开放平台及 API 业务板块毛利率由去年同期的‑0.4%提升至24.6%,实现由负转正。智谱2026中期业绩沟通会披露,截至2026年8月31日,平台企业及开发者用户超过740万,覆盖233个国家和地区;Token调用量较年初增长超40倍;付费日活用户增长603%;前十大客户日均调用量增长98倍;API平均售价较年初提升约101%,实现“量价齐升”。Coding Plan调用量增长超23倍。
据智谱2026年中期业绩沟通会披露,截至2026年8月31日,智谱MaaS平台年化收入规模(ARR)按月度计算达到16亿美元、按周度计算达到20亿美元。基于此强劲势头,管理层给出 2026 年底 ARR 指引为 24 亿美元;7 月公司披露 MaaS 平台 ARR 已达 10 亿美元。
智谱表示:“公司以GLM‑5.3与GLM‑5.3‑Flash完成能力上界×成本前沿的双线突围,依托国产芯片规模化推理把成本曲线掌握在自己手里,驱动MaaS平台迎来历史性放量,前沿智能正在进入更多开发者、企业和真实工作流。”
探索自治系统新方向
在验证模型可独立完成数小时量级工程任务的基础上,智谱下一阶段将进一步延长模型持续执行任务的周期,推动模型从单一Agent走向多Agent分工协作,探索数天量级、可验证、可审计的完整业务流程执行。
公司同时正在探索“Fully Self Training”——模型逐步参与高质量数据生产、训练环境搭建和基础设施优化。目前,GLM生成的任务环境已用于后续模型训练;由GLM‑5.3驱动的基础设施Agent已参与推理内核、性能诊断和服务栈优化,推动国产芯片端到端服务性能提升3倍、算子开发周期缩短约一半。公司强调,该流程当前仍保留大量人工环节,能力评估和风险判断最终由人及外部机构独立完成。
智谱提出AGI的商业价值等于智能上限乘以Token消耗规模——“前半截决定单个任务值多少钱,后半截决定有多少任务真实发生”。从“卖模型”到“卖调用”再到“卖端到端任务结果”,智谱的商业化路径正沿着能力阶梯逐级向上。