智谱半年报要点
智谱发布了 2026 年半年报并召开业绩会。上半年公司收入实现量级跃迁,API 与 MaaS 平台成为主要增长引擎,单位推理成本显著下降,模型迭代与商业化路径同步推进到 Co-work 阶段。以下为业绩会披露的核心要点:
- 2026 年上半年收入 9.54 亿元,同比增长约 400%,半年收入已经超过 2025 年全年。
- API/开放平台收入 8.25 亿元,同比增长约 27 倍,占总收入 86.5%,收入结构已从私有化部署明显转向 MaaS。
- MaaS 平台 Token 调用量较年初增长超过 40 倍,Coding Plan 调用量增长超过 23 倍,模型调用进入快速放量阶段。
- MaaS 平台企业及开发者用户超过 740 万,付费 DAU 增长 603%,前十大客户日均调用量较年初增长 98 倍。
- 在调用量大幅增长的同时,单位 Token 推理成本下降 80%,其定义的「算力乘数」同比提升约 14 倍。
- API 业务已从亏损转向盈利,毛利率由 -0.4% 提升到 24.6%;但公司整体毛利率为 26.4%,上半年仍处于高投入阶段。
- 商业化路径明确划为 Chat → Coding → Agent → Co-work → Autonomous AI,当前核心收入落在 Coding,并开始向 Co-work 推进。
- 过去半年进行了高频模型迭代:GLM-5.3 主攻智能上界,GLM-5.3-Flash 主攻成本下界,共同推进「智能—成本」Pareto Frontier。
- GLM-5.3-Flash 采用 320B 总参数、18B 激活参数的新架构,单任务成本约 0.045 美元;其匿名版本 Ox-Alpha 上线后 6 天累计调用超过 62T Token。
- 下一阶段路线从单纯「堆参数」转向 Scaling + Fully Self Training + Autonomous AI:让 AI 自己生产数据、构造训练环境、优化 Infra,并逐步从数小时任务走向数天级、多人类工作流级的自主交付。
关键数据速览
以下数据来自业绩会披露图表,为人工读取的近似值,最终以公司公告为准。
收入与 API 业务
| 维度 | 数值 | 同比 | 备注 |
|---|---|---|---|
| 报告期收入 | 9.54 亿元 | +400% | 已超过 2025 年全年收入 |
| 开放平台及 API 业务收入 | 8.25 亿元 | +2736% | 占总收入 86.5% |
平台用户数 2026 年 1–8 月
| 月份 | 用户数(百万) |
|---|---|
| 1 月 | 323.48 |
| 2 月 | 355.00 |
| 3 月 | 413.65 |
| 4 月 | 470.16 |
| 5 月 | 502.82 |
| 6 月 | 583.08 |
| 7 月 | 656.46 |
| 8 月 | 743.46 |
覆盖国家/地区 233 个,城市 20628 个。
运营 KPI(据原文数据看板)
| 指标 | 变化 | 说明 |
|---|---|---|
| Token 调用量 | +40 倍(较年初) | 模型调用进入快速放量 |
| Coding Plan 调用量 | +23 倍(较年初) | 编程场景为核心增长极 |
| API 业务毛利率 | -0.4% → 24.6% | 从亏损转向盈利 |
| 公司整体毛利率 | 26.4% | 仍处高投入阶段 |
| 单位 Token 推理成本 | -80%(较年初) | 算力乘数同比 +14 倍 |
| 付费 DAU | +603% | 前十大客户日均调用量 +98 倍 |
| 国产芯片推理集群规模 | 10 万 | 规模化部署 |
模型迭代与商业化
过去六个月智谱完成七代模型迭代,定位从「智能上界」与「成本下界」两端推进,叠加 Pareto Frontier 的横纵延伸。GLM-5.3 标签为开源 SOTA、国产 SOTA、编程 SOTA;GLM-5.3-Flash 标签为前沿模型、普惠成本、国芯推理,单任务成本约 0.045 美元,匿名版本 Ox-Alpha 上线 6 天累计调用超 62T Token。
GLM 模型 6 个月演进
| 模型 | 发布时段(近似) | 定位 / 备注 |
|---|---|---|
| GLM-5 | 2025.10 | Use Catalyzing Agentic Engineering |
| GLM-5.1 | 2025 年末 | 深度推理 |
| GLM-5.1-Turbo | 2025 年末–2026 初 | 推理加速 |
| GLM-5.2 | 2026 Q1(约 2026.04) | 编程方向 |
| GLM-5V-Turbo | 2026 Q2 | 视觉理解 |
| GLM-5.3 | 2026.06 | 智能上界:开源 SOTA / 国产 SOTA / 编程 SOTA |
| GLM-5.3-Flash | 2026.06 | 成本下界:前沿模型 / 普惠成本 / 国芯推理;320B/18B,单任务约 0.045 美元 |
(据原文图表人工读取的近似值,具体发布时间以官方为准。)
TAM 市场规模分层
| 阶段 | 规模 | 场景 |
|---|---|---|
| Chat / 群聊 / 信息获取 | 100B 美元 | 入口级 |
| Coding / 助理 / 编程 PMF | 500B 美元 | 当前核心收入 |
| Co-work / 广深场景 | 5T 美元 | 下一步推进 |
| Autonomous AI / 行业渗透 / 社区驱动 | 30T 美元 | 终局形态 |
下一阶段技术路线
智谱将下一阶段技术演进归为三个递进层次,构成从「能力上限」到「自主交付」的完整路径:
| 阶段 | 核心命题 | 关键动作 |
|---|---|---|
| Scaling | 依然是通向更高智能的主路径 | 持续扩大模型规模与训练算力 |
| Fully Self Training | 数据自产、环境自造、基础设施自优化 | 让 AI 自己生产数据、构造训练环境、优化 Infra |
| Autonomous AI | 从长程任务到自治系统的数天级交付 | 从数小时任务走向数天级、多人类工作流级的自主交付 |
网友热评







gary · 广东 · 5 小时前 · 6 赞
glm 是我第一个花钱用的国模,好像是去年八九月就花钱了,只用了一次,只说了一句话,发现他不支持图片(当时),我就再也没用了。上周你们都说 flash 好,我又买了个季度会员,头两天还行,结果从周六到周一,再也没吐过一个 token,总是说高峰忙,周用量才用了不到 40%,这周也快过完了。好多文章说什么新斩杀线,一个 token 都吐不出来你斩杀谁啊?ds 加油,kimi 加油,qwen 加油。
龚宇钢 · 上海 · 6 小时前 · 5 赞 · 首评
不及预期。
李祯 · 河南 · 4 小时前 · 4 赞
说白了,就是苦 DeepSeek 久矣。这不,看到梁子涨价了,直接不忍了,贴脸开大。但是吧,使用成本跟 DeepSeek V4 Flash 差距真不大。毕竟它这半价也就暂时的,而且 DeepSeek 的硬缓存命中的效率和性价比真就是黑科技,成本低到选择涨价后依然很有性价比。
老戴 · 北京 · 6 小时前 · 1 赞
天天上蹿下跳的不敢买,等突破了 55 线再看吧。