登录

智谱:年内词元调用量增4倍,推理成本下降80%



速读:智谱半年报披露,截至6月30日。 业绩快速增长背后,是大模型智能水平和性价比的同步攀升。
智谱:年内词元调用量增4倍,推理成本下降80% _ 东方财富网

智谱:年内词元调用量增4倍,推理成本下降80%

2026年09月01日 20:15

作者:

叶健

K图 02513_0

  8月31日,大模型公司 智谱 发布2026年半年报。上半年, 智谱 营收近9.54亿元,同比增长399.7%,比2025年全年营收高出30%。其中,开放平台及API收入约8.25亿元,同比增长2735.7%,成为主要增长引擎。截至8月31日, 智谱 MaaS(模型即服务)平台Token(词元)调用量较年初增长超过40倍,同期API(应用程序编程接口)平均售价提高约101%。量价齐增之下,上半年智谱开放平台及API业务毛利率提升至24.6%,较2025年同期提升约25个百分点,较2025年全年提升约6个百分点,盈利能力持续改善。

  2026年上半年,随着智能体风靡全球,智谱的收入结构发生重大变化。智谱半年报显示,“按调用计费的开放平台与API服务收入占比由去年全年的26.3%升至86.5%,模型本地化部署收入由73.7%降至13.5%。”

  对此,智谱表示,“模型每完成一次能力跃迁,客户购买的东西就向结果靠近一步,本公司的收入结构随之改写一次。”

  在这背后,是用户数和调用量的双重增长。财报显示,截至8月31日,智谱MaaS平台用户数超过740万,较2026年初增长144%;付费日活用户数较年初增长603%。以收入计的前十大用户,日均调用量较年初增长98倍。

  由于GLM-5.3、GLM-5.3-Flash都是在8月份发布,智谱半年报中专门提及了两款大模型的客户拉动效果。数据显示,从6月30日到8月31日,智谱MaaS平台企业和开发者用户累计从580万增至740万,两个月用户数增长近27.6%。

  在业绩沟通会上,智谱披露了大客户梯队:按ARR年化贡献口径统计,年化贡献超10万美金的用户115个,超50万美金的25个,超100万美金的37个,超1000万美金的8个,超2500万美金的2个,超2.5亿美金的2个。

  对此,智谱董事会秘书肖磊表示,进入长程任务时代后,平台重度开发者用户的基数、使用深度、日均调用量均远超此前水平,高质量用户群体持续扩大。

  业绩快速增长背后,是大模型智能水平和性价比的同步攀升。2026年以来,智谱发布多款大模型,特别是经过后训练优化而性能大幅提升的GLM-5.3,以及匿名打榜夺冠的GLM-5.3-Flash,都在智能水平和性价比上表现不俗。

  智谱半年报显示,GLM系列在约11个月内完成六代迭代,智能指数由32提升至60,单任务成本稳定在0.2美元档;GLM-5.3-Flash以0.045美元的单任务成本,进入智能-成本前沿。

  在大模型性价比崛起的背后,智谱总结为“国芯推国模”,并且实现了多个“第一次”。半年报显示,“已实现10万级 国产芯片 的规模化低成本推理,单位Token推理成本较年初下降80%。”“GLM-5.3-Flash模型的推理是本公司第一次在超大规模真实流量中全面使用 国产芯片 集群提供服务;模型优化系统,系统承载模型,这个循环首次在本公司内部跑通。与同一硬件上的初始基线相比,端到端服务性能提升3倍;在编码场景下,单Token的 国产芯片 推理成本已达到与主流进口卡性价比相当的水平。国产芯片可以在大规模场景下经济地支撑前沿模型的推理。”

  后训练等技术的持续进步,保障了智谱大模型的智能水平和性价比的同步提升。智谱半年报中显示,今天决定一个模型上限的,是四个因素的组合:基座规模、有效深度、训练深度、任务环境。其中,训练深度是当前余量最大的一个,“这条曲线尚未见顶,公司将继续扩大长程任务的强化学习规模、延长有效训练轨迹、提高轨迹利用效率。”任务环境则被智谱视为新出现的变量,当算法与算力都不再是唯一瓶颈,环境的数量、类型与复杂度开始直接决定模型能学到什么,这也是智谱下一阶段投入最集中的方向。

  众多技术需求之下,研发投入仍是智谱的主要支出项。2026年上半年,智谱研发投入约21.31亿元,是同期营收的2.23倍。

  由于处在持续投入阶段,智谱的现金储备颇受关注。智谱半年报披露,截至6月30日,持有现金及现金等价物39.94亿元,较2025年底增加17.35亿元。值得关注的是,智谱增加的现金主要来自上市募集资金和 银行 贷款。而截至6月底,智谱贷款余额约22.25亿元,是2025年底的3.2倍,且均为无担保借贷。

  针对当前算力紧缺,肖磊表示,当前国内算力环境以异构算力为主,国产卡尚未进入大规模放量阶段。预计未来3到6个月,大量先进的国产卡厂商将迎来算力放量,届时异构算力变形的情况将得到大的改善。智谱在算力配置上,将优先保障关键训练窗口,不会因推理侧历史性的需求放量而倾斜所有资源。当前,新模型的训练相关工作已在推进中。

  关于智谱下一代大模型,在业绩沟通会上,智谱创始人唐杰表示,目前正在做下一代模型,这同样是一个很大的基座模型。“我们的基本思路是,每个基座模型都把它的能量放大到最大,让大家用得上。下一代模型我们已经开始预研它的推理,而且我们有信心,下一代大模型出来的第一天,就让大家满量地用上,而不是一个大而用不上的东西。”

(文章来源:经济参考网)

主题:新股|推理成本下降80%|基金|智谱|美股