智谱(02513.HK):后训练SCALING 驱动GLM-5.3能力实现跃迁

昨天 00:02

机构:国盛证券
研究员:夏君/刘玲/孙行臻/焦安东

  事件:智谱发布GLM-5.3 模型。智谱发布新一代旗舰模型GLM-5.3,基座与GLM-5.2 保持一致,但通过扩大后训练规模实现能力跃迁。长程任务训练环境规模提升至此前的数十倍,并进一步增加训练环境的复杂度与多样性。编程体感较前代提升50%,并在Terminal Bench 3.0 等公开基准中位列开源模型第一;同时涌现出强大的网络安全能力,在白盒代码审查、漏洞发现等任务中的表现接近Mythos 5。在AA 综合智能指数中,GLM-5.3 与Kimi K3 并列开源第一,但完成单任务的效率更优。价格方面,每百万Token 的输入输出价格分别为8/28 元,与GLM-5.2 保持一致。
  从GLM-5.2 到GLM-5.3,后训练Scaling 成为模型能力提升的重要路径。GLM-5.3 的核心变化集中于后训练阶段,公司将训练任务由相对独立的编程问题进一步扩展至真实专家的完整专业工作单元。环境覆盖了更广泛的生产级工作流,任务设计也更加贴近工程与研究工作的实际开展方式。我们认为,GLM-5.3 验证了模型后训练的Scaling 仍具较大空间,真实环境数量、任务复杂度等有望成为未来提升Agent 能力的重要抓手。
  在网络安全领域,模型能力出现明显涌现。随着真实任务环境持续扩展,GLM-5.3 涌现出较强的网络安全能力。在白盒漏洞发现评测CyberGym 中得分84.5%,高于Mythos 5 的83.8%和GPT-5.6 Sol 的83.6%;在考验深度推理能力的ExploitBench 中,GLM-5.3 得分为54.4%,是GLM-5.2 的两倍多。在限定时间内完成漏洞利用任务的 ExploitGym 上,G在LM-5.3两小时内完成105 项任务,六小时内完成130 项,相对于GLM-5.2 分别完成29 项和39 项提升显著。
  模型与Agent Harness 同步迭代,ZCode 进一步承接GLM-5.3 长程执行能力。GLM-5.3 已全量上线GLM Coding Plan 及ZCode,ZCode 围绕GLM-5.3 进行深度适配,可在同一任务中持续保留目标、文件、终端结果、浏览器上下文、Git 状态等,搭建完整工作流。我们认为,随着模型长程执行能力提升,Agent 产品的竞争重点将由单轮Coding 能力转向“模型+Harness+工具+上下文管理”的系统能力,ZCode 有望成为智谱承接模型能力并推动用户使用量增长的重要产品入口。
  维持““买入”评级。我们持续看好智谱GLM 系列模型的迭代,搭配ZCode有望进一步加速ARR 的增长,预计公司2026-2028 年收入为37、89、183亿元,同比增长415%、138%、107%;non-GAAP 归母净亏损为38、28、4 亿元。维持“买入”评级。
  风险提示:模型迭代不及预期的风险、行业竞争激烈的风险、盈利改善不及预期的风险等。
相关股票

HK 智谱

格隆汇声明:文中观点均来自原作者,不代表格隆汇观点及立场。特别提醒,投资决策需建立在独立思考之上,本文内容仅供参考,不作为实际操作建议,交易风险自担。

10
商务、渠道、广告合作/招聘立即咨询