20260817-交银国际证券-智谱-02513.HK-公司追踪_最新旗舰模型GLM-5.3发布——后训练深度优化_编程商业化能力提升_4页_556kb
报告摘要
智谱 (2513 HK) 旗舰模型 GLM-5.3 发布总结
核心内容概述
2026年8月14日,智谱(2513 HK)发布了其最新旗舰模型 GLM-5.3,标志着公司在大模型研发领域的重要进展。此次发布聚焦于模型的后训练深度优化,旨在提升模型在复杂任务和编程场景中的表现,同时增强其商业化落地能力。
主要观点
模型迭代与优化
- 后训练深度优化:GLM-5.3 的核心创新在于对模型进行后训练深度优化,结合自研算法 SAO 和 slime,通过引入更多环境数据,显著提升了模型性能。
- 架构沿用:模型基于前代 GLM-5.2 的 753B 总参 / 40B 激活 MoE 架构,基座权重保持不变,优化集中在模型微调和推理机制上。
- 性能提升:
- 推理效率:在 Max effort 模式下,任务完成率从 $23.4%$ 提升至 $34.5%$,Token 消耗量减少约 $22%$。
- 复杂任务执行能力:在 Agentic 基准测试中,模型表现优于头部闭源模型。特别是在网络安全领域,ExploitBench 得分从 $24.4%$ 提升至 $54.4%$,达到行业领先水平(SOTA)。
商业化能力提升
- ZCode 平台兼容性增强:GLM-5.3 与智谱自建的 ZCode 平台更加契合,支持 API 模式调节(Low/High/Max mode),便于企业根据实际需求调整资源使用。
- 目标驱动功能:新推出的 Goal Mode 功能,让用户能够以最终结果为导向,提升 AI Agent 的使用效率和控制能力。
- 成本优化:上述功能优化有助于降低企业部署 AI Agent 的总体拥有成本(TCO),推动经常性收入(ARR)增长。
关键信息
技术亮点
- GDPval-AA v2:模型在真实世界长程任务中的表现有明显提升。
- DeepSWE:在代码工程导向的 Agentic 编程中,模型准确度显著提高。
- Terminal-Bench v3.0:终端 Agentic 编程能力提升,达到 28.3 分。
- Automation Bench:项目完成程度提升,显示模型在自动化任务中的能力增强。
市场反应
- 股价表现:GLM-5.3 发布后,公司股价尚未出现明显上涨,可能与市场对模型参数规模提升的期待有关。
- 用户反馈:海外用户在社交媒体“X”平台对 GLM-5.3 的功能迭代表现出较高兴趣,其中对视觉功能、Agentic 工作长度和强度提升、专业编程能力的诉求较高。
- 功能满足度:根据“X”平台讨论结果,GLM-5.3 功能迭代满足海外用户需求约 60-65%,尤其在编程与 Agentic 能力方面提升显著。
短期关注点
- 榜单更新:关注 Artificial Analysis 和 Arena.ai 榜单对 GLM-5.3 的排名更新,以评估模型能力的市场认可度。
- 中报发布:公司计划于 8 月底公布中期业绩,届时将披露 ARR 增速及年底 ARR 目标的情况。
评级与披露
- 评级定义:分析员对个股的评级包括买入、中性、沽出和无评级,对行业评级则为领先、同步和落后。
- 利益冲突声明:分析员及关联方在报告发布前 30 天内未交易所评论的公司证券,且无财务利益关联。
- 业务关系披露:交银国际证券及其关联公司与多家企业存在投资银行业务关系,包括智谱华章科技等。
- 免责声明:本报告内容基于交银国际证券认为可靠的信息来源,不构成投资建议,且不保证其准确性、完整性或可靠性。
结论
GLM-5.3 的发布展示了智谱在大模型优化与商业化应用方面的持续进步。其在推理效率、复杂任务执行及编程能力上的提升,有助于增强用户对 AI Agent 的使用体验,并可能推动公司 ARR 增长。短期内,榜单更新和中报发布将成为市场关注的焦点。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载