>> 交银国际-智谱(2513.HK)公司追踪:最新旗舰模型GLM~5.3发布——后训练深度优化,编程商业化能力提升-260817
| 上传日期: |
2026/8/17 |
大小: |
555KB |
| 格式: |
pdf 共4页 |
来源: |
交银国际 |
| 评级: |
-- |
作者: |
郑民康 |
| 下载权限: |
无限制-登录即可下载 |
|
|
迭代模型向后训练倾斜是创新举措:8月14日智谱(2513 HK/未评级)发布最新旗舰模型GLM-5.3。我们认为,关键变化在于后训练深度优化对大模型研发的重要性正逐步增强。在沿用前代753B总参/40B激活MoE架构(基座权重未变)的前提下,GLM-5.3开发团队依托SAO及slime等自研算法,通过增加环境数据,实现模型能力的显著提升。 推理效率改善,复杂任务执行能力增强:核心能力指标方面,GLM-5.3的推理效率与任务执行能力有实质性改善。在最高算力投入(Max effort)下,任务完成率从23.4%升至34.5%,同时输出Token消耗从96K降至75K,降幅约22%。显示新模型思维链的精准度有所优化,并在特定Agentic基准检验中超越头部闭源模型。此外,在网络安全等高复杂度垂直场景,模型在深度漏洞利用(ExploitBench)中的得分从24.4%提升至54.4%。我们认为,以上复杂规划能力的增强,是高质量场景数据与SAO协同作用的结果。 工作流向自动化演进,用户可更好把控成本。在商业化落地层面,我们认为GLM-5.3模型对自建的ZCode平台有更好的配合。API层面可按工作需求量调节(Low/High/Max mode),同时新推出“目标驱动”功能(Goal Mode),使用户可转向最终结果验收。上述特性有望优化企业部署AI Agent的总体拥有成本(TCO),实际降本效果仍需视用户具体任务负载而定。我们认为,公司持续优化编程体验,有望显著利好其经常性收入(ARR )的增长。 市场对智谱模型迭代发展的看法不一。GLM-5.3发布后公司股价尚未出现正面反应。我们认为这可能是因为市场仍对迭代模型提升到万亿级参数有较高期望。同时,海外用户早前曾在社交媒体“X”平台就“智谱下一轮迭代的新增功能”发起相关讨论,其中对视觉功能诉求较高,其次为Agentic工作长度和强度提升/专业编程。若仅以“X”平台讨论结果为参考,GLM-5.3的功能迭代达到海外用户满足度约60-65%,其中编程与Agentic能力大幅提升(Terminal-Bench 3.0升至28.3,DeepSWE达66.9),Token在可调节机制下效率更优,同时网安能力达到行业领先(SOTA)水平,应是令用户有较好体验的环节。 榜单更新及中报或为短期焦点。我们认为,短期可关注Artifical Analysis 和Arena.ai榜单对GLM-5.3 的更新,若更新排名应能对GLM-5.3模型能力的提升有较好反映。同时,公司于8月底公布中期业绩,届时有望对目前ARR的增速及年底ARR目标的提升展开进一步讨论。
|
|