智谱发布GLM-5.3 强化编程能力并两周后开放权重
智谱8月14日发布GLM-5.3,基座模型未变,主要依靠后训练Scaling提升智能上界。官方称内部编程评测较GLM-5.2提升50%,并在TerminalBench3.0、Agents'LastExam(CLI)...
智谱于8月14日正式发布GLM-5.3。与GLM-5.2相比,这次升级没有更换基座模型,变化主要来自后训练阶段。官方将其称为“极致的后训练Scaling”,目标是提高模型的智能上界。
编程能力是本次发布强调的重点。智谱称在内部自建体感评测中,GLM-5.3较GLM-5.2提升50%;在包括TerminalBench3.0、Agents'LastExam(CLI)在内的公开基准测试中取得开源第一。需要注意,50%提升来自内部评测,具体方法和样本尚未披露,公开基准成绩更适合作为选型参考,而不是直接等同于生产环境收益。
对工程团队来说,如果业务涉及代码生成、终端命令执行或命令行工具调用,可以优先把GLM-5.3纳入重新评测。由于公开基准只反映特定测试维度,团队应结合自有任务和现有基线进行验证,权重开放后再做复现,确认实际收益。
智谱表示将在发布两周后开放模型权重。目前下载渠道、许可证、参数规模、上下文长度和硬件要求均未披露。团队可以利用这段时间准备下载、硬件适配和许可证审核;若现有部署流程基于GLM-5.2,基座未变意味着架构层面可能无需大幅调整,但仍需验证推理性能与行为变化。
整体看,这次变化集中在后训练阶段,说明模型能力提升并不一定依赖扩大或更换基座。对于依赖GLM系列的项目,这次发布更像一次针对性升级,重点是编程和CLI相关场景。具体效果仍需权重开放后验证。





