智谱于 2026 年 8 月 14 日发布 GLM-5.3。模型已全量进入 GLM Coding Plan,并可在官方编程工具 ZCode 中使用。GLM-5.3 支持 1M Token 上下文和 128K Token 最大输出,定位于代码库级别的长程编程与多步工具调用任务。
GLM-5.3 已进入 Coding Plan 与 ZCode
GLM-5.3 已向 GLM Coding Plan 全量用户开放。Coding Plan 是智谱面向编程工具的订阅式入口,用户可以把套餐账号连接到支持的编程智能体,让模型读取项目、修改文件、运行命令并根据结果继续调整。
ZCode 是智谱的桌面端智能体开发环境,支持 macOS、Windows 和 Linux。GLM-5.3 已成为 ZCode 的当前模型选项。用户可以在同一任务中保留目标、文件、终端输出、浏览器上下文和 Git 状态,适合需要多轮修改和验证的工程任务。
同一基座模型,主要变化来自后训练
GLM-5.3 沿用 GLM-5.2 的基座模型,这次更新主要发生在后训练阶段。后训练是指基座模型完成大规模预训练后,再通过任务环境、反馈和强化学习调整它的行为。
训练任务覆盖从发现问题、制定方案到实施、验证和交付的完整流程。这类任务要求模型在较长时间内维持目标,根据命令输出、测试结果和项目状态反复修正方案。对使用者来说,它面向的不是单次生成一段代码,而是持续推进一项可执行、可检查的开发工作。
1M 上下文可容纳更大的项目信息
GLM-5.3 的上下文窗口为 1M Token,最大输出为 128K Token。Token 是模型读取和生成内容时使用的基本计量单位。1M 上下文让模型可以在一项任务中处理更多代码文件、工具结果和历史步骤,减少任务进行中频繁丢失早期信息的情况。
模型接收文本并输出文本,支持流式输出、结构化输出、函数调用和 MCP。MCP 可以理解为让模型连接外部工具与数据的通用协议。这些能力可用于读取工程环境、调用开发工具,以及把输出交给其他系统继续处理。
用户可按任务选择思考强度
GLM-5.3 提供 low、high 和 max 三个思考强度,不提供关闭思考的选项。对小范围修改、代码解释和快速查找问题,可以先使用较低档位;对跨文件重构、多步调试或长时间执行的任务,可以选择更高档位。
思考档位影响模型处理任务的深度和 Token 消耗。在实际项目中,可以先用小任务测试模型对代码库和工具的兼容性,再把已经明确验收条件的长任务交给高档位执行。无论使用哪个档位,结果都应通过测试、构建或实际输出验收,不应只以模型的文字说明作为完成依据。


