GLM-5.3 API正式上线,人工分析得分60,开放权重计划于8月28日发布
智谱AI已正式开放 GLM-5.3 API。该模型面向复杂编程、长周期智能体任务和网络安全工作负载,人工分析评分达到 60 分;官方同时宣布,开放权重版本计划于 8 月 28 日发布。

GLM-5.3 API 上线,人工分析评分60分,开源权重计划于8月28日发布
引言
智谱AI已正式开放其最新旗舰模型 GLM-5.3 的API访问权限,该模型面向复杂编程、长周期智能体任务及网络安全相关工作负载。
8月19日的公告将该模型直接纳入Z.AI生产级API栈和GLM编程计划。在当前的 人工分析智能指数 上,GLM-5.3(max)得分为 60,与多款领先专有模型处于同一前沿区间,并在该指数上与 Kimi K3(max) 持平。

截至本文撰写时,该模型尚未开放权重。智谱在8月19日的公告(多家中国科技及财经媒体转载)中表示,权重计划于 2026年8月28日(星期五) 发布。
GLM-5.3 在人工分析智能指数上达到60分
AIBase报告中最引人注目的数字是 60分的人工分析智能指数评分。
人工分析目前将 GLM-5.3(max)列为60分,与 Kimi K3(max) 的评分相同。该结果使GLM-5.3在当前对比模型中处于最强之列,但单一综合指数不应被视为两款模型在每项工作负载上表现完全相同的证据。
一个有用的概览如下:
| 模型 | 人工分析智能指数 |
|---|---|
| GLM-5.3(max) | 60 |
| Kimi K3(max) | 60 |
| Claude Fable 5,特定高端配置 | 在当前人工分析对比中高于60 |
| GLM-5.2(max) | 53 |
重要的代际变化在于从GLM-5.2到GLM-5.3的跃升,同时保持了相同的底层基础模型。
主要改进来自后训练阶段
Z.AI表示 GLM-5.3使用与GLM-5.2相同的基础模型。性能提升来自额外的后训练,而非全新训练的基础模型。
官方文档重点强调了三个领域的改进,与AIBase原始文章一致:
- 复杂软件工程
- 防御性网络安全与漏洞分析
- 长周期智能体任务
在Z.AI自家的Code Bench中,公司报告相较GLM-5.2约有 50%的性能提升。公开基准测试结果也显示,在终端操作类和长时运行的软件工程任务上有显著提升。
例如,Z.AI报告GLM-5.3在 Terminal-Bench 3.0 上从 4.6提升至28.3,在 DeepSWE v1.1 上从 46.2提升至66.9,均与GLM-5.2相比。
这些数据是厂商公布的基准测试结果,应在此背景下理解。
网络安全性能同样大幅提升
Z.AI表示,额外的后训练在训练规模扩大时意外地产生了更强的网络安全能力。
在公司发布的评估集上,GLM-5.3在 CyberGym上达到84.5%,而 GLM-5.2为77.2%。公司还报告在ExploitBench和ExploitGym等更深入的利用导向基准上取得了更大的提升。
这一趋势值得注意,因为随着任务难度增加,GLM-5.3的提升幅度变得更大
从识别漏洞转向推理更长的利用链。
与此同时,Z.AI 自身的基准测试表显示,部分闭源前沿模型在更困难的利用类评估中仍然领先。因此,正确的结论并非 GLM-5.3 在所有安全基准上都占据主导,而是其后训练带来了跨代际的实质性提升。
GLM-5.3 推动智能-成本前沿
原始报告中的第二张图表关注的是价格而非原始基准排名。

Artificial Analysis 目前列出的 Z.AI 第一方 API 价格为:
| Token 类型 | GLM-5.3 每百万 Token 价格 |
|---|---|
| 输入 | $1.40 |
| 缓存输入 | $0.26 |
| 输出 | $4.40 |
这些价格与 GLM-5.2 当前的官方定价完全相同。
Artificial Analysis 按其 7:2:1 的缓存输入/输入/输出比例计算出约 $0.90/百万 Token 的混合价格。同时,其报告显示 GLM-5.3 在其智能指数上的评估成本约为 $1,238.50。
因此,成本图表支持原文的核心观点:GLM-5.3 将前沿级别的综合得分与相对较低的 API 定价结合在一起。
这并不意味着每个生产任务都会更便宜。实际成本取决于输出长度、缓存率、提示词大小、推理强度、工具调用次数以及所需的智能体交互轮数。
API 定价与 GLM-5.2 保持一致
Z.AI 的官方定价页面确认,GLM-5.3 和 GLM-5.2 目前使用相同的 Token 费率。
这一点意义重大,因为该模型在未提高标价 API 价格的情况下增加了大量能力。
对于已经在使用 GLM-5.2 的团队而言,迁移决策因此主要关乎行为和兼容性,而非新的 Token 成本层级。
开发者在切换生产流量之前仍应运行回归测试,因为 GLM-5.3 改变了多项模型行为和参数。
GLM-5.3 使用强制推理
其中一个差异是推理配置。
GLM-5.3 始终启用思考功能,并支持三个推理强度级别:
lowhighmax
默认值为 max。
Z.AI 警告,使用以下旧配置的应用在直接迁移到 GLM-5.3 时会失败:
{
"thinking": {
"type": "disabled"
}
}
对于 GLM-5.3,思考功能必须保持启用。对于复杂的编程工作,Z.AI 推荐使用最深的推理强度级别:
{
"model": "glm-5.3",
"thinking": {
"type": "enabled"
},
"reasoning_effort": "max"
}
这是官方配置示例,而非来自简短的 AIBase 来源的片段;此处包含它是因为它直接影响从 GLM-5.2 迁移的开发者。
上下文窗口与输出长度
官方模型文档列出:
| 规格 | GLM-5.3 |
|---|---|
| 输入模态 | 文本 |
| 输出模态 | 文本 |
| 上下文窗口 | 1,000,000 Token |
| 最大输出 | 128K Token |
| 推理 | 始终启用 |
| 推理强度 | low / high / max |
GLM-5.3 还支持函数调用、结构化输出、流式响应、上下文缓存和流式工具调用。
该模型目前仅支持文本,因此需要直接图像理解能力的开发者需要使用单独的视觉模型或工作流程。
GLM-5.3 现已可用在 ZCode 和 GLM 编程套餐中
AIBase 文章指出,GLM-5.3 已集成到 ZCode 和 GLM 编程套餐中。
这一点得到了 Z.AI 当前产品文档的确认。
ZCode 将其描述为一个基于 GLM-5.3 构建的智能体开发环境,用于规划、编码、审查、调试、测试和长期项目工作。其工作流程旨在将项目文件、终端输出、浏览器上下文、执行状态和 Git 变更保持在同一个持续任务中。
GLM 编程套餐也将 GLM-5.3 列为受支持的模型。当前套餐使用基于点数的配额系统,非高峰时段——包括周末——消耗更少的点数。
Z.AI 还通过多种 API 协议支持 GLM-5.3,包括兼容 OpenAI 的 Chat Completions、OpenAI Responses 和 Anthropic Messages 端点,具体受 Z.AI 文档中列出的套餐和账户限制约束。
一个最小化的 GLM-5.3 API 调用
对于希望直接测试新开放 API 的开发者,Z.AI 官方文档使用的模型标识符为:
glm-5.3
一个基本的 cURL 请求遵循与 Z.AI 文档记录的 Chat Completions 接口相同的结构:
curl -X POST "https://api.z.ai/api/paas/v4/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer your-api-key" \
-d '{
"model": "glm-5.3",
"messages": [
{
"role": "user",
"content": "审查此项目架构,并识别风险最高的工程瓶颈。"
}
],
"thinking": {
"type": "enabled"
},
"reasoning_effort": "max"
}'
上述端点和模型配置遵循 Z.AI 当前官方文档。使用编程套餐的开发者应检查其单独的端点规则,因为订阅流量和标准 API 计费并不总是可以互换的。
权重计划于 8 月 28 日发布
原文的最后一个要点是开放权重发布。
8 月 19 日,与智谱相关的公告称 GLM-5.3 权重将于下周五开放,对应 2026 年 8 月 28 日。
在本 Markdown 文件编写时,该日期尚未到来。Artificial Analysis 仍将 GLM-5.3 归类为专有模型,因为可下载的模型权重尚未公开。
因此,最准确的表述是:
智谱已宣布计划于 2026 年 8 月 28 日发布 GLM-5.3 模型权重,但截至撰写本文时,权重尚未公开可用。
一旦权重实际发布,开发者应核实官方仓库、模型卡、许可证、参数数量、支持的推理框架和部署要求,之后才能将该发布视为可自行部署。
常见问题
什么是 GLM-5.3?
GLM-5.3 是智谱 AI / Z.AI 最新的旗舰文本模型,用于
复杂的软件工程、智能体任务、推理以及网络安全相关工作。它使用与GLM-5.2相同的基础模型,主要能力提升来自额外的后训练。
GLM-5.3 在 Artificial Analysis 上获得多少分?
Artificial Analysis 目前在智能指数上给 GLM-5.3(max)打出了 60 分。在当前对比中,Kimi K3(max)同样获得 60 分,不过在各项基准测试和工作负载中,模型行为存在显著差异。
GLM-5.3 API 的费用是多少?
Z.AI 目前的收费标准为每百万输入 token $1.40,每百万缓存输入 token $0.26,每百万输出 token $4.40。这些费率与官方 GLM-5.2 定价相同。
GLM-5.3 是否支持 100 万 token 的上下文窗口?
支持。Z.AI 官方文档列出 GLM-5.3 的上下文窗口为 1,000,000 token,最大输出长度为 128K token。
GLM-5.3 中能否禁用推理功能?
不能。GLM-5.3 要求必须保持思考开启。开发者可以通过 reasoning_effort 参数控制推理深度,可选值为 low、high 或 max,默认值为 max。
GLM-5.3 是否已开源或开放权重?
截至撰写本文时尚未开放。智谱已宣布计划于 2026 年 8 月 28 日 发布权重,但公开的权重包和最终许可证仍需在发布后确认。
GLM-5.3 能否用于编码智能体?
可以。Z.AI 已将模型集成到 ZCode 和 GLM Coding Plan 中,其文档列出了与多种智能体编码工具和 API 协议的兼容性。
GLM-5.3 是否支持多模态?
当前 GLM-5.3 API 文档仅列出文本输入和文本输出。其当前形式不是直接的图像输入模型。
相关工具
- ZCode:Z.AI 的智能体开发环境,围绕 GLM-5.3 设计,用于长时间运行的编码和项目工作流。
- Z.AI API 平台:访问 GLM 模型、API 密钥、计费和开发者服务的官方平台。
- GLM Coding Plan:Z.AI 的订阅计划,用于在受支持的编码智能体工具中使用 GLM 模型。
- Artificial Analysis:涵盖 GLM-5.3 智能、定价、速度和上下文大小的独立模型分析。
- Z.AI 开发者文档:官方 API、模型、迁移、定价和集成文档。
相关链接
- GLM-5.3 官方模型文档:官方规格、能力、推理设置、端点、基准测试和快速入门示例。
- GLM-5.3 官方发布博客:Z.AI 关于编码、长时程智能体和新兴网络安全性能的发布文章。
- Z.AI 定价:GLM-5.3、GLM-5.2 以及其他 Z.AI 模型的官方 token 定价。
- 迁移至 GLM-5.3:涵盖模型 ID、强制思考、推理力度、流式输出和工具调用的官方迁移检查清单。
- [ZCode 文档](https://zcode.z.
ai/en/docs/welcome):在ZCode的智能体开发工作流中使用GLM-5.3的官方指南。
- GLM编程计划FAQ:关于支持的模型、配额行为、端点和计划限制的官方信息。
- Artificial Analysis GLM-5.3:GLM-5.3(最大版)当前独立的基准测试和价格分析。
摘要
GLM-5.3现已通过Z.AI的API和编程生态系统提供。其当前Artificial Analysis智能指数的得分为60,而Z.AI表示,最大的代际提升来自专注于复杂编码、长周期智能体和网络安全任务的训练后优化。
该模型保持了GLM-5.2的API定价,同时增加了100万Token的上下文窗口、最高128K的输出,以及具有可调节推理力度级别的强制推理功能。它已经集成到ZCode和GLM编程计划中。
智谱还宣布,GLM-5.3的权重计划于2026年8月28日发布。在实际的代码仓库和许可证发布之前,它仍应被描述为可通过API访问、并计划随后开放权重发布的模型,而非已可直接下载的开放模型。
关键变化简单明了:GLM-5.3在不提高GLM-5.2主API价格的情况下提升了能力,同时计划随后公开权重发布。