ChinaModelAPI
更新 · 2026-08-28

GLM-5.3 已成为开源权重旗舰:权重已于 8 月 28 日登陆 Hugging Face(zai-org/GLM-5.3,自定义协议)。API 自 8 月 19 日起 GA —— 每 1M tokens 输入 $1.40 / 输出 $4.40(缓存 $0.26),并已于 8 月 18 日登陆 OpenRouter;Artificial Analysis 指数 60(排名 8/182)。API 破坏性变更:thinking.type: "disabled" 不再受支持且会导致调用失败。ChinaModelAPI 中继上 glm-5.2 / glm-5.1 继续保持可解析,glm-5.3 ID 将在完成健康检查后上线。阅读发布简报 →

更新于 2026-08-31 · 指南

GLM-5.3 API —— 智谱旗舰快速上手

GLM-5.3 是智谱 AI / Z.ai 当前的长程编码与 Agent旗舰 —— 与 GLM-5.2 采用相同基座,经后训练 Scaling 获得全面提升(Terminal-Bench 3.0 从 4.6 跃升至 28.3),具备扎实的 1M token 上下文,权重自 8 月 28 日起在 Hugging Face 开放。ChinaModelAPI 上 glm-5.2 / glm-5.1 ID 在向 glm-5.3 中继 ID 过渡期间继续可解析

直接解答(2026 年 8 月)

智谱当前旗舰 = GLM-5.3(2026 年 8 月 14 日发布 —— 与 GLM-5.2 采用相同基座,全部提升来自后训练阶段的 scaling;Terminal-Bench 3.0 从 4.6 跃升至 28.3,CyberGym 84.5%)。Z.ai 已于 8 月 19 日 GA API,定价 每 1M tokens $1.40 / $4.40(缓存 $0.26),并于 8 月 28 日公开开源权重(zai-org/GLM-5.3,自定义协议)。ChinaModelAPI 目标模型 ID:glm-5.3https://api.chinamodelapi.com/v1),中继健康检查完成后即上线 —— 过渡期 glm-5.2 / glm-5.1 继续可解析,请在控制台确认实时别名。官方产品入口:z.ai / chat.z.ai。同期新发布:GLM-5.3-Flash —— 开源权重,价格约为旗舰的 1/10。

来源:Z.ai 官方博客《GLM-5.3》(2026-08-14);Z.ai 官方博客《GLM-5.2: Built for Long-Horizon Tasks》(2026-06-16);zai-org/GLM-5.3 Hugging Face 权重发布(2026-08-28)。

相较早期 GLM 系列的变化

  • GLM-5.3 —— 当前旗舰(2026 年 8 月 14 日):与 5.2 采用相同基座,所有提升均来自后训练 Scaling;Terminal-Bench 3.0 得分 4.6→28.3,CyberGym 84.5%;权重自 8 月 28 日起开放(自定义协议);同系 GLM-5.3-Flash 以约 1/10 价格开放权重
  • GLM-5.2 —— 开源权重、长程软件工程(SWE)与 Agent,约 1M 上下文,MIT 协议权重;ChinaModelAPI 上持续可解析的生产模型 ID
  • GLM-5.1 —— 之前的 5.x 版本(仍适用于成本/延迟 A/B 测试)
  • 早期营销型号如 GLM-4.5 / 4-Plus 的“最新”定位已被取代 —— 在产品文案中建议优先使用 5.x 系列(当前旗舰:GLM-5.3)

核心优势

  • 长流程多步编程循环 / Harness 风格 Agent(Terminal-Bench 3.0 得分 28.3)
  • 涌现网络安全能力(CyberGym 84.5%)—— 请负责任地使用
  • 具备竞争力的前沿开源权重质量,成本低于美国闭源 API
  • 数据必须保留在本地时的私有化自建部署选项(自定义 glm-5.3 协议)
  • 中英双语产品体验依旧出色

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="glm-5.3",
    messages=[
        {"role": "system", "content": "You are a senior software engineer. Plan then implement."},
        {"role": "user", "content": "Add retry + timeout to this HTTP client and write tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.CHINAMODELAPI_KEY,
  baseURL: "https://api.chinamodelapi.com/v1",
});
const resp = await client.chat.completions.create({
  model: "glm-5.3",
  messages: [{ role: "user", content: "Refactor this service for idempotent webhooks." }],
});
console.log(resp.choices[0].message.content);

路由建议

生产环境的编程/Agent 流量建议默认路由至 glm-5.3(中继 ID 健康检查完成后生效 —— 过渡期 glm-5.2 / glm-5.1 继续可解析;请在控制台确认实时别名)。短文本批量分类可使用 GLM-5.3-Flash 等更低成本档位。针对超长多文档包,也可评估 Kimi K3

FAQ

最新版 GLM 还是 4.5 吗?

不是。智谱当前旗舰为 GLM-5.3(继 GLM-5.2 / 5 / 5.1 之后于 2026 年 8 月 14 日发布)。Z.ai 已于 8 月 19 日全面开放(GA)5.3 API,并于 8 月 28 日公开开源权重;在 ChinaModelAPI 上,glm-5.2 / glm-5.1 继续保持可解析,glm-5.3 中继 ID 将在完成健康检查后上线。

GLM-5.3 开源吗?

是 —— 智谱已于 2026 年 8 月 28 日在 Hugging Face 公开权重(zai-org/GLM-5.3),采用自定义 glm-5.3 协议(GLM-5.2 为 MIT);而通过 ChinaModelAPI 等兼容 OpenAI 的网关调用云端 API 依然是最便捷的路径。

上下文窗口?

GLM-5.3 官方标称具备扎实的 1M token 上下文,专为长程任务打造。具体实时限制请在服务商控制台中确认。

GLM-5.3 对比 Kimi K3?

两者均为 2026 年中国前沿大模型系列。GLM-5.3 是经后训练 Scaling 强化、面向编程与 Agent 的旗舰;Kimi K3 则是月之暗面(Moonshot)推出的 2.8T 参数级、1M 上下文多模态旗舰。建议在您的评测集上进行基准测试。

相关指南