ChinaModelAPI
Atualização · 2026-08-28

O GLM-5.3 é agora o flagship de pesos abertos: os pesos chegaram ao Hugging Face em 28 de ago (zai-org/GLM-5.3, licença personalizada). API em GA desde 19 de ago — $1.40 de entrada / $4.40 de saída por 1M de tokens ($0.26 em cache), disponível no OpenRouter desde 18 de ago; índice Artificial Analysis 60 (posição 8/182). Breaking change da API: thinking.type: "disabled" não é mais suportado e falhará. No relay da ChinaModelAPI, glm-5.2 / glm-5.1 continuam resolvendo enquanto o ID glm-5.3 conclui o health-check. Leia o brief de lançamento →

Atualizado em 2026-08-31 · Guia

API do GLM-5.3 — Guia Rápido do Flagship da Zhipu

O GLM-5.3 é o flagship atual da Zhipu AI / Z.ai para programação e agentes de longo prazo — mesma base do GLM-5.2, com ganhos abrangentes do escalonamento pós-treinamento (Terminal-Bench 3.0 de 4.6 para 28.3), um contexto sólido de 1M tokens e pesos abertos no Hugging Face desde 28 de ago. Na ChinaModelAPI, os IDs glm-5.2 / glm-5.1 continuam resolvendo durante a transição para o ID de relay glm-5.3.

Resposta direta (agosto de 2026)

Flagship atual da Zhipu = GLM-5.3 (lançado em 14 de ago de 2026 — mesma base do GLM-5.2, todos os ganhos provenientes de escalonamento pós-treinamento; Terminal-Bench 3.0 de 4.6 para 28.3, CyberGym 84.5%). A Z.ai disponibilizou a API em GA em 19 de ago a $1.40 / $4.40 por 1M de tokens ($0.26 em cache) e publicou os pesos abertos em 28 de ago (zai-org/GLM-5.3, licença personalizada). ID alvo via ChinaModelAPI: glm-5.3 em https://api.chinamodelapi.com/v1, ativo assim que o health-check do relay for concluído — até lá, glm-5.2 / glm-5.1 continuam resolvendo; confirme o alias ativo no seu painel. Interface oficial do produto: z.ai / chat.z.ai. Também novo: GLM-5.3-Flash — pesos abertos por ~1/10 do preço do flagship.

Fontes: blog da Z.ai “GLM-5.3” (2026-08-14); blog da Z.ai “GLM-5.2: Built for Long-Horizon Tasks” (2026-06-16); lançamento dos pesos zai-org/GLM-5.3 no Hugging Face (2026-08-28).

O que mudou em relação às linhas GLM anteriores

  • GLM-5.3 — flagship atual (14 de ago de 2026): mesma base do 5.2, todos os ganhos provenientes de escalonamento pós-treinamento; Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%; pesos abertos desde 28 de ago (licença personalizada); o irmão GLM-5.3-Flash publica pesos abertos a ~1/10 do preço
  • GLM-5.2 — pesos abertos para SWE & agentes de longo prazo, contexto de ~1M, pesos MIT; o ID de produção na ChinaModelAPI que continua resolvendo hoje
  • GLM-5.1 — versão 5.x anterior (ainda útil para testes A/B de custo/latência)
  • Nomenclaturas de marketing mais antigas como GLM-4.5 / 4-Plus foram substituídas no posicionamento de "mais recente" — dê preferência à linha 5.x (flagship atual: GLM-5.3) nos textos do produto

Pontos fortes

  • Loops longos de programação multi-etapas / agentes estilo harness (Terminal-Bench 3.0: 28.3)
  • Capacidades emergentes de segurança cibernética (CyberGym 84.5%) — use com responsabilidade
  • Qualidade frontier de pesos abertos competitiva, mais barata que as APIs fechadas dos EUA
  • Opção de self-host quando os dados precisam ficar on-premise (licença glm-5.3 personalizada)
  • A UX de produto bilíngue ZH/EN continua forte

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="glm-5.3",
    messages=[
        {"role": "system", "content": "You are a senior software engineer. Plan then implement."},
        {"role": "user", "content": "Add retry + timeout to this HTTP client and write tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.CHINAMODELAPI_KEY,
  baseURL: "https://api.chinamodelapi.com/v1",
});
const resp = await client.chat.completions.create({
  model: "glm-5.3",
  messages: [{ role: "user", content: "Refactor this service for idempotent webhooks." }],
});
console.log(resp.choices[0].message.content);

Dica de roteamento

Direcione o tráfego de produção de código/agentes por padrão para o glm-5.3 assim que o ID de relay concluir o health-check — até lá, glm-5.2 / glm-5.1 continuam resolvendo; confirme os alias ativos no seu painel. Mantenha classificações curtas em lote em IDs mais baratos, como a camada GLM-5.3-Flash. Para pacotes extremos de múltiplos documentos, avalie também o Kimi K3.

FAQ

O GLM mais recente ainda é o 4.5?

Não. O flagship atual da Zhipu é o GLM-5.3 (lançado em 14 de ago de 2026, após o GLM-5.2 / 5 / 5.1). A Z.ai disponibilizou a API do 5.3 em GA em 19 de ago e publicou os pesos abertos em 28 de ago; via ChinaModelAPI, glm-5.2 / glm-5.1 continuam resolvendo enquanto o ID de relay glm-5.3 conclui o health-check.

O GLM-5.3 é de código aberto?

Sim — a Zhipu publicou pesos abertos no Hugging Face (zai-org/GLM-5.3) em 28 de ago de 2026 sob uma licença glm-5.3 personalizada (o GLM-5.2 era MIT); a API em nuvem continua sendo o caminho mais prático por meio de gateways compatíveis com OpenAI como o ChinaModelAPI.

Janela de contexto?

O GLM-5.3 é comercializado com um contexto sólido de 1M tokens para trabalhos de longo prazo. Confirme os limites em tempo real no painel do seu provedor.

GLM-5.3 vs Kimi K3?

Ambos são linhas frontier chinesas de 2026. O GLM-5.3 é o flagship de código/agentes reforçado por pós-treinamento; o Kimi K3 é o flagship multimodal de classe 2.8T e contexto 1M da Moonshot. Faça benchmark no seu próprio conjunto de avaliação.

Guias Relacionados