ChinaModelAPI
Actualización · 2026-08-28

GLM-5.3 es ya el modelo insignia de pesos abiertos: los pesos llegaron a Hugging Face el 28 de ago (zai-org/GLM-5.3, licencia personalizada). API en GA desde el 19 de ago — $1.40 de entrada / $4.40 de salida por 1M de tokens ($0.26 en caché), disponible en OpenRouter desde el 18 de ago; índice de Artificial Analysis de 60 (puesto 8/182). Cambio rupturista de la API: thinking.type: "disabled" ya no está soportado y fallará. En el relé de ChinaModelAPI, glm-5.2 / glm-5.1 siguen resolviendo mientras el ID glm-5.3 completa su comprobación de estado. Lee el informe de lanzamiento →

Actualizado 2026-08-31 · Guía

API de GLM-5.3 — Inicio rápido del modelo insignia de Zhipu

GLM-5.3 es el modelo insignia actual de Zhipu AI / Z.ai para la programación y los agentes de largo alcance — misma base que GLM-5.2, con mejoras generalizadas del escalado post-entrenamiento (Terminal-Bench 3.0 de 4.6 a 28.3), un sólido contexto de 1M de tokens y pesos abiertos en Hugging Face desde el 28 de ago. En ChinaModelAPI, los ID glm-5.2 / glm-5.1 siguen resolviendo durante la transición al ID de relé glm-5.3.

Respuesta directa (agosto de 2026)

Modelo insignia actual de Zhipu = GLM-5.3 (lanzado el 14 de ago de 2026: misma base que GLM-5.2, todas las mejoras provienen del escalado post-entrenamiento; Terminal-Bench 3.0 de 4.6 a 28.3, CyberGym 84.5%). Z.ai lanzó la API en GA el 19 de ago a $1.40 / $4.40 por 1M de tokens ($0.26 en caché) y publicó los pesos abiertos el 28 de ago (zai-org/GLM-5.3, licencia personalizada). ID objetivo vía ChinaModelAPI: glm-5.3 en https://api.chinamodelapi.com/v1, activo cuando la comprobación de estado del relé termine — hasta entonces glm-5.2 / glm-5.1 siguen resolviendo; confirma el alias activo en tu panel. Superficie oficial del producto: z.ai / chat.z.ai. También nuevo: GLM-5.3-Flash — pesos abiertos a ~1/10 del precio insignia.

Fuentes: blog de Z.ai “GLM-5.3” (2026-08-14); blog de Z.ai “GLM-5.2: Built for Long-Horizon Tasks” (2026-06-16); publicación de los pesos zai-org/GLM-5.3 en Hugging Face (2026-08-28).

Qué ha cambiado frente a las líneas GLM anteriores

  • GLM-5.3 — buque insignia actual (14 de ago de 2026): misma base que 5.2, todas las mejoras provienen del escalado post-entrenamiento; Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%; pesos abiertos desde el 28 de ago (licencia personalizada); el hermano GLM-5.3-Flash publica pesos abiertos a ~1/10 del precio
  • GLM-5.2 — pesos abiertos para SWE y agentes de largo alcance, ~1M de contexto, pesos MIT; el ID de producción en ChinaModelAPI que hoy sigue resolviendo
  • GLM-5.1 — paso previo de la serie 5.x (aún útil para pruebas A/B de coste/latencia)
  • Las denominaciones comerciales anteriores como GLM-4.5 / 4-Plus han quedado reemplazadas para el posicionamiento de “última generación”; prioriza la línea 5.x (buque insignia actual: GLM-5.3) en los textos del producto

Puntos fuertes

  • Bucles largos de programación multi-paso / agentes estilo harness (Terminal-Bench 3.0: 28.3)
  • Capacidades emergentes de ciberseguridad (CyberGym 84.5%) — úsalas con responsabilidad
  • Calidad frontier de pesos abiertos competitiva y más barata que las API cerradas de EE. UU.
  • Opción de autoalojamiento cuando los datos deben quedar on-premise (licencia glm-5.3 personalizada)
  • La UX de producto bilingüe ZH/EN sigue siendo sólida

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="glm-5.3",
    messages=[
        {"role": "system", "content": "You are a senior software engineer. Plan then implement."},
        {"role": "user", "content": "Add retry + timeout to this HTTP client and write tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.CHINAMODELAPI_KEY,
  baseURL: "https://api.chinamodelapi.com/v1",
});
const resp = await client.chat.completions.create({
  model: "glm-5.3",
  messages: [{ role: "user", content: "Refactor this service for idempotent webhooks." }],
});
console.log(resp.choices[0].message.content);

Consejo de enrutamiento

Enruta por defecto el tráfico de producción de programación/agentes a glm-5.3 cuando el ID de relé complete su comprobación de estado — hasta entonces glm-5.2 / glm-5.1 siguen resolviendo; confirma los alias activos en tu panel. Mantén la clasificación masiva breve en IDs más económicos como el nivel GLM-5.3-Flash. Para paquetes extremos de múltiples documentos, evalúa también Kimi K3.

FAQ

¿El último GLM sigue siendo el 4.5?

No. El modelo insignia actual de Zhipu es GLM-5.3 (lanzado el 14 de ago de 2026, tras GLM-5.2 / 5 / 5.1). Z.ai lanzó la API 5.3 en GA el 19 de ago y publicó los pesos abiertos el 28 de ago; a través de ChinaModelAPI, glm-5.2 / glm-5.1 siguen resolviendo mientras el ID de relé glm-5.3 completa su comprobación de estado.

¿GLM-5.3 es de código abierto?

Sí — Zhipu publicó pesos abiertos en Hugging Face (zai-org/GLM-5.3) el 28 de ago de 2026 bajo una licencia glm-5.3 personalizada (GLM-5.2 era MIT); la API en la nube sigue siendo la vía más sencilla mediante pasarelas compatibles con OpenAI como ChinaModelAPI.

¿Ventana de contexto?

GLM-5.3 se comercializa con un sólido contexto de 1M de tokens para tareas de largo alcance. Confirma los límites en tiempo real en el panel de tu proveedor.

¿GLM-5.3 frente a Kimi K3?

Ambas son líneas frontier chinas de 2026. GLM-5.3 es el modelo insignia de programación/agentes reforzado por post-entrenamiento; Kimi K3 es el modelo insignia multimodal de clase 2.8T y contexto 1M de Moonshot. Haz benchmark en tu propio set de evaluación.

Guías relacionadas