Noticias / Seguimiento de modelos · Disponibilidad general de la API
La API de GLM-5.3 llega a GA: $1.40/$4.40, un día de retraso y un ecosistema que no esperó
Cinco días después del lanzamiento de GLM-5.3 el 14 de ago. (Coding Plan primero, API «próximamente»), Zhipu habilitó el acceso general a la API en la madrugada del 19 de agosto —un día después de lo previsto— con precios idénticos a los de GLM-5.2. Este informe incluye el cronograma verificado, la tabla comparativa de precios frente a otros modelos chinos, el desglose de plataformas y los cambios para desarrolladores de API antes de que los pesos abiertos se publiquen hacia el 28 de ago..
La API de GLM-5.3 ya cuenta con disponibilidad general a partir del 19 de agosto de 2026 (madrugada, hora de Pekín), según el anuncio oficial de Zhipu difundido por 证券时报 y 第一财经. El precio se mantiene sin cambios respecto a GLM-5.2 — $1.40 / $4.40 por 1M de tokens (entrada / salida) en la página de precios de docs.z.ai. Debuta en el Artificial Analysis Index con 60 puntos, empatando con Kimi K3 en el puesto n.º 1 compartido de código abierto; pesos abiertos entregados el 28 de ago. — consulta nuestro informe sobre pesos abiertos.
La semana de lanzamiento, verificada
| Cuándo | Qué ocurrió · fuente |
|---|---|
| 14 de ago. | GLM-5.3 se lanza: primero Coding Plan / ZCode, con la API prometida. Blog de z.ai; nuestro informe de lanzamiento. PhanRouter y JD Cloud MaaS lo integran el mismo día (量子位). |
| 18 de ago. | La API no se abre según lo programado: los clientes que habían presupuestado para el fin de semana de lanzamiento presionan fuertemente (华尔街见闻: "delay一天我们的管理成本就多好几万"). |
| 19 de ago. (madrugada) | GA de la API. Anuncio de Zhipu en WeChat: 即日起正式上线, 定价与 5.2 持平, 权重下周五开源 (IT之家, 界面新闻). En la prensa en inglés: VentureBeat destaca el mantenimiento de los precios de $1.4/$4.4. |
| 21 de ago. | La plataforma National Supercomputing Internet de China añade llamadas a la API de GLM-5.3 en un solo clic (compatible con OpenAI y Anthropic); Zhipu (2513.HK) sube un 11% junto a MiniMax en el repunte del «dúo de grandes modelos de HK» (ZAKER). |
Precios: sin cambios y cómo queda posicionado
Zhipu mantuvo la línea en $1.40 / $4.40 por 1M de tokens (entrada en caché ~$0.26), la misma tarifa que ocupaba GLM-5.2 y todavía entre las opciones de API de nivel de vanguardia más económicas disponibles.
| Modelo (2026) | Entrada $/1M | Salida $/1M | Nota |
|---|---|---|---|
| GLM-5.3 (GA) | $1.40 | $4.40 | en caché ~$0.26; AA 60, co-#1 en código abierto |
| qwen3.8-max | $2.00 | $6.00 | pesos abiertos desde el 12–17 de ago. |
| Kimi K3 | $3.00 | $15.00 | pesos abiertos de 2.8T, licencia modificada |
| deepseek-v4-flash (valle/punta) | $0.22 / $0.44 | $0.66 / $1.32 | nuevas franjas punta/valle desde el 17 de ago. |
Las filas comparativas reutilizan precios verificados en nuestros informes anteriores; la fila de GLM corresponde a la página de precios de docs.z.ai.
Lo que se lanzó y el cambio incompatible clave a recordar
- Acceso general a la API. Llamadas compatibles con OpenAI según docs.z.ai (la guía de inicio rápido oficial cubre curl/Python/Node); el modelo está posicionado para programación compleja, ciberseguridad defensiva y tareas de largo alcance.
- Plataformas desde el primer día. ZCode y el GLM Coding Plan son las integraciones de referencia; PhanRouter (el mismo día 14 de ago.), JD Cloud MaaS (14 de ago.) y National Supercomputing Internet (21 de ago., compatible con OpenAI + Anthropic) ya lo ofrecen.
- El cambio incompatible.
thinking.type: 'disabled'fue eliminado — si tu código de la era 5.2 lo utiliza, elimínalo antes de migrar (señalado en nuestro informe de lanzamiento). - Resultados de evaluaciones independientes disponibles. AA Intelligence Index 60 — en el mismo nivel que Kimi K3 para modelos abiertos, cerca de Claude Fable 5 / GPT-5.6 Sol; vale la pena recordar la advertencia previa de «muy detallado» (mediana de 170M frente a 72M de tokens en la prueba del índice de AA) para flujos de agentes sensibles a los costos.
Accede a GLM a través de un único endpoint compatible con OpenAI
ChinaModelAPI es un relay independiente que ofrece modelos de frontera chinos — GLM, DeepSeek, Qwen, Kimi — a desarrolladores de todo el mundo tras una única API compatible con OpenAI y pagos en USDT/USD1. En el relay, glm-5.2 / glm-5.1 siguen siendo los IDs de producción hoy; el ID glm-5.3 se añadirá una vez que se confirme el funcionamiento estable de GA a través de relays.
ChinaModelAPI es un relay independiente sin relación oficial con Zhipu / Z.ai.
Fuentes primarias
- 证券时报 — 智谱GLM-5.3 API今日凌晨上线 (2026-08-19)
- IT之家 — 智谱 GLM-5.3 模型 API 上线,权重下周五开源 (2026-08-19)
- 第一财经/东方财富 — GLM-5.3 API即日起正式上线 (2026-08-19)
- 界面新闻 — 智谱GLM-5.3 API正式上线 (2026-08-19)
- docs.z.ai — 官方定价页 ($1.40/$4.40,缓存输入更低)
- Z.ai 官方博客 — GLM-5.3 发布公告 (2026-08-14)
- VentureBeat — GLM-5.3 llega a la API por $1.4/$4.4 por millón de tokens
- 量子位 — 范式PhanRouter上线智谱GLM-5.3,即日开放调用 (2026-08-17)
- ZAKER — 国家超算互联网上线GLM-5.3 API;港股大模型双雄大涨 (2026-08-21)
- 华尔街见闻 — 5000亿智谱如何「逆风改命」(API推迟一天的客户压力叙事)
Preguntas frecuentes (2026)
¿Cuándo estuvo disponible la API?
19 de agosto de 2026, en la madrugada hora de Pekín — un día después de lo previsto originalmente para el 18 de agosto, según el anuncio oficial de Zhipu.
¿Precios?
Igual que GLM-5.2: $1.40 de entrada / $4.40 de salida por 1M en docs.z.ai, entrada en caché mucho más baja. Sin aumento de precio por GA.
¿Cuándo estarán disponibles los pesos abiertos?
Entregados el 28 de ago. (noche): 141 shards + BF16 disponibles en zai-org, licencia personalizada de glm-5.3. Nuestro informe sobre pesos abiertos incluye los detalles.
¿Dónde puedo llamarlo?
API de Z.ai/bigmodel, ZCode + Coding Plan, PhanRouter, JD Cloud MaaS y la plataforma National Supercomputing Internet (compatible con OpenAI/Anthropic).
¿Frente a GLM-5.2 para desarrolladores?
Misma base, mejoras en post-entrenamiento (Terminal-Bench 3.0 4.6→28.3; AA 60 co-#1 en código abierto). Recuerda: thinking.type 'disabled' fue eliminado — un cambio incompatible.
¿A través de ChinaModelAPI?
Aún no al momento de la publicación — glm-5.2/glm-5.1 son los IDs de producción del relay; el enrutamiento de glm-5.3 se habilitará una vez que se confirme el funcionamiento estable de GA a través de relays. La lista de espera recibirá el primer aviso.