Noticias / Seguimiento de modelos · Seguimiento de modelos misteriosos
Ox Alpha revelado: Zhipu confirma que es GLM-5.3-Flash — Lanzamiento oficial y pesos abiertos esta noche
Un modelo anónimo aterriza en OpenRouter con 1M de contexto, entrada de imagen+video y una semana gratis — luego supera a Claude Fable 5 en las primeras pruebas, atrae al CEO de Stripe a los comentarios, recibe un guiño cómplice sin confirmación por parte de Google del que internet se burla sin piedad y absorbe cada análisis forense que la comunidad le lanza. Los medios chinos lo llaman 牛来. Nadie se ha atribuido su autoría. Todo lo que figura a continuación está atribuido, fechado y señalado como no confirmado donde se indique.
Actualización (26 de agosto, noche): misterio resuelto — Zhipu confirmó a Bloomberg que Ox Alpha es GLM-5.3-Flash, con el lanzamiento oficial y los pesos abiertos llegando esta noche. Zixuan Li, de Zhipu: "Ox Alpha era una versión preliminar de GLM-5.3-Flash. El lanzamiento oficial ofrece un mayor rendimiento y una estabilidad significativamente mejor". La comunidad forense lo predijo hace días; el guion de Pony Alpha se repitió al pie de la letra. Detalles en la sección La revelación a continuación.
Ox Alpha es GLM-5.3-Flash — confirmado oficialmente por Zhipu a Bloomberg el 26 de agosto, con el lanzamiento oficial y los pesos abiertos llegando esta noche a través de Z.ai. La prueba en sigilo (OpenRouter/OpenCode desde el 20-21 de agosto, 1M de contexto, texto+imagen+video, semana gratuita) fue una prueba de estrés pública inicial: "inteligencia de frontera, costo flash", medida por la comunidad en un 80% frente al 65% de Fable 5 en una muestra de 10 tareas de DeepSWE y, según SemiAnalysis, su capacidad de 100T-tokens/día funciona con chips chinos. Zhipu afirma que el lanzamiento oficial es más potente y estable que la versión de prueba en sigilo.
La semana en que ocurrió, verificado
| Cuándo | Qué ocurrió · fuente |
|---|---|
| 20-21 de ago. | Ox Alpha aparece en OpenRouter + OpenCode Zen — 1M de contexto, multimodal, gratis ~1 semana, "100T tokens/día" de capacidad de plataforma (capacidad, no parámetros). OpenRouter: "solo enrutamiento; tercero anónimo." (36氪/APPSO) |
| 21-22 de ago. | Silicon Valley se suma en masa: el autor de DeepSWE registra un 63% en su suite agéntica; la muestra de 10 tareas de Ben Davis: Ox 80% / Fable 5 65% / GPT-5.6 Sol 52%; el CEO de Stripe, Patrick Collison: "bastante impresionante"; los CEO de OpenRouter/T3 Chat/Box se hacen eco. (36氪) |
| 22-23 de ago. | Los análisis forenses apuntan a GLM: el conteo del tokenizador frente a GLM-5.3 difiere en una constante de 75 tokens en 25 prompts (el equivalente a un system prompt oculto); el consumo de tokens de video coincide exactamente con GLM-5V-Turbo; los errores de la capa de servicio coinciden con el dialecto de Z.ai. (TechTimes 08-23; 36氪) |
| 23-24 de ago. | La insinuación no oficial de Google: investigadores de DeepMind insinúan "Gemini" y "trust the process" —objeto de burlas generalizadas (Google se apresuró a atribuírselo y fue el hazmerreír de las redes, 36Kr). El hilo con el veredicto en HN: "Ox-Alpha es GLM" (26 pts, por ahora solo una atribución de la comunidad). |
| 24 ago | 36氪 informa que al periodo gratuito le quedan "menos de cuatro días"; el apodo chino 牛来 se vuelve tendencia. Aún no hay declaraciones oficiales. |
La revelación (26 de ago.): confirmado por Bloomberg, pesos esta noche
- Zhipu confirmó a Bloomberg (miércoles, 26 de agosto): "el modelo Ox Alpha es una nueva iteración de su serie GLM" — específicamente GLM-5.3-Flash — y afirmó que liberará los pesos esta noche, en respuesta a las consultas de Bloomberg News.
- Zixuan Li de Zhipu (X, @zixuanli_): "Ox Alpha fue una versión temprana de GLM-5.3-Flash. La versión oficial ofrece un mayor rendimiento y una estabilidad significativamente mejor. Muchísimas gracias a @opencode y @OpenRouter por ponerlo a disposición de la comunidad."
- El detalle impactante (SemiAnalysis): los supuestos 100T tokens/día de la prueba encubierta se procesaron en chips chinos — la semana gratuita fue, entre otras cosas, una prueba de estrés para aceleradores nacionales a escala de frontera.
- Primeras reacciones: Andrew Curran — "la frontera de Pareto se ha redibujado" (anuncio + benchmarks ya disponibles); resumen de la comunidad: "GLM-5.3 Flash supera a GLM-5.2 en todo"; la frase de posicionamiento que circula: "inteligencia de frontera, costo flash."
- El guion, repetido. El Pony Alpha de febrero (anónimo → confirmado por Zhipu como GLM-5 en el día ~6) predijo exactamente esto: lanzamiento sigiloso → tráfico gratis → benchmarks → revelación. El análisis forense del tokenizer que lo identificó como GLM días antes de la confirmación tenía razón.
- Pesos liberados (verificación del 27 de agosto): zai-org/GLM-5.3-Flash (+ BF16) ya está disponible en Hugging Face. Datos de la ficha oficial: 320B totales / 18B activos, el primer modelo nativamente multimodal de la serie GLM-5, superando a GLM-5.2 en los benchmarks a una décima parte del precio (≈ $0.14/$0.44 por 1M vs. los $1.40/$4.40 de 5.2) mientras se acerca a Claude Opus 4.8 en suites de código y tareas agénticas — con cuantizaciones para llama.cpp / Ollama / LM Studio para despliegue local. Recepción en HN: 809 puntos para el modelo, 407 para el anuncio.
El análisis forense previo a la revelación — y lo acertado que fue
- Huella digital del tokenizador. En 25 prompts controlados, el recuento de tokens de Ox Alpha se sitúa exactamente 75 tokens por encima del de GLM-5.3 — la firma característica de un system prompt oculto y constante en el mismo tokenizador (resumen técnico de 36氪).
- Firma de tokens de video. Cuatro pruebas de video controladas coincidieron línea por línea con el cálculo de tokens de tasa de fotogramas/duración/resolución de GLM-5V-Turbo; los modelos de otros proveedores divergieron.
- Supera en capacidades multimodales al GLM-5.3 público. La versión 5.3 lanzada es solo de texto vía API —por lo que, si esto es de Zhipu, se trata de una variante multimodal no publicada (en la jerga de la comunidad: un caballo de batalla de clase GLM-5.5). La comparativa directa de APPSO encontró una cadena de razonamiento "muy cercana a GLM-5.3" —y una prueba de teoría de números que Ox resolvió y GLM-5.3-max no logró terminar.
- El precedente. Cuatro de cuatro lanzamientos anónimos anteriores de OpenRouter fueron de laboratorios chinos: Pony Alpha → GLM-5 (reclamado por Zhipu el día 6), Hunter/Healer Alpha → Xiaomi MiMo-V2, Elephant Alpha → Ant Ling-2.6-flash, Owl Alpha → Meituan LongCat-2.0.
- Los límites (pre-revelación). Hasta el 25 de agosto nada de esto era oficial — Google lo insinuaba sin afirmarlo y Zhipu guardaba silencio. El 26 de agosto llegó la confirmación y validó cada hilo forense expuesto arriba.
Notas prácticas para desarrolladores de API
- De incógnito a oficial, esta noche. El periodo gratuito (~27-28 de agosto) da paso ahora al lanzamiento oficial de GLM-5.3-Flash con pesos abiertos vía Z.ai — la ventana de pruebas a coste cero finaliza justo cuando llega el producto real.
- Tómalo como una prueba de estrés encubierta. Sin SLA, sin aviso de obsolescencia, sin atribución — ideal para evaluaciones y curiosidades, pero el lugar equivocado para tráfico de producción o datos sensibles.
- Pesos + API llegan esta noche vía Z.ai — consulta zai-org en Hugging Face y docs.z.ai; nuestra cobertura de GLM-5.3 sigue a toda la familia, y la edición de mañana incluirá las especificaciones verificadas del lanzamiento.
Fuentes primarias
- Bloomberg confirma (vía @kimmonismus/Techmeme) — Zhipu confirmó el miércoles que Ox Alpha es una nueva iteración de la serie GLM y liberará los pesos esta noche
- Recopilación de Techmeme — Reacciones al anuncio oficial de GLM-5.3-Flash (HN/r/singularity/r/LocalLLaMA + publicación de SemiAnalysis sobre chips chinos + agradecimientos a Zixuan Li)
- 36氪 — 神秘「牛来」掀翻硅谷,谷歌抢着认领被全网笑惨(实测细节与取证汇总)
- 36氪/APPSO — El misterioso modelo «牛来» arrasa en redes: ponemos a prueba si realmente es tan bueno (tokenizer / análisis forense de video + pruebas de teoría de números)
- TechTimes — análisis forense de la capa de servicio (nombres de clases de Zhipu, dialecto de errores, 30/30 pruebas de tokenizador)(2026-08-23)
- OrcaRouter — Ox Alpha probablemente GLM-5.3 (tarjeta de puntuación del historial de lanzamientos de modelos anónimos)
- Trending Topics — Ox Alpha: un nuevo y misterioso modelo de IA busca ganarse a los desarrolladores
- Hacker News — Hilo de debate sobre "Ox-Alpha Is GLM" (atribución de la comunidad, no oficial)
Preguntas frecuentes (2026)
¿Qué es Ox Alpha?
Un modelo anónimo y sigiloso en OpenRouter/OpenCode desde el 20-21 de agosto: 1M de contexto, texto+imagen+video, gratis ~1 semana. Ningún laboratorio se lo ha atribuido. Apodo en los medios chinos: 牛来.
¿Qué tan bueno?
Muestra reducida pero impactante: 80% frente al 65% de Fable 5 en una ejecución de 10 tareas de DeepSWE; 63% en la suite del autor de DeepSWE. CEO de Stripe: "相当惊艳" (según 36氪).
¿Quién lo construyó?
Confirmado el 26 de agosto: Zhipu — Ox Alpha era una versión preliminar de GLM-5.3-Flash (Bloomberg; Zixuan Li de Zhipu en X). El análisis forense del tokenizer (+75-offset) y de la firma de video lo anticipó con días de antelación.
¿Lo reclamó Google?
Los investigadores de DeepMind lanzaron fuertes indirectas ("Gemini", "confíen en el proceso") y recibieron burlas por ello — sin confirmación de nadie.
¿Sigue siendo gratis?
El periodo de acceso gratuito discreto da paso al lanzamiento oficial de esta noche de GLM-5.3-Flash con pesos abiertos a través de Z.ai — la vista previa gratuita termina con la llegada del producto real.
¿Enlace a los pesos de GLM-5.3?
Resuelto y verificado: los pesos de GLM-5.3-Flash ya están disponibles en zai-org (comprobado el 27 de agosto) — 320B/18B activos, primer modelo nativamente multimodal de la serie GLM-5, ~1/10 del precio de GLM-5.2. La ventana del ~28 de agosto se adelantó para Flash.