Nuevos Modelos
AI Minute Newsroom
2026-08-27
El modelo anónimo que los desarrolladores llevaban semanas sondeando ya es descargable con licencia MIT — y Z.ai dice que toda la vista previa corrió en chips chinos
Z.ai publicó GLM-5.3-Flash el 26 de agosto y confirmó que es el modelo que circulaba de forma anónima como Ox Alpha. Es un modelo de mezcla de expertos con 320.000 millones de parámetros totales y 18.000 millones activos por token, una ventana de contexto de un millón de tokens, pesos en Hugging Face bajo licencia MIT y —una primicia en la línea GLM-5— multimodalidad nativa: el modelo base procesa imagen y vídeo en lugar de recibirlos por un añadido. La arquitectura combina atención lineal para dependencias locales con atención dispersa para el contexto de largo alcance, y a contexto completo usa un componente llamado IndexPool que comprime los vectores clave del indexador para que la latencia y la memoria no se disparen. Z.ai declara un entrenamiento sobre un corpus multimodal de unos 30 billones de tokens. Según sus propias cifras, obtiene 63,4 en DeepSWE v1.1 frente al 46,2 de GLM-5.2, 48,8 en AutomationBench frente a 26,2, y 84,3 en Terminal-Bench 2.1 junto al 85,0 de Claude Opus 4.8. El precio es de 0,15 dólares por millón de tokens de entrada, 0,03 en caché y 0,50 de salida, aproximadamente una décima parte de GLM-5.2, con una promoción del 50 por ciento hasta el 9 de septiembre. La afirmación que más se discutirá: Z.ai sostiene que toda la vista previa de Ox Alpha se sirvió en aceleradores chinos de producción nacional con su propio motor de inferencia, con una mejora de extremo a extremo de unas tres veces sobre decenas de miles de ellos. Todas las cifras de referencia son autodeclaradas y no se han replicado de forma independiente.
Por qué importaAquí han ocurrido dos cosas distintas y conviene separarlas. La primera es un acontecimiento de precio: un modelo de 320.000 millones de parámetros que responde a las pruebas de código y de agentes a uno o dos puntos de un modelo frontera cerrado, publicado bajo MIT —la licencia más permisiva que existe, es decir, se puede incorporar a un producto comercial sin pedir permiso a nadie— y a aproximadamente una décima parte de lo que costaba su predecesor. Eso reduce la distancia entre lo que se alquila y lo que uno puede ejecutar por su cuenta, y lo hace justo en las categorías por las que pagan las empresas. La segunda es la afirmación sobre el hardware, que merece más escepticismo que los resultados. Los controles de exportación descansan en la premisa de que la computación avanzada es el cuello de botella. Si un laboratorio puede servir un modelo cercano a la frontera a un público global de probadores enteramente sobre silicio nacional, esa premisa se estrecha, pero solo en la parte de servir. La inferencia exige mucho menos que el entrenamiento, no sabemos qué chips ni con qué eficiencia, y la única fuente es la empresa que se beneficia del relato. Anótelo, no apueste por ello.
✓ Verificado · 5 fuentes
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
A los nuevos modelos abiertos de IBM no les enseñaron a describir una terminal: los entrenaron usándola
2026-08-27El modelo sin nombre que devoró 42 billones de tokens en seis días ya tiene dueño: Z.ai reconoce que Ox Alpha es un GLM y abre los pesos
2026-08-26El anticipo de Qwen4 ya es abierto: seis mil millones de parámetros activos por token y, en la tabla de la propia Alibaba, arregla más errores reales que Opus 4.6
2026-08-26Un agente que sigue pensando cuando dejas de escribir, y todo el armazón cabe en menos de 10.000 líneas de Bash
2026-08-26Enséñale al robot un vídeo de una tarea de diez minutos y hará la tarea de diez minutos: sin reentrenar, sin escribir nada
2026-08-26