Nuevos Modelos
AI Minute Newsroom
2026-08-27
El modelo anónimo que los desarrolladores llevaban semanas sondeando ya es descargable con licencia MIT — y Z.ai dice que toda la vista previa corrió en chips chinos
Z.ai publicó GLM-5.3-Flash el 26 de agosto y confirmó que es el modelo que circulaba de forma anónima como Ox Alpha. Es un modelo de mezcla de expertos con 320.000 millones de parámetros totales y 18.000 millones activos por token, una ventana de contexto de un millón de tokens, pesos en Hugging Face bajo licencia MIT y —una primicia en la línea GLM-5— multimodalidad nativa: el modelo base procesa imagen y vídeo en lugar de recibirlos por un añadido. La arquitectura combina atención lineal para dependencias locales con atención dispersa para el contexto de largo alcance, y a contexto completo usa un componente llamado IndexPool que comprime los vectores clave del indexador para que la latencia y la memoria no se disparen. Z.ai declara un entrenamiento sobre un corpus multimodal de unos 30 billones de tokens. Según sus propias cifras, obtiene 63,4 en DeepSWE v1.1 frente al 46,2 de GLM-5.2, 48,8 en AutomationBench frente a 26,2, y 84,3 en Terminal-Bench 2.1 junto al 85,0 de Claude Opus 4.8. El precio es de 0,15 dólares por millón de tokens de entrada, 0,03 en caché y 0,50 de salida, aproximadamente una décima parte de GLM-5.2, con una promoción del 50 por ciento hasta el 9 de septiembre. La afirmación que más se discutirá: Z.ai sostiene que toda la vista previa de Ox Alpha se sirvió en aceleradores chinos de producción nacional con su propio motor de inferencia, con una mejora de extremo a extremo de unas tres veces sobre decenas de miles de ellos. Todas las cifras de referencia son autodeclaradas y no se han replicado de forma independiente.
Por qué importaAquí han ocurrido dos cosas distintas y conviene separarlas. La primera es un acontecimiento de precio: un modelo de 320.000 millones de parámetros que responde a las pruebas de código y de agentes a uno o dos puntos de un modelo frontera cerrado, publicado bajo MIT —la licencia más permisiva que existe, es decir, se puede incorporar a un producto comercial sin pedir permiso a nadie— y a aproximadamente una décima parte de lo que costaba su predecesor. Eso reduce la distancia entre lo que se alquila y lo que uno puede ejecutar por su cuenta, y lo hace justo en las categorías por las que pagan las empresas. La segunda es la afirmación sobre el hardware, que merece más escepticismo que los resultados. Los controles de exportación descansan en la premisa de que la computación avanzada es el cuello de botella. Si un laboratorio puede servir un modelo cercano a la frontera a un público global de probadores enteramente sobre silicio nacional, esa premisa se estrecha, pero solo en la parte de servir. La inferencia exige mucho menos que el entrenamiento, no sabemos qué chips ni con qué eficiencia, y la única fuente es la empresa que se beneficia del relato. Anótelo, no apueste por ello.
✓ Verificado · 5 fuentes
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
Microsoft lanzó una jaula que los agentes de IA no pueden abrir.
2026-10-11La lista de precios de OpenAI muestra un modelo que nunca anunció.
2026-10-11Odyssey abrió un modelo de mundo que se maneja desde el navegador.
2026-10-11Claude ya puede repartir una tarea entre hasta 1.000 agentes.
2026-10-11Agentes que rehacían un viejo juego quisieron cambiar su verificador.
2026-10-11