aiminute. ← Todas las noticias de IA
Nuevos Modelos AI Minute Newsroom 2026-08-26

El anticipo de Qwen4 ya es abierto: seis mil millones de parámetros activos por token y, en la tabla de la propia Alibaba, arregla más errores reales que Opus 4.6

El anticipo de Qwen4 ya es abierto: seis mil millones de parámetros activos por token y, en la tabla de la propia Alibaba, arregla más errores reales que Opus 4.6

El equipo Qwen de Alibaba ha abierto los pesos de Qwen3.8-Flash-Next, el modelo al que esta mañana le había puesto una cuenta atrás. Es un sistema multimodal de mezcla de expertos: 125.000 millones de parámetros en la red principal, más una tabla de incrustaciones n-gram de 51.000 millones y una capa de predicción multitoken de 4.000 millones — unos 180.000 millones en total en BF16, de los cuales alrededor de 6.000 millones se activan para cada token. La arquitectura es nueva: un híbrido de Gated DeltaNet y Qwen Sparse Attention, 512 expertos con diez enrutados y uno compartido, un residual con compuerta y una receta de entrenamiento que combina los optimizadores Muon y AdamW. El contexto es de 262.144 tokens de forma nativa y se extiende hasta un millón. La tabla publicada por Qwen lo sitúa en 62,5 en SWE-bench Pro frente a 53,4 de Claude Opus 4.6 Max, en 81,0 en SWE-bench Multilingual frente a 77,5, y en 58,7 en DeepSWE 1.1: cifras del propio laboratorio, en su propio banco de pruebas, aún sin reproducción independiente. El equipo afirma que entrenarlo costó cerca de una novena parte de lo que costó Qwen3.7-Plus. Los pesos están en Hugging Face y ModelScope con licencia qwen-community-1.0: 131 archivos, unos 360 GB, con una versión FP8 que reduce la memoria a la mitad. Qwen lo describe como un anticipo temprano de la arquitectura sobre la que se construirá Qwen4, y anuncia una versión alojada a 0,16 dólares por millón de tokens de entrada y 0,47 por millón de salida.

Por qué importaLa cifra que importa no es 62,5, sino seis mil millones. Un modelo que solo enciende seis mil millones de parámetros por token corre casi a la velocidad de uno pequeño mientras carga el conocimiento de uno grande, y por eso la versión FP8 cabe en una estación de trabajo bien equipada en lugar de en un bastidor. Si las puntuaciones de programación sobreviven a las pruebas independientes, la distancia entre lo que se alquila a un laboratorio de frontera y lo que uno puede ejecutar en casa vuelve a estrecharse, y lo hace en el eje que cuesta dinero: tokens por segundo por vatio. La advertencia es evidente: son los propios test del fabricante, publicados el mismo día que los pesos, y lo primero que debería hacer cualquiera es comprobarlos.
#Programación

✓ Verificado · 4 fuentes

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

El modelo sin nombre que devoró 42 billones de tokens en seis días ya tiene dueño: Z.ai reconoce que Ox Alpha es un GLM y abre los pesos
2026-08-26
Un agente que sigue pensando cuando dejas de escribir, y todo el armazón cabe en menos de 10.000 líneas de Bash
2026-08-26
Enséñale al robot un vídeo de una tarea de diez minutos y hará la tarea de diez minutos: sin reentrenar, sin escribir nada
2026-08-26
Alibaba ha puesto una cuenta atrás a la primera pieza de Qwen4: los pesos se abren esta noche a las 23:00 en Pekín
2026-08-26
Alibaba ha publicado la página de un modelo al que llama anticipo de la arquitectura Qwen4, con fecha del 26 de agosto: las especificaciones aparecieron y luego se retiraron
2026-08-25