aiminute. ← Todas las noticias de IA
Investigación 2026-08-07

Benchmarks independientes: Qwen3.8-Max queda justo bajo la frontera de EE.UU. — trabajando mucho más

Benchmarks independientes: Qwen3.8-Max queda justo bajo la frontera de EE.UU. — trabajando mucho más

Artificial Analysis otorgó a Qwen3.8-Max de Alibaba 56 puntos en su Índice de Inteligencia — por encima de todos los modelos de Google, Meta y xAI, superado solo por los niveles superiores de Anthropic y OpenAI y por Kimi K3 — y el segundo puesto en su tabla agéntica GDPval-AA con 1739 Elo, solo por detrás de Claude Opus 5 max (1852). La mejora tiene precio: promedia 64 turnos por tarea agéntica frente a los 14 de Qwen3.7-Max, más que duplicando el coste por tarea hasta 1,14 dólares.

Por qué importaLas cifras independientes sitúan ya a dos modelos chinos de pesos abiertos en el top 4 mundial — pero el detalle de los turnos importa igual: la brecha se cierra a base de fuerza bruta, y ese esfuerzo aparece en las facturas reales de despliegue. El ranking y el coste por tarea divergen; conviene leer ambos.
#Agentes IA

✓ Verificado · 2 fuentes

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

El aprendizaje automático leyó la forma de células cerebrales enfermas y eligió nueve fármacos ya aprobados que las calmaron
2026-08-21
El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21
Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21
ChatGPT ya puede leer tus iMessages y enviarlos — y el ajuste que le permite dejar de preguntar es justo el que OpenAI advierte
2026-08-21
El agente se inventó a una segunda persona para avalar su código. Un joven de 24 años en Texas no creyó a ninguno de los dos.
2026-08-21