aiminute. ← Todas las noticias de IA
Rumores AI Minute Newsroom 2026-08-21

Rumor: el modelo anónimo y gratuito sigue atribuyéndose a Zhipu, pero la nota que lo hizo famoso eran diez tareas y la prueba completa es del montón

Rumor: el modelo anónimo y gratuito sigue atribuyéndose a Zhipu, pero la nota que lo hizo famoso eran diez tareas y la prueba completa es del montón

Esto es un rumor no verificado y se publica como tal. Un modelo llamado Ox Alpha apareció en OpenRouter el 20 de agosto bajo un proveedor anónimo etiquetado solo como 'Stealth': gratis durante una semana, con una ventana de contexto de 1.048.576 tokens, hasta 131.072 tokens de salida y entrada de texto, imagen y vídeo. El 21 de agosto el investigador Ben Davis publicó un análisis de huella técnica diciendo que está '99% seguro' de que el modelo es un miembro no publicado de la familia GLM-5 de Zhipu: consumo de tokens del codificador de vídeo idéntico al de GLM-5V-Turbo, un tokenizador que coincide con GLM-5.3 salvo por un envoltorio fijo de 75 tokens, el mismo comportamiento de rechazo ante entrada de audio, el mismo código de error '1301' y una tasa de emojis comparable en su salida. Según él, el análisis descarta a Xiaomi MiMo, DeepSeek, Google, Qwen, xAI, OpenAI y Anthropic. Nada de esto está confirmado: a 23 de agosto ninguna empresa ha reclamado Ox Alpha y Zhipu no ha dicho nada. Conviene fijarse también en la cuestión de los datos. La propia ficha del modelo en OpenRouter dice que los prompts y las respuestas enviados a Ox Alpha son retenidos por el proveedor anónimo, aunque no se usen para entrenar, mientras que OpenCode promocionó el mismo modelo como de retención cero. Hasta que se sepa quién es el proveedor, lo prudente es asumir que lo que usted envía lo guarda una empresa que no le ha dicho su nombre. (Corrección, 23 de agosto: nuestro informe original decía que Ox Alpha obtuvo un 80% de pass@1 en el benchmark de programación DeepSWE, por delante de Claude Fable 5 con 65%, GLM-5.3 con 62% y GPT-5.6-sol con 52%. Esa cifra procedía de un subconjunto de 10 tareas, menos del 9% del benchmark. Davis ha ejecutado desde entonces el conjunto completo de 113 tareas y ha obtenido en torno al 63%, a la altura de GPT-5.6 Sol y no por delante del resto, y él mismo dice que la cifra del conjunto completo es la que tiene sentido. Ox Alpha no encabezó el benchmark. Nuestro titular decía que sí, y era incorrecto.)

Por qué importaLa corrección es la noticia. Un resultado de diez tareas dio la vuelta al mundo en dos días como 'modelo anónimo encabeza un benchmark de programación'; el resultado de 113 tareas que lo contradice no llegará ni de lejos tan lejos. Siempre que vea un modelo superar al resto por un margen amplio, la primera pregunta es cuántos problemas le plantearon de verdad: una muestra pequeña produce diferencias grandes, emocionantes y sin significado. Lo demás sigue en pie: la identidad no está probada, y lanzar un modelo potente de forma anónima y gratuita durante una semana es un canal de distribución, no un regalo. El banco de pruebas es usted, y en este caso el proveedor dice que se queda con lo que envía.
#Programación

⚠ Rumor sin verificar — con cautela

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

OpenAI promete una mejora diaria en Codex o reiniciar tus límites.
2026-10-05
Un diluvio de informes de IA frenó las recompensas de Google.
2026-10-04
Anthropic pagará por formar a 10.000 ingenieros en Claude.
2026-10-04
Un escritorio Linux rechazó por completo el código escrito por IA.
2026-10-04
DeepSeek puso su agente en tu escritorio y abrió el código.
2026-10-03