Nuevos Modelos
2026-08-15
La empresa detrás del Instagram chino liberó el hermano del modelo que sacó nota perfecta en la Olimpiada de Matemáticas
Xiaohongshu —la aplicación de estilo de vida conocida fuera de China como RedNote— publicó el 14 de agosto los pesos abiertos de dots3-note-prev, un modelo de mezcla de expertos con 280.000 millones de parámetros totales pero solo 16.000 millones activos a la vez, ventana de contexto de 512K y entradas de texto, visión y voz. Procede de la misma familia que dots-note-3.0, que el mes pasado registró lo que su laboratorio describe como el primer 42 sobre 42 oficial de una IA en la Olimpiada Internacional de Matemáticas. El laboratorio también publicó su método de entrenamiento, TEMPO, en el que el modelo alterna entre actuar y calificar su propio avance en tareas largas, además de dos bancos de pruebas hechos justo para eso: VibeSearchBench, 200 tareas en 20 dominios, y VibeLifeBench, 20 tareas con 1.247 comprobaciones individuales. Según el laboratorio, ni Claude Opus 5 ni GPT-5.5 superaron su umbral de aprobado.
Por qué importaAquí hay dos cosas inusuales. La primera es quién: una aplicación de compras sociales, no un laboratorio, publica pesos abiertos la misma semana que Alibaba y Meta, un recordatorio de que en China las empresas de internet de consumo tienen sus propios equipos de frontera y están dispuestas a regalar los resultados. La segunda es qué midieron. Casi todos los bancos de pruebas públicos premian que el modelo responda una pregunta; estos dos premian que termine un encargo de varias horas —planificar un viaje, llevar una operación— y lo califican con más de mil comprobaciones pequeñas. Es el examen más difícil y más honesto para un agente, y la afirmación de que dos modelos de frontera lo suspenden merece réplica independiente antes de darla por zanjada.
✓ Verificado · 4 fuentes
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21ChatGPT ya puede leer tus iMessages y enviarlos — y el ajuste que le permite dejar de preguntar es justo el que OpenAI advierte
2026-08-21Enséñaselo al robot una vez — de tres a doce segundos — y acierta 59 veces de cada 100 sin ningún entrenamiento
2026-08-21El agente se inventó a una segunda persona para avalar su código. Un joven de 24 años en Texas no creyó a ninguno de los dos.
2026-08-21