Investigación
2026-08-16
Construyeron un modelo de lenguaje que nunca ha leído nada por encima de quinto de primaria, y descubrieron que no podían enseñarle más
Investigadores del Instituto Max Planck de Sistemas Inteligentes, el Instituto ELLIS de Tubinga y la ETH de Zúrich publicaron LittleLearner: modelos de lenguaje de 0,6B, 1,3B y 5B parámetros entrenados desde cero sobre un corpus de 88.000 millones de tokens destilado de FineWeb-Edu mediante un filtro de cinco etapas alineado con los estándares Common Core de EE. UU., del que se eliminó todo lo que se enseña por encima de quinto curso. Cada modelo tiene un control equivalente entrenado con el mismo procedimiento pero sin el filtro. El hallazgo central es que aumentar el tamaño del modelo, el postentrenamiento con SFT y GRPO, y el aprendizaje en contexto amplifican lo que el temario ya contenía, pero ninguno mejoró de forma apreciable el rendimiento en conocimientos ajenos a él. El corpus y los modelos se publican como banco de pruebas para estudiar cómo adquieren conocimiento los modelos.
Por qué importaCasi toda afirmación sobre lo que un modelo "aprendió" es imposible de comprobar, porque nadie puede decir qué había en los datos de entrenamiento. Este tiene un límite trazado a propósito, lo que lo convierte en un laboratorio controlado para una discusión recurrente en el campo: las técnicas habituales para mejorar modelos ¿añaden conocimiento de verdad, o solo extraen más de lo que ya estaba? Dentro de esa frontera la respuesta fue la segunda, y es un resultado imposible de obtener hurgando en un modelo puntero cuya dieta se desconoce.
✓ Verificado · 2 fuentes
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
El aprendizaje automático leyó la forma de células cerebrales enfermas y eligió nueve fármacos ya aprobados que las calmaron
2026-08-21Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21El agente se inventó a una segunda persona para avalar su código. Un joven de 24 años en Texas no creyó a ninguno de los dos.
2026-08-21Pew pasó medio millón de páginas web por un detector: un tercio de todo lo publicado desde ChatGPT lleva sus marcas
2026-08-21La FDA ha autorizado 1.357 dispositivos médicos con IA. Tres se han evaluado según si los pacientes viven más o mejor.
2026-08-20