Nuevos Modelos
2026-08-17
Un laboratorio coreano triplicó la puntuación de su propio modelo en una generación — y cobra 30 centavos por millón de tokens
Upstage lanzó Solar Pro 4 este mes. En el Intelligence Index de Artificial Analysis obtiene 42 puntos, frente a los 14 de Solar Pro 3: uno de los mayores saltos de una sola generación que ha registrado cualquier laboratorio este año. Eso lo deja a la altura de Inkling, de Thinking Machines, y a un punto de MiMo-V2.5-Pro. Las mejoras se concentran en el trabajo agéntico, que es para lo que Upstage dice haberlo construido: Terminal-Bench v2.1 subió de 43,2 a 57, el razonamiento sobre documentos largos en AA-LCR de 62,7 a 71, y en el banco de pruebas agéntico GDPval-AA v2 su Elo pasó de 498 a 1277, frente a una referencia humana de 1000. Cuesta 0,30 dólares por millón de tokens de entrada y 1,20 por millón de salida, con aciertos de caché a 0,06, actualmente con un 90% de descuento hasta el 10 de septiembre. El contexto es de 384.000 tokens con hasta 256.000 de salida, solo texto, servido a través de la API de Upstage y de OpenRouter. Hay un coste: el modelo usa un 17% menos de tokens de salida que su predecesor, pero tarda 8,6 minutos por tarea en lugar de 6,0. Funciona en inglés, coreano y japonés.
Por qué importaLa cifra interesante no es 42; ahí se sientan muchos modelos. Lo interesante es pasar de 14 a 42 en una generación, desde un laboratorio que la mayoría fuera de Corea nunca ha evaluado. La receta para llegar a este nivel se comprende ya lo bastante bien como para que un laboratorio nacional de tamaño medio la ejecute en meses, y por eso el suelo de precios baja más rápido de lo que avanza la frontera. Conviene tomar el Elo agéntico por encima de la referencia humana con la cautela que merece cualquier banco de pruebas aislado, y fijarse en la latencia: esa puntuación se está comprando también con tiempo de reloj, no solo con mejores pesos.
✓ Verificado · 3 fuentes
▶ Vídeo relacionado: Solar Pro 4 First Look & Test – South Korea's DeepSeek Competitor!
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21ChatGPT ya puede leer tus iMessages y enviarlos — y el ajuste que le permite dejar de preguntar es justo el que OpenAI advierte
2026-08-21Enséñaselo al robot una vez — de tres a doce segundos — y acierta 59 veces de cada 100 sin ningún entrenamiento
2026-08-21El agente se inventó a una segunda persona para avalar su código. Un joven de 24 años en Texas no creyó a ninguno de los dos.
2026-08-21