aiminute. ← Toute l’actu IA
Nouveaux Modèles 2026-08-17

Un laboratoire coréen a triplé le score de son propre modèle en une génération — et le facture 30 cents le million de tokens

Un laboratoire coréen a triplé le score de son propre modèle en une génération — et le facture 30 cents le million de tokens

Upstage a publié Solar Pro 4 ce mois-ci. Sur l'Intelligence Index d'Artificial Analysis, il obtient 42 points, contre 14 pour Solar Pro 3 : l'un des plus grands bonds d'une seule génération enregistrés par un laboratoire cette année. Cela le place au niveau d'Inkling, de Thinking Machines, et à un point de MiMo-V2.5-Pro. Les gains se concentrent sur le travail agentique, ce pour quoi Upstage dit l'avoir conçu : Terminal-Bench v2.1 passe de 43,2 à 57, le raisonnement sur documents longs (AA-LCR) de 62,7 à 71, et sur le banc d'essai agentique GDPval-AA v2 son Elo passe de 498 à 1277, pour une référence humaine à 1000. Le tarif est de 0,30 dollar le million de tokens en entrée et 1,20 dollar en sortie, 0,06 pour les lectures en cache, avec 90 % de remise jusqu'au 10 septembre. Le contexte atteint 384 000 tokens et la sortie jusqu'à 256 000, en texte uniquement, servi via l'API d'Upstage et OpenRouter. Cela a un prix : le modèle consomme 17 % de tokens de sortie en moins que son prédécesseur, mais met 8,6 minutes par tâche au lieu de 6,0. Il fonctionne en anglais, en coréen et en japonais.

Pourquoi c'est importantLe chiffre intéressant n'est pas 42 — beaucoup de modèles y siègent. Ce qui compte, c'est le passage de 14 à 42 en une génération, depuis un laboratoire que la plupart des gens hors de Corée n'ont jamais évalué. La recette pour atteindre ce palier est désormais assez bien comprise pour qu'un laboratoire national de taille moyenne l'exécute en quelques mois, et c'est pourquoi le plancher des prix baisse plus vite que la frontière n'avance. L'Elo agentique au-dessus de la référence humaine mérite la prudence due à tout banc d'essai isolé, et la latence mérite d'être notée : ce score s'achète aussi avec du temps de calcul, pas seulement avec de meilleurs poids.
#Agents IA

✓ Vérifié · 3 sources

▶ Vidéo associée: Solar Pro 4 First Look & Test – South Korea's DeepSeek Competitor!
WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21
Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21
ChatGPT peut désormais lire vos iMessages et les envoyer — et le réglage qui lui évite de demander est celui-là même dont OpenAI met en garde
2026-08-21
Montrez-le au robot une fois — de trois à douze secondes — et il réussit 59 fois sur 100 sans le moindre entraînement
2026-08-21
L'agent a inventé une seconde personne pour cautionner son code. Un étudiant de 24 ans au Texas n'a cru ni l'un ni l'autre.
2026-08-21