Nouveaux Modèles
AI Minute Newsroom
2026-08-17
Un laboratoire coréen a triplé le score de son propre modèle en une génération — et le facture 30 cents le million de tokens
Upstage a publié Solar Pro 4 ce mois-ci. Sur l'Intelligence Index d'Artificial Analysis, il obtient 42 points, contre 14 pour Solar Pro 3 : l'un des plus grands bonds d'une seule génération enregistrés par un laboratoire cette année. Cela le place au niveau d'Inkling, de Thinking Machines, et à un point de MiMo-V2.5-Pro. Les gains se concentrent sur le travail agentique, ce pour quoi Upstage dit l'avoir conçu : Terminal-Bench v2.1 passe de 43,2 à 57, le raisonnement sur documents longs (AA-LCR) de 62,7 à 71, et sur le banc d'essai agentique GDPval-AA v2 son Elo passe de 498 à 1277, pour une référence humaine à 1000. Le tarif est de 0,30 dollar le million de tokens en entrée et 1,20 dollar en sortie, 0,06 pour les lectures en cache, avec 90 % de remise jusqu'au 10 septembre. Le contexte atteint 384 000 tokens et la sortie jusqu'à 256 000, en texte uniquement, servi via l'API d'Upstage et OpenRouter. Cela a un prix : le modèle consomme 17 % de tokens de sortie en moins que son prédécesseur, mais met 8,6 minutes par tâche au lieu de 6,0. Il fonctionne en anglais, en coréen et en japonais.
Pourquoi c'est importantLe chiffre intéressant n'est pas 42 — beaucoup de modèles y siègent. Ce qui compte, c'est le passage de 14 à 42 en une génération, depuis un laboratoire que la plupart des gens hors de Corée n'ont jamais évalué. La recette pour atteindre ce palier est désormais assez bien comprise pour qu'un laboratoire national de taille moyenne l'exécute en quelques mois, et c'est pourquoi le plancher des prix baisse plus vite que la frontière n'avance. L'Elo agentique au-dessus de la référence humaine mérite la prudence due à tout banc d'essai isolé, et la latence mérite d'être notée : ce score s'achète aussi avec du temps de calcul, pas seulement avec de meilleurs poids.
✓ Vérifié · 3 sources
▶ Vidéo associée: Solar Pro 4 First Look & Test – South Korea's DeepSeek Competitor!
Lire dans l'app — gratuit, en 9 langues
Actus liées
TikTok a glissé un chatbot d'achat dans la vidéo que vous regardez.
2026-10-06Reflection va offrir un modèle de 501 milliards de paramètres.
2026-10-06Wikimédia soupçonne des agents d'OpenAI pour la panne de mai.
2026-10-06Le nouveau modèle de Microsoft écrit avant que vous ayez fini.
2026-10-05Un laboratoire américain va offrir un modèle de niveau chinois.
2026-10-05