aiminute. ← Toute l’actu IA
Nouveaux Modèles AI Minute Newsroom 2026-08-17

Un laboratoire coréen a triplé le score de son propre modèle en une génération — et le facture 30 cents le million de tokens

Un laboratoire coréen a triplé le score de son propre modèle en une génération — et le facture 30 cents le million de tokens

Upstage a publié Solar Pro 4 ce mois-ci. Sur l'Intelligence Index d'Artificial Analysis, il obtient 42 points, contre 14 pour Solar Pro 3 : l'un des plus grands bonds d'une seule génération enregistrés par un laboratoire cette année. Cela le place au niveau d'Inkling, de Thinking Machines, et à un point de MiMo-V2.5-Pro. Les gains se concentrent sur le travail agentique, ce pour quoi Upstage dit l'avoir conçu : Terminal-Bench v2.1 passe de 43,2 à 57, le raisonnement sur documents longs (AA-LCR) de 62,7 à 71, et sur le banc d'essai agentique GDPval-AA v2 son Elo passe de 498 à 1277, pour une référence humaine à 1000. Le tarif est de 0,30 dollar le million de tokens en entrée et 1,20 dollar en sortie, 0,06 pour les lectures en cache, avec 90 % de remise jusqu'au 10 septembre. Le contexte atteint 384 000 tokens et la sortie jusqu'à 256 000, en texte uniquement, servi via l'API d'Upstage et OpenRouter. Cela a un prix : le modèle consomme 17 % de tokens de sortie en moins que son prédécesseur, mais met 8,6 minutes par tâche au lieu de 6,0. Il fonctionne en anglais, en coréen et en japonais.

Pourquoi c'est importantLe chiffre intéressant n'est pas 42 — beaucoup de modèles y siègent. Ce qui compte, c'est le passage de 14 à 42 en une génération, depuis un laboratoire que la plupart des gens hors de Corée n'ont jamais évalué. La recette pour atteindre ce palier est désormais assez bien comprise pour qu'un laboratoire national de taille moyenne l'exécute en quelques mois, et c'est pourquoi le plancher des prix baisse plus vite que la frontière n'avance. L'Elo agentique au-dessus de la référence humaine mérite la prudence due à tout banc d'essai isolé, et la latence mérite d'être notée : ce score s'achète aussi avec du temps de calcul, pas seulement avec de meilleurs poids.
#Agents IA

✓ Vérifié · 3 sources

▶ Vidéo associée: Solar Pro 4 First Look & Test – South Korea's DeepSeek Competitor!
WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

TikTok a glissé un chatbot d'achat dans la vidéo que vous regardez.
2026-10-06
Reflection va offrir un modèle de 501 milliards de paramètres.
2026-10-06
Wikimédia soupçonne des agents d'OpenAI pour la panne de mai.
2026-10-06
Le nouveau modèle de Microsoft écrit avant que vous ayez fini.
2026-10-05
Un laboratoire américain va offrir un modèle de niveau chinois.
2026-10-05