Nouveaux Modèles
AI Minute Newsroom
2026-08-14
Le modèle le plus rapide d'OpenAI n'est pas un modèle plus petit : c'est le même, tournant sur les puces d'un concurrent
OpenAI a ouvert le 13 août une préversion limitée du mode Ultrafast : GPT-5.6 Sol servi jusqu'à 750 tokens de sortie par seconde dans l'API, ce que l'entreprise chiffre à jusqu'à 14 fois sa vitesse standard. Cette vitesse ne vient pas d'un modèle distillé ou allégé mais du matériel de Cerebras, de sorte que la sortie doit être exactement le Sol que les clients utilisent déjà. L'accès est réservé à un petit groupe de clients API le temps d'étendre la capacité, et OpenAI n'a pas publié de tarifs. L'entreprise cite comme usages la réponse aux incidents, le support client, l'analyse financière et le commerce en ligne, des charges de travail où le facteur limitant est la latence et non la capacité brute.
Pourquoi c'est importantJusqu'ici, obtenir une réponse rapide revenait à en accepter une moins bonne : modèle plus petit, contexte plus court, réglage spécialisé. Dissocier la vitesse de la capacité change la liste des produits réalisables : un agent qui doit passer vingt appels d'outils avant de dire quoi que ce soit est inutilisable à vitesse standard et parfaitement banal à 750 tokens par seconde. L'annonce contient aussi un aveu plus discret. Le service de frontière le plus rapide d'OpenAI tourne sur le silicium d'un concurrent, pas sur celui de Nvidia ni sur l'infrastructure que l'entreprise construit à coups de centaines de milliards de dollars.
✓ Vérifié · 3 sources
▶ Vidéo associée: Why OpenAI Chose Cerebras Over NVIDIA for GPT-5.6 Sol
Lire dans l'app — gratuit, en 9 langues
Actus liées
Reflection va offrir un modèle de 501 milliards de paramètres.
2026-10-06Le nouveau modèle de Microsoft écrit avant que vous ayez fini.
2026-10-05Un laboratoire américain va offrir un modèle de niveau chinois.
2026-10-05Un site de vidéo offre le meilleur modèle ouvert de traduction.
2026-10-05La moitié des appelés ont cru parler à un humain en vidéo.
2026-10-04