aiminute. ← Toute l’actu IA
Nouveaux Modèles AI Minute Newsroom 2026-08-14

Le modèle le plus rapide d'OpenAI n'est pas un modèle plus petit : c'est le même, tournant sur les puces d'un concurrent

Le modèle le plus rapide d'OpenAI n'est pas un modèle plus petit : c'est le même, tournant sur les puces d'un concurrent

OpenAI a ouvert le 13 août une préversion limitée du mode Ultrafast : GPT-5.6 Sol servi jusqu'à 750 tokens de sortie par seconde dans l'API, ce que l'entreprise chiffre à jusqu'à 14 fois sa vitesse standard. Cette vitesse ne vient pas d'un modèle distillé ou allégé mais du matériel de Cerebras, de sorte que la sortie doit être exactement le Sol que les clients utilisent déjà. L'accès est réservé à un petit groupe de clients API le temps d'étendre la capacité, et OpenAI n'a pas publié de tarifs. L'entreprise cite comme usages la réponse aux incidents, le support client, l'analyse financière et le commerce en ligne, des charges de travail où le facteur limitant est la latence et non la capacité brute.

Pourquoi c'est importantJusqu'ici, obtenir une réponse rapide revenait à en accepter une moins bonne : modèle plus petit, contexte plus court, réglage spécialisé. Dissocier la vitesse de la capacité change la liste des produits réalisables : un agent qui doit passer vingt appels d'outils avant de dire quoi que ce soit est inutilisable à vitesse standard et parfaitement banal à 750 tokens par seconde. L'annonce contient aussi un aveu plus discret. Le service de frontière le plus rapide d'OpenAI tourne sur le silicium d'un concurrent, pas sur celui de Nvidia ni sur l'infrastructure que l'entreprise construit à coups de centaines de milliards de dollars.

✓ Vérifié · 3 sources

▶ Vidéo associée: Why OpenAI Chose Cerebras Over NVIDIA for GPT-5.6 Sol
WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Reflection va offrir un modèle de 501 milliards de paramètres.
2026-10-06
Le nouveau modèle de Microsoft écrit avant que vous ayez fini.
2026-10-05
Un laboratoire américain va offrir un modèle de niveau chinois.
2026-10-05
Un site de vidéo offre le meilleur modèle ouvert de traduction.
2026-10-05
La moitié des appelés ont cru parler à un humain en vidéo.
2026-10-04