Outils
AI Minute Newsroom
2026-08-22
OpenAI a donné le moteur qui tourne sous Codex, et ses propres chiffres disent que le moteur vaut plus que le modèle
Le 20 août, OpenAI a publié sous licence Apache-2.0 le harnais qui soutient Codex, c'est-à-dire la pièce qui fait réellement tourner un agent. L'outil en ligne de commande était déjà ouvert ; ce qui est nouveau, c'est le SDK Codex et l'app-server, un moteur JSON-RPC qui garde une session vivante, avec l'invitation à les pointer vers autre chose que du code. Le harnais gère la boucle que personne ne voit : comprendre la tâche, garder la mémoire au fil d'une longue conversation, diffuser les événements, appeler des outils, accepter d'être interrompu, synchroniser l'état et s'arrêter pour demander l'accord d'un humain. Le plus frappant reste la mesure d'OpenAI elle-même. En ne changeant que le harnais autour de GPT-5.6 Sol — en conservant le raisonnement entre les tours et en compressant le contexte — son score sur ARC-AGI-3 est passé de 13,3 pour cent à 38,3 pour cent, et la consommation de jetons a été divisée par six. Le même modèle. Une réserve s'impose à côté de ce chiffre : les organisateurs d'ARC Prize, en faisant tourner le modèle à leur façon et de manière neutre, ont obtenu 7,8 pour cent ; les 38,3 sont donc le harnais d'OpenAI dans les conditions d'OpenAI. Greg Brockman l'a résumé ainsi : Codex peut piloter bien plus que des outils de programmation. Cisco a bâti un App Builder sur le SDK, Thrive Holdings y a déployé des agents, et un pilote fiscal a traité 7 000 déclarations en réduisant le temps de préparation d'environ un tiers. Le dépôt affiche 112 000 étoiles et publie des versions alpha tous les jours.
Pourquoi c'est importantUne semaine plus tôt, DeepSeek avait ouvert son propre harnais sous licence MIT et récolté 26 000 étoiles en trois heures. Le plus grand laboratoire fermé vient de faire la même chose sous Apache-2.0. Les deux plus grands noms du secteur ont décidé que le harnais n'est pas le produit — et si l'on croit le 13,3 puis 38,3 d'OpenAI, une bonne part de l'intelligence visible se cachait là depuis le début. Pour qui construit avec ces outils, la conséquence est concrète : l'écart entre un modèle qui patauge et un modèle qui termine relève peut-être d'un échafaudage dont on peut désormais lire le code, et non d'un modèle plus gros qu'il faudrait acheter. Cela dit aussi ce que les laboratoires jugent rare. Ils vous laissent la boucle gratuitement, parce que ce qu'ils vendent, ce sont les jetons qui la traversent.
✓ Vérifié · 4 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
Un modèle vocal qui commence à parler en moins de 50 millisecondes, et le code de service est ouvert
2026-08-22Donnez à un modèle la bibliographie d'un article non publié et demandez-lui ce que dit l'article. Les meilleurs trouvent 15 pour cent du temps.
2026-08-22Anthropic laisse son modèle le plus puissant traquer les failles de votre code, mais vous interdit de lui parler
2026-08-22Le modèle seul obtenait 30 pour cent. Enveloppé dans l'échafaudage de Nvidia, le même modèle a tout franchi.
2026-08-22Apple Music indiquera quand un morceau a été fait par une machine — mais c'est celui qui le publie qui décide de le dire
2026-08-21