Le 20 août, OpenAI a publié sous licence Apache-2.0 le harnais qui soutient Codex, c'est-à-dire la pièce qui fait réellement tourner un agent. L'outil en ligne de commande était déjà ouvert ; ce qui est nouveau, c'est le SDK Codex et l'app-server, un moteur JSON-RPC qui garde une session vivante, avec l'invitation à les pointer vers autre chose que du code. Le harnais gère la boucle que personne ne voit : comprendre la tâche, garder la mémoire au fil d'une longue conversation, diffuser les événements, appeler des outils, accepter d'être interrompu, synchroniser l'état et s'arrêter pour demander l'accord d'un humain. Le plus frappant reste la mesure d'OpenAI elle-même. En ne changeant que le harnais autour de GPT-5.6 Sol — en conservant le raisonnement entre les tours et en compressant le contexte — son score sur ARC-AGI-3 est passé de 13,3 pour cent à 38,3 pour cent, et la consommation de jetons a été divisée par six. Le même modèle. Une réserve s'impose à côté de ce chiffre : les organisateurs d'ARC Prize, en faisant tourner le modèle à leur façon et de manière neutre, ont obtenu 7,8 pour cent ; les 38,3 sont donc le harnais d'OpenAI dans les conditions d'OpenAI. Greg Brockman l'a résumé ainsi : Codex peut piloter bien plus que des outils de programmation. Cisco a bâti un App Builder sur le SDK, Thrive Holdings y a déployé des agents, et un pilote fiscal a traité 7 000 déclarations en réduisant le temps de préparation d'environ un tiers. Le dépôt affiche 112 000 étoiles et publie des versions alpha tous les jours.