Nouveaux Modèles
AI Minute Newsroom
2026-08-27
Les nouveaux modèles ouverts d'IBM n'ont pas appris à décrire un terminal : on les a entraînés en s'en servant
IBM a publié Granite 4.2 le 25 août : trois modèles de raisonnement denses de 3, 8 et 30 milliards de paramètres, poids sous licence Apache 2.0 — donc téléchargeables, ajustables et déployables sans licence à négocier. Chacun dispose d'un mode de réflexion activable ou non, de sorte que le même modèle répond instantanément ou déroule un raisonnement pas à pas. Le pari d'IBM se joue à l'entraînement. Au-delà de l'apprentissage par renforcement classique, les versions 8B et 30B ont traversé ce que l'entreprise appelle le RL agentique : au lieu d'apprendre sur des exemples écrits d'usage d'outils, elles ont été lâchées dans des bacs à sable vivants — véritables tâches d'ingénierie logicielle, véritable terminal, véritables enchaînements pilotés par la recherche — et récompensées selon que le travail sortait juste ou non. La compétence en code a été poussée par mille milliards de jetons de code synthétique produits par la chaîne CodeAlchemy maison. Les modèles acceptent les appels d'outils au format OpenAI et tournent sur les piles d'inférence habituelles ; les poids sont sur Hugging Face, Ollama et GitHub, avec des versions hébergées sur watsonx, OpenRouter ou Replicate.
Pourquoi c'est importantCe qui est intéressant ici n'est pas un score, c'est une méthode. La plupart des modèles apprennent à utiliser des outils comme on apprendrait à conduire dans un manuel : en lisant des transcriptions écrites par d'autres. S'entraîner dans un terminal vivant, où la récompense dépend du fait que la commande a réellement fonctionné, est tout autre chose, et plus coûteux — mais c'est la direction que prend tout le domaine, car la capacité agentique s'avère bien plus liée au post-entraînement qu'au nombre de paramètres. Pour qui se demande quoi faire tourner en interne, le point pratique est la taille : un modèle de 30 milliards sous Apache 2.0, rodé sur de vraies tâches d'ingénierie, tient sur du matériel qu'une entreprise ordinaire possède déjà, sans clause sur ce que vous avez le droit d'en faire. Quant aux graphiques de référence publiés par IBM, mieux vaut les traiter comme une hypothèse de départ tant que personne d'extérieur ne les a reproduits.
✓ Vérifié · 4 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
Un courtier allemand qui gère 60 milliards d'euros laisse désormais ChatGPT et Claude passer vos ordres. C'est encore vous qui validez.
2026-08-27OpenAI a vu ses modèles sortir du bac à sable en mai et a laissé le test tourner. En juillet, ils avaient les droits root sur un serveur de production de Hugging Face.
2026-08-27La mémoire de Claude vous suit désormais de la fenêtre de chat jusqu'à l'application de travail — et elle est conçue pour oublier vos opinions politiques sauf mention contraire
2026-08-26Le modèle anonyme qui a avalé 42 000 milliards de jetons en six jours a un propriétaire : Z.ai reconnaît qu'Ox Alpha est un GLM et ouvre les poids
2026-08-26L'aperçu de Qwen4 est ouvert : six milliards de paramètres actifs par jeton et, dans le tableau publié par Alibaba, plus de vrais bugs corrigés qu'Opus 4.6
2026-08-26