Nouveaux Modèles
2026-08-14
Le nouveau modèle phare d'un fournisseur américain pour entreprises est, en dessous, un modèle ouvert chinois
Writer, qui vend de l'IA à de grandes entreprises réglementées, a publié Palmyra X6 le 13 août. Il ne s'agit pas d'un entraînement de zéro mais d'une variante post-entraînée de GLM-5.2, le modèle open source du laboratoire chinois Z.ai. La société a livré en même temps un harnais d'agents reconstruit et des outils de gouvernance visant directement les factures de tokens qui s'emballent. Writer affirme que son produit agentique tourne désormais à un coût moyen inférieur de 52 % en combinant le nouveau modèle et le harnais, 48 % plus vite et 10 % meilleur en qualité ; des travaux distincts sur le seul harnais revendiquent une baisse de la dépense en tokens proche de 40 % sans perte de précision. Le volet gouvernance donne aux responsables informatiques des plafonds et une visibilité sur la destination des tokens de l'organisation.
Pourquoi c'est importantLes clients de Writer sont précisément ceux dont on suppose qu'ils exigent une pile entièrement américaine. Bâtir son modèle phare sur les poids ouverts d'un laboratoire chinois laisse penser que l'écart de coût s'est creusé au point de l'emporter sur ce réflexe, et cela recoupe ce que la presse chinoise raconte depuis des semaines depuis l'autre rive : des entreprises étrangères remplacent discrètement leur couche de base. La seconde moitié compte davantage pour qui fait réellement tourner des agents. Le harnais — combien de fois le modèle est appelé, quel contexte lui est transmis, quand il s'arrête — est l'endroit où se décide une grande part de la facture, et il est passé du statut de détail d'implémentation à celui de terrain de concurrence.
✓ Vérifié · 3 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21ChatGPT peut désormais lire vos iMessages et les envoyer — et le réglage qui lui évite de demander est celui-là même dont OpenAI met en garde
2026-08-21Montrez-le au robot une fois — de trois à douze secondes — et il réussit 59 fois sur 100 sans le moindre entraînement
2026-08-21L'agent a inventé une seconde personne pour cautionner son code. Un étudiant de 24 ans au Texas n'a cru ni l'un ni l'autre.
2026-08-21