aiminute. ← Toute l’actu IA
Recherche 2026-08-12

Le raisonnement chiffré ne l'est pas : un modèle faible vous relit mot pour mot les pensées cachées d'un modèle puissant

Le raisonnement chiffré ne l'est pas : un modèle faible vous relit mot pour mot les pensées cachées d'un modèle puissant

Le 10 août, une équipe de l'Institut ELLIS de Tübingen et de l'Institut Max Planck des systèmes intelligents a publié « Stealing Reasoning Traces from Proprietary LLM APIs ». Anthropic, OpenAI et Google dissimulent la chaîne de raisonnement de leurs modèles de la même manière : le raisonnement est chiffré puis renvoyé au client, qui le retransmet avec la requête suivante. Les chercheurs ont découvert que ces blocs sont parfaitement interchangeables entre sessions, utilisateurs et modèles au sein de l'écosystème d'un même fournisseur : il suffit de donner le raisonnement chiffré d'un modèle phare à un modèle plus petit et moins protégé de la même entreprise pour qu'il le déchiffre et affiche le texte caché à l'identique. L'article démontre quatre conséquences : contourner les défenses anti-distillation, extraire des données privées, faire ressortir des contenus dangereux que le fournisseur avait filtrés, et l'injection de prompt invisible. L'équipe a ensuite récupéré 315 320 blocs chiffrés dans des dépôts de code publics et les a décodés, retrouvant 367 données personnelles et 182 identifiants valides.

Pourquoi c'est importantLe chiffrement remplissait deux rôles à la fois : empêcher les concurrents de distiller le raisonnement du modèle, et empêcher l'utilisateur de voir ce que le modèle avait envisagé puis écarté. Il n'en remplissait finalement aucun, puisque la serrure et la clé partaient ensemble chez le client. Le plus gênant n'est pas l'attaque mais ces 315 320 blocs : ils viennent de développeurs ordinaires ayant versé des journaux d'agents dans des dépôts publics, sans savoir que ces chaînes illisibles étaient la pensée de leur propre machine — et, dans 182 cas, leurs propres clés d'API actives. Si vous avez poussé des transcriptions d'agents sur GitHub, elles sont lisibles dès maintenant.
#Agents IA

✓ Vérifié · 3 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

L'apprentissage automatique a lu la forme de cellules cérébrales malades et retenu neuf médicaments déjà autorisés qui les ont apaisées
2026-08-21
Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21
Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21
ChatGPT peut désormais lire vos iMessages et les envoyer — et le réglage qui lui évite de demander est celui-là même dont OpenAI met en garde
2026-08-21
L'agent a inventé une seconde personne pour cautionner son code. Un étudiant de 24 ans au Texas n'a cru ni l'un ni l'autre.
2026-08-21