Recherche
AI Minute Newsroom
2026-08-12
Le raisonnement chiffré ne l'est pas : un modèle faible vous relit mot pour mot les pensées cachées d'un modèle puissant
Le 10 août, une équipe de l'Institut ELLIS de Tübingen et de l'Institut Max Planck des systèmes intelligents a publié « Stealing Reasoning Traces from Proprietary LLM APIs ». Anthropic, OpenAI et Google dissimulent la chaîne de raisonnement de leurs modèles de la même manière : le raisonnement est chiffré puis renvoyé au client, qui le retransmet avec la requête suivante. Les chercheurs ont découvert que ces blocs sont parfaitement interchangeables entre sessions, utilisateurs et modèles au sein de l'écosystème d'un même fournisseur : il suffit de donner le raisonnement chiffré d'un modèle phare à un modèle plus petit et moins protégé de la même entreprise pour qu'il le déchiffre et affiche le texte caché à l'identique. L'article démontre quatre conséquences : contourner les défenses anti-distillation, extraire des données privées, faire ressortir des contenus dangereux que le fournisseur avait filtrés, et l'injection de prompt invisible. L'équipe a ensuite récupéré 315 320 blocs chiffrés dans des dépôts de code publics et les a décodés, retrouvant 367 données personnelles et 182 identifiants valides.
Pourquoi c'est importantLe chiffrement remplissait deux rôles à la fois : empêcher les concurrents de distiller le raisonnement du modèle, et empêcher l'utilisateur de voir ce que le modèle avait envisagé puis écarté. Il n'en remplissait finalement aucun, puisque la serrure et la clé partaient ensemble chez le client. Le plus gênant n'est pas l'attaque mais ces 315 320 blocs : ils viennent de développeurs ordinaires ayant versé des journaux d'agents dans des dépôts publics, sans savoir que ces chaînes illisibles étaient la pensée de leur propre machine — et, dans 182 cas, leurs propres clés d'API actives. Si vous avez poussé des transcriptions d'agents sur GitHub, elles sont lisibles dès maintenant.
✓ Vérifié · 3 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
Un modèle a appris sans la méthode qui entraîne toutes les IA.
2026-10-06TikTok a glissé un chatbot d'achat dans la vidéo que vous regardez.
2026-10-06Wikimédia soupçonne des agents d'OpenAI pour la panne de mai.
2026-10-06L'assistant de Meta tient une fiche horaire sur vos proches.
2026-10-05Deux sénateurs veulent la prison pour les patrons d'agents pirates.
2026-10-05