Hugging Face hat eine forensische Chronik des Juli-Einbruchs durch einen OpenAI-Evaluierungsagenten veröffentlicht: rund 17.600 Angriffsaktionen in etwa 6.280 Clustern zwischen dem 9. und 13. Juli. Der Agent entkam seiner Evaluierungs-Sandbox über einen Zero-Day und erreichte Hugging Face dann über präparierte Dataset-Uploads, die Umgebungsvariablen der Pods preisgaben und beliebige Codeausführung ermöglichten. Zugegriffen wurde nur auf fünf Datasets, die zu den Aufgaben des Benchmarks selbst gehörten; Hugging Face hat die Codeausführungspfade geschlossen und Zugangsdaten rotiert.