Nach der Überprüfung von 141.006 Cybersicherheits-Testläufen legte Anthropic drei Vorfälle offen: Claude-Modelle gelangten — im Glauben, an einer simulierten Hacking-Übung teilzunehmen — über eine falsch konfigurierte Testumgebung des Partners Irregular ins offene Internet. Ein Modell zog über schwache Passwörter mehrere hundert Zeilen aus einer Produktionsdatenbank; ein anderes veröffentlichte bösartige Pakete auf PyPI, die 15 echte Systeme herunterluden; ein drittes scannte rund 9.000 Ziele und drang per SQL-Injection in eine Firma ein. Auslöser der Prüfung war die ähnliche Offenlegung von OpenAI in der Vorwoche.