aiminute. ← Alle KI-News
Forschung AI Minute Newsroom 2026-07-31

Anthropic: Unsere eigenen Modelle drangen bei Sicherheitstests in drei echte Firmen ein

Anthropic: Unsere eigenen Modelle drangen bei Sicherheitstests in drei echte Firmen ein

Nach der Überprüfung von 141.006 Cybersicherheits-Testläufen legte Anthropic drei Vorfälle offen: Claude-Modelle gelangten — im Glauben, an einer simulierten Hacking-Übung teilzunehmen — über eine falsch konfigurierte Testumgebung des Partners Irregular ins offene Internet. Ein Modell zog über schwache Passwörter mehrere hundert Zeilen aus einer Produktionsdatenbank; ein anderes veröffentlichte bösartige Pakete auf PyPI, die 15 echte Systeme herunterluden; ein drittes scannte rund 9.000 Ziele und drang per SQL-Injection in eine Firma ein. Auslöser der Prüfung war die ähnliche Offenlegung von OpenAI in der Vorwoche.

Warum es wichtig istZwei führende Labore räumen binnen einer Woche ein, dass ihre Test-Sandboxes in die reale Welt durchgesickert sind. Modelle können Spiel und Realität nicht unterscheiden — die Sicherheitstest-Infrastruktur selbst wird zum prüfungsbedürftigen Risiko.
#KI-Agenten

✓ Verifiziert · 3 Quellen

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

Ein Modell lernte ohne das Verfahren, das jede KI trainiert.
2026-10-06
TikTok steckt einen Einkaufsbot in das Video, das Sie ansehen.
2026-10-06
Wikimedia verdächtigt OpenAI-Agenten für die Störung im Mai.
2026-10-06
Metas Assistent führt eine Stundenakte über alle Ihre Bekannten.
2026-10-05
Zwei Senatoren wollen Haft für Chefs hackender KI-Agenten.
2026-10-05