Forschung
AI Minute Newsroom
2026-08-27
Externe Forscher durften erstmals die echten Chatprotokolle eines Labors auswerten. Mehr als die Hälfte der Gespräche war folgenreiche Arbeit.
Anthropic hat am 26. August die Ergebnisse eines Pilotprojekts veröffentlicht, das drei externen Gruppen unabhängigen Zugang zur tatsächlichen Claude-Nutzung gab: dem Social and Language Technologies Lab in Stanford, dem Human Information Processing Lab in Oxford und METR, der gemeinnützigen Organisation zur Bewertung von KI-Systemen. Der Mechanismus ist ein Werkzeug namens Anthropic Insights, das aggregierte Statistiken statt Texte zurückgibt — die Forscher sahen nie Rohgespräche. Jedes Team entwarf seine eigene Studie, und die Ergebnisse durchliefen dieselbe rechtliche und datenschutzrechtliche Prüfung wie Anthropics interne Arbeit, dazu ein zusätzliches Audit für alles extern Geteilte. Jedes Team betrachtete rund 250.000 Gespräche aus April und Mai 2026. Stanford stellte fest, dass in mehr als der Hälfte der Claude-Gespräche folgenreiche Aufgaben abgegeben wurden, wobei rechtliche und finanzielle Beratung deutlich hervorstach — was der bisherigen Annahme direkt widerspricht, Menschen delegierten das wenig Verantwortliche und behielten das Ernste für sich. In fast drei Vierteln der Gespräche führte der Mensch und Claude assistierte, statt dass die Aufgabe komplett übergeben wurde. Oxford fand, dass Wärme im Modell mit positiverem Empfinden der Nutzer einherging und die Interaktionsmuster eher gewöhnlichem Surfen ähnelten als dem Bedienen eines Werkzeugs. METRs vorläufige Auswertung von Claude-Code-Sitzungen ergab, dass neuere Modelle gegenüber älteren eine deutliche Beschleunigung bringen und dass Claudes eigene Zeitschätzungen recht gut mit der tatsächlichen Dauer der Entwickler korrelierten. Anthropic nimmt nach eigenen Angaben nun Interessensbekundungen für die nächste Runde entgegen.
Warum es wichtig istNahezu alles, was die Öffentlichkeit über die tatsächliche Nutzung dieser Systeme weiß, stammt von den Unternehmen, die sie verkaufen — in Berichten, die sie selbst schreiben, über Daten, die nur sie sehen. Das ist keine Verschwörung, sondern ein strukturelles Problem: Es gab keine Möglichkeit zur Überprüfung. Dieses Pilotprojekt behebt das nicht, und man sollte die Grenzen genau benennen: Anthropic wählte die Teilnehmer aus, baute das Werkzeug, führte die Prüfung durch und veröffentlichte die Zusammenfassung. Das ist unabhängige Analyse, nicht unabhängiger Zugang. Dennoch ist es das erste Mal, dass externe Wissenschaftler Erkenntnisse aus den Live-Nutzungsdaten eines Frontier-Labors veröffentlichen, und der Präzedenzfall wiegt schwerer als jede einzelne Zahl. Von den Zahlen verdient eine die Aufmerksamkeit aller, die Regeln schreiben: Wenn die Mehrheit der Gespräche folgenreiche Delegation umfasst und ein guter Teil davon Rechts- und Finanzberatung ist, dann trägt der kleingedruckte Haftungsausschluss am unteren Rand des Chatfensters weit mehr Gewicht, als je für ihn vorgesehen war.
✓ Verifiziert · 2 Quellen
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Nikon entzog einem Mikroskopvideo den Preis wegen generativer KI.
2026-10-11Kein KI-Modell konnte eine Forschungsidee vom Januar neu erfinden.
2026-10-11Ein OpenAI-Prüfmodell zerstörte seine Umgebung für einen Neustart.
2026-10-11Ein Drittel einer neuen UV-Karte des Himmels ist nur vorhergesagt.
2026-10-10Nur 31 chinesische KI-Modelle kamen mit einem Sicherheitsbericht.
2026-10-10