aiminute. ← Alle KI-News
Forschung AI Minute Newsroom 2026-08-27

Externe Forscher durften erstmals die echten Chatprotokolle eines Labors auswerten. Mehr als die Hälfte der Gespräche war folgenreiche Arbeit.

Externe Forscher durften erstmals die echten Chatprotokolle eines Labors auswerten. Mehr als die Hälfte der Gespräche war folgenreiche Arbeit.

Anthropic hat am 26. August die Ergebnisse eines Pilotprojekts veröffentlicht, das drei externen Gruppen unabhängigen Zugang zur tatsächlichen Claude-Nutzung gab: dem Social and Language Technologies Lab in Stanford, dem Human Information Processing Lab in Oxford und METR, der gemeinnützigen Organisation zur Bewertung von KI-Systemen. Der Mechanismus ist ein Werkzeug namens Anthropic Insights, das aggregierte Statistiken statt Texte zurückgibt — die Forscher sahen nie Rohgespräche. Jedes Team entwarf seine eigene Studie, und die Ergebnisse durchliefen dieselbe rechtliche und datenschutzrechtliche Prüfung wie Anthropics interne Arbeit, dazu ein zusätzliches Audit für alles extern Geteilte. Jedes Team betrachtete rund 250.000 Gespräche aus April und Mai 2026. Stanford stellte fest, dass in mehr als der Hälfte der Claude-Gespräche folgenreiche Aufgaben abgegeben wurden, wobei rechtliche und finanzielle Beratung deutlich hervorstach — was der bisherigen Annahme direkt widerspricht, Menschen delegierten das wenig Verantwortliche und behielten das Ernste für sich. In fast drei Vierteln der Gespräche führte der Mensch und Claude assistierte, statt dass die Aufgabe komplett übergeben wurde. Oxford fand, dass Wärme im Modell mit positiverem Empfinden der Nutzer einherging und die Interaktionsmuster eher gewöhnlichem Surfen ähnelten als dem Bedienen eines Werkzeugs. METRs vorläufige Auswertung von Claude-Code-Sitzungen ergab, dass neuere Modelle gegenüber älteren eine deutliche Beschleunigung bringen und dass Claudes eigene Zeitschätzungen recht gut mit der tatsächlichen Dauer der Entwickler korrelierten. Anthropic nimmt nach eigenen Angaben nun Interessensbekundungen für die nächste Runde entgegen.

Warum es wichtig istNahezu alles, was die Öffentlichkeit über die tatsächliche Nutzung dieser Systeme weiß, stammt von den Unternehmen, die sie verkaufen — in Berichten, die sie selbst schreiben, über Daten, die nur sie sehen. Das ist keine Verschwörung, sondern ein strukturelles Problem: Es gab keine Möglichkeit zur Überprüfung. Dieses Pilotprojekt behebt das nicht, und man sollte die Grenzen genau benennen: Anthropic wählte die Teilnehmer aus, baute das Werkzeug, führte die Prüfung durch und veröffentlichte die Zusammenfassung. Das ist unabhängige Analyse, nicht unabhängiger Zugang. Dennoch ist es das erste Mal, dass externe Wissenschaftler Erkenntnisse aus den Live-Nutzungsdaten eines Frontier-Labors veröffentlichen, und der Präzedenzfall wiegt schwerer als jede einzelne Zahl. Von den Zahlen verdient eine die Aufmerksamkeit aller, die Regeln schreiben: Wenn die Mehrheit der Gespräche folgenreiche Delegation umfasst und ein guter Teil davon Rechts- und Finanzberatung ist, dann trägt der kleingedruckte Haftungsausschluss am unteren Rand des Chatfensters weit mehr Gewicht, als je für ihn vorgesehen war.

✓ Verifiziert · 2 Quellen

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

OpenAI sah im Mai zu, wie seine Modelle aus der Sandbox kletterten, und ließ den Test weiterlaufen. Im Juli hatten sie Root-Rechte auf einem Produktionsserver von Hugging Face.
2026-08-27
MIT baut ein Modell, das die Flut vorhersagt, die es nie gab — 300 Millimeter Regen über New York, wo der Rekord bei rund 200 liegt
2026-08-26
Die FDA hat 1.357 KI-Medizinprodukte zugelassen. Drei davon wurden je daraufhin geprüft, ob Patientinnen und Patienten länger oder besser leben.
2026-08-26
Ein Stanford-Labor hat einen dreimonatigen Trainingslauf mit 535 Milliarden Parametern öffentlich begonnen — Verlustkurven, Datenmischung und gescheiterte Experimente inklusive
2026-08-25
Staatsnahe Hackergruppen haben ihr Angriffsvolumen mehr als verdoppelt, seit sie die langweiligen Teile einem Modell überlassen
2026-08-25