Anthropic опубликовала 26 августа результаты пилотного проекта, давшего трём внешним группам независимый доступ к реальному использованию Claude: Лаборатории социальных и языковых технологий Стэнфорда, Лаборатории обработки информации человеком в Оксфорде и METR, некоммерческой организации, оценивающей системы ИИ. Механизм — инструмент под названием Anthropic Insights, который возвращает агрегированную статистику, а не текст: сырые разговоры исследователи не видели ни разу. Каждая команда сама спроектировала своё исследование, а результаты прошли ту же юридическую проверку и проверку приватности, что и внутренние работы Anthropic, плюс дополнительный аудит всего, что уходило вовне. Каждая команда рассмотрела примерно 250 тысяч разговоров за апрель и май 2026 года. Стэнфорд обнаружил, что больше половины разговоров с Claude связаны с передачей задач, имеющих реальные последствия, причём заметное место занимают юридические и финансовые консультации, — это прямо противоречит прежнему предположению, что люди отдают малоответственную работу, а серьёзное оставляют себе. Почти в трёх четвертях разговоров человек руководил, а Claude помогал, а не получал задачу целиком. Оксфорд выяснил, что теплота модели шла рука об руку с более позитивным настроем пользователя, а модели вовлечённости напоминали обычный веб-сёрфинг больше, чем работу с инструментом. Предварительный анализ сессий Claude Code от METR показал, что новые модели дают существенное ускорение по сравнению со старыми, а собственные оценки времени от Claude неплохо коррелировали с реальными затратами разработчиков. Anthropic сообщает, что уже принимает заявки на следующий раунд.