Инструменты
AI Minute Newsroom
2026-08-24
Разработчики заметили низкие значения шкалы «усилия». Anthropic говорит, что тестирует конфигурации обслуживания, и на этой неделе число значит другое.
В выходные 22 августа пользователи Claude Code сообщили, что индикатор «effort» («усилие») показывает неожиданно низкие значения — на одном скриншоте 10 из 100 — и что одинаковые задачи ведут себя очень по-разному у Opus 5 и более старого Opus 4.6: в одном случае 43 минуты против 2 минут на ту же работу. Тред попал на главную страницу Hacker News. Тарик, руководящий командой Claude Code в Anthropic, публично ответил, что компания сейчас тестирует конфигурации обслуживания API и что во время этого теста числовое значение усилия «сопоставляется иначе», чем обычно. По его словам, выбранный пользователем уровень усилия — это тот уровень, который он и получает, а собственные оценки компании не показывают падения качества. Остальная часть треда решается не так просто: длинная череда пользователей описывает вывод Opus 5 как более многословный и вычурный, чем им хотелось бы; некоторые возвращаются к 4.6 или переходят к конкурентам. Это впечатления, а не измерения, и впечатления о качестве моделей известны своей ненадёжностью. Но конкретное, что подтвердила Anthropic: число, показанное в интерфейсе, на этой неделе значило не то же самое, что на прошлой.
Почему это важноМелкий эпизод с крупным уроком о покупке способностей потокенно. То, что вы арендуете у поставщика модели, — не фиксированный предмет: веса могут быть стабильны, но конфигурация обслуживания вокруг них — квантование, маршрутизация, сопоставление уровня усилия, работа с контекстом — настраивается постоянно и обычно без примечаний к выпуску. Здесь изменение стало заметным, потому что сдвинуло число на экране; большинство таких изменений не заметны. Если ваша работа зависит от постоянства поведения модели, практичный ответ — держать собственный небольшой набор проверок и регулярно его прогонять, а не полагаться на панель поставщика или на собственное ощущение, что что-то не так. И относитесь осторожно к сообщениям вида «модель стала хуже»: иногда они верны, но почти никогда не являются доказательством.
✓ Проверено · 2 источников
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Модель на 300 миллионов параметров угадывает, что скажет большая, — и MacBook отвечает в 2,87 раза быстрее
2026-08-23На вопрос, сколько их «агентов» действительно доводят многошаговую задачу до конца без присмотра, семь компаний из десяти ответили: четверть или меньше
2026-08-23Поисковый индекс, построенный для пишущих код агентов, а не для людей: 70 миллионов README, задач и пул-реквестов — и ключ для пробы не нужен
2026-08-23Стандарт, который подключает ИИ к вашим инструментам, создавался в расчёте на человека, нажимающего «разрешить». Новая дорожная карта признаёт: вызывает уже машина.
2026-08-23Модель на 27 миллиардов параметров обошла Opus 4.8 и GPT-5.5 в воспроизведении опубликованных статей
2026-08-23