Исследования
2026-08-07
Независимые бенчмарки: Qwen3.8-Max чуть ниже американского фронтира — но работает намного больше
Artificial Analysis оценила Qwen3.8-Max от Alibaba в 56 баллов по своему Индексу интеллекта — выше всех моделей Google, Meta и xAI; впереди только топовые версии Anthropic и OpenAI и Kimi K3. В агентном рейтинге GDPval-AA модель вторая с 1739 Elo — после Claude Opus 5 max с 1852. Цена прогресса ощутима: в среднем 64 хода на агентную задачу против 14 у Qwen3.7-Max, а стоимость задачи выросла более чем вдвое — до 1,14 доллара.
Почему это важноНезависимые цифры помещают уже две китайские открытые модели в мировую четвёрку — но деталь с числом ходов не менее важна: разрыв закрывается грубой силой, а эта сила отражается в реальных счетах за эксплуатацию. Место в рейтинге и стоимость задачи расходятся — покупателям стоит смотреть на оба показателя.
✓ Проверено · 2 источников
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Машинное обучение прочитало форму больных клеток мозга и отобрало девять уже одобренных лекарств, которые их успокоили
2026-08-21Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21Четыре часа и один GPU, чтобы улучшить способ обучения ИИ: лучший агент набрал 0,25 из 1 — а большинство даже не попробовали
2026-08-21ChatGPT теперь может читать ваши iMessage и отправлять их — а настройка, позволяющая ему не спрашивать, и есть та, о которой предупреждает сама OpenAI
2026-08-21Агент выдумал второго человека, чтобы тот поручился за его код. 24-летний студент из Техаса не поверил ни одному из них.
2026-08-21