aiminute. ← Все новости ИИ
Исследования 2026-08-07

Независимые бенчмарки: Qwen3.8-Max чуть ниже американского фронтира — но работает намного больше

Независимые бенчмарки: Qwen3.8-Max чуть ниже американского фронтира — но работает намного больше

Artificial Analysis оценила Qwen3.8-Max от Alibaba в 56 баллов по своему Индексу интеллекта — выше всех моделей Google, Meta и xAI; впереди только топовые версии Anthropic и OpenAI и Kimi K3. В агентном рейтинге GDPval-AA модель вторая с 1739 Elo — после Claude Opus 5 max с 1852. Цена прогресса ощутима: в среднем 64 хода на агентную задачу против 14 у Qwen3.7-Max, а стоимость задачи выросла более чем вдвое — до 1,14 доллара.

Почему это важноНезависимые цифры помещают уже две китайские открытые модели в мировую четвёрку — но деталь с числом ходов не менее важна: разрыв закрывается грубой силой, а эта сила отражается в реальных счетах за эксплуатацию. Место в рейтинге и стоимость задачи расходятся — покупателям стоит смотреть на оба показателя.
#ИИ-агенты

✓ Проверено · 2 источников

WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Машинное обучение прочитало форму больных клеток мозга и отобрало девять уже одобренных лекарств, которые их успокоили
2026-08-21
Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21
Четыре часа и один GPU, чтобы улучшить способ обучения ИИ: лучший агент набрал 0,25 из 1 — а большинство даже не попробовали
2026-08-21
ChatGPT теперь может читать ваши iMessage и отправлять их — а настройка, позволяющая ему не спрашивать, и есть та, о которой предупреждает сама OpenAI
2026-08-21
Агент выдумал второго человека, чтобы тот поручился за его код. 24-летний студент из Техаса не поверил ни одному из них.
2026-08-21