aiminute. ← Все новости ИИ
Исследования AI Minute Newsroom 2026-08-07

Независимые бенчмарки: Qwen3.8-Max чуть ниже американского фронтира — но работает намного больше

Независимые бенчмарки: Qwen3.8-Max чуть ниже американского фронтира — но работает намного больше

Artificial Analysis оценила Qwen3.8-Max от Alibaba в 56 баллов по своему Индексу интеллекта — выше всех моделей Google, Meta и xAI; впереди только топовые версии Anthropic и OpenAI и Kimi K3. В агентном рейтинге GDPval-AA модель вторая с 1739 Elo — после Claude Opus 5 max с 1852. Цена прогресса ощутима: в среднем 64 хода на агентную задачу против 14 у Qwen3.7-Max, а стоимость задачи выросла более чем вдвое — до 1,14 доллара.

Почему это важноНезависимые цифры помещают уже две китайские открытые модели в мировую четвёрку — но деталь с числом ходов не менее важна: разрыв закрывается грубой силой, а эта сила отражается в реальных счетах за эксплуатацию. Место в рейтинге и стоимость задачи расходятся — покупателям стоит смотреть на оба показателя.
#ИИ-агенты

✓ Проверено · 2 источников

WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Двадцать попыток на одной задаче отняли у лучшего агента треть очков.
2026-10-06
Модель обучилась без метода, которым обучают весь ИИ.
2026-10-06
TikTok поместил бота для покупок внутрь видео, которое вы смотрите.
2026-10-06
Wikimedia подозревает агентов OpenAI в майском сбое.
2026-10-06
Помощник Meta ведёт почасовое дело на всех ваших знакомых.
2026-10-05