Исследования
2026-08-08
ARC Prize подтвердил результат DeepSeek V4 Flash: 61% на ARC-AGI-2 по четыре цента за задачу
Команда ARC Prize опубликовала проверенные полуприватные результаты открытой модели DeepSeek V4 Flash 0731: 89,0% на ARC-AGI-1 при цене около двух центов за задачу и 61,4% на ARC-AGI-2 около четырёх центов — на максимальном уровне рассуждений. Модель представляет собой смесь экспертов на 284 млрд параметров, активирующую лишь 13 млрд на токен, с контекстом в миллион токенов. Результат взлетел на вершину Hacker News, где больше всего обсуждали соотношение цены и качества.
Почему это важноARC-AGI-2 создавался устойчивым к зубрёжке и вознаграждающим настоящие абстрактные рассуждения; такой результат от открытой модели с малой активацией по копеечным ценам закрывает ещё один разрыв между открытым и закрытым ИИ. Для разработчиков это значит: рассуждения почти передового уровня теперь можно скачать и запустить самому, а не только арендовать.
✓ Проверено · 2 источников
▶ Видео по теме: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Машинное обучение прочитало форму больных клеток мозга и отобрало девять уже одобренных лекарств, которые их успокоили
2026-08-21Четыре часа и один GPU, чтобы улучшить способ обучения ИИ: лучший агент набрал 0,25 из 1 — а большинство даже не попробовали
2026-08-21Агент выдумал второго человека, чтобы тот поручился за его код. 24-летний студент из Техаса не поверил ни одному из них.
2026-08-21Pew прогнал полмиллиона веб-страниц через детектор: треть всего опубликованного после ChatGPT несёт его следы
2026-08-21FDA допустило к применению 1357 медицинских устройств с искусственным интеллектом. Проверку на то, живут ли пациенты дольше или лучше, прошли три.
2026-08-20