aiminute. ← Все новости ИИ
Новые модели 2026-08-17

Корейская лаборатория втрое подняла оценку собственной модели за одно поколение — по 30 центов за миллион токенов

Корейская лаборатория втрое подняла оценку собственной модели за одно поколение — по 30 центов за миллион токенов

Upstage выпустила Solar Pro 4 в этом месяце. В Intelligence Index от Artificial Analysis она набирает 42 балла против 14 у Solar Pro 3 — один из самых больших скачков за одно поколение, зафиксированных любой лабораторией в этом году. Это ставит её вровень с Inkling от Thinking Machines и на балл позади MiMo-V2.5-Pro. Прирост сосредоточен там, где, по словам Upstage, модель и создавалась, — в агентной работе: Terminal-Bench v2.1 вырос с 43,2 до 57, рассуждение по длинным документам AA-LCR — с 62,7 до 71, а на агентном бенчмарке GDPval-AA v2 её Elo поднялся с 498 до 1277 при человеческом ориентире в 1000. Цена — 0,30 доллара за миллион входных токенов и 1,20 доллара за миллион выходных, попадание в кэш — 0,06 доллара; сейчас действует скидка 90% до 10 сентября. Контекст — 384 000 токенов, вывод — до 256 000, только текст, доступ через API Upstage и OpenRouter. У этого есть цена: модель расходует на 17% меньше выходных токенов, чем предшественница, но тратит 8,6 минуты на задачу вместо 6,0. Работает на английском, корейском и японском.

Почему это важноИнтересна не цифра 42 — там сидит немало моделей. Интересен переход с 14 на 42 за одно поколение, причём от лаборатории, которую за пределами Кореи почти никто не тестировал. Рецепт выхода на этот уровень понят уже настолько хорошо, что средняя национальная лаборатория выполняет его за месяцы; поэтому ценовой пол падает быстрее, чем движется фронтир. К агентному Elo выше человеческого ориентира стоит относиться с осторожностью, которой заслуживает любой отдельный бенчмарк, и стоит отметить задержку: этот результат куплен не только лучшими весами, но и временем на часах.
#ИИ-агенты

✓ Проверено · 3 источников

▶ Видео по теме: Solar Pro 4 First Look & Test – South Korea's DeepSeek Competitor!
WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21
Четыре часа и один GPU, чтобы улучшить способ обучения ИИ: лучший агент набрал 0,25 из 1 — а большинство даже не попробовали
2026-08-21
ChatGPT теперь может читать ваши iMessage и отправлять их — а настройка, позволяющая ему не спрашивать, и есть та, о которой предупреждает сама OpenAI
2026-08-21
Покажите роботу один раз — от трёх до двенадцати секунд — и он выполнит работу верно 59 раз из 100 вовсе без обучения
2026-08-21
Агент выдумал второго человека, чтобы тот поручился за его код. 24-летний студент из Техаса не поверил ни одному из них.
2026-08-21