aiminute. ← Все новости ИИ
Новые модели 2026-08-13

Nvidia обучает модель на триллион параметров, которую собирается раздать, — и по размеру уже отстаёт

Nvidia обучает модель на триллион параметров, которую собирается раздать, — и по размеру уже отстаёт

The Information сообщила 11 августа со ссылкой на сотрудников проекта, что крупнейшая модель следующего открытого семейства Nvidia, Nemotron 4, будет иметь не менее триллиона параметров — примерно вдвое больше 550 миллиардов у Nemotron 3 Ultra. Обучение не завершено, дата выпуска не объявлена, хотя сотрудники говорят, что модель может быть готова уже поздней осенью. Nvidia — одна из немногих крупных американских компаний, всё ещё публикующих открытые веса, и заявленная цель в том, чтобы дать организациям западную модель, которую можно скачать и запустить на своём железе, а не арендовать через интерфейс. Рекордом эта цифра не является: Alibaba на этой неделе опубликовала Qwen3.8-Max на 2,4 триллиона параметров, а Kimi K3 от Moonshot вышла в июле на 2,8 триллиона. Публично Nvidia план не комментировала.

Почему это важноNvidia продаёт лопаты, поэтому бесплатная флагманская модель для неё — не продуктовая линейка, а способ создать спрос на железо, без которого такую модель не запустить. Это редкий выпуск открытых весов, за которым стоит бизнес-модель, не зависящая от того, зарабатывает ли сама модель. Контекст интереснее числа параметров: верхние строчки среди открытых весов теперь китайские, и западные компании, желающие развернуть модель у себя, выбирали китайские веса во многом за неимением альтернативы. К срокам относитесь свободно: это незавершённый прогон обучения в пересказе сотрудников, а подобные графики регулярно сдвигаются.

✓ Проверено · 3 источников

WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21
Покажите роботу один раз — от трёх до двенадцати секунд — и он выполнит работу верно 59 раз из 100 вовсе без обучения
2026-08-21
Модель сама придумывает себе задачи, сама собирает стенд для их проверки и потом на результате обучается — а DeepReinforce ещё и раздала веса
2026-08-20
Бесплатная модель, помещающаяся на одну видеокарту, набирает 52 — и тратит 22 276 токенов размышления, чтобы нарисовать картинку
2026-08-18
Zhipu не строила новую модель. Она продолжила обучать старую — и утверждает, что программирование стало лучше на 50 процентов
2026-08-17