aiminute. ← Все новости ИИ
Новые модели 2026-08-14

Самая быстрая модель OpenAI — не уменьшенная модель, а та же самая, но на чипах конкурента

Самая быстрая модель OpenAI — не уменьшенная модель, а та же самая, но на чипах конкурента

13 августа OpenAI открыла ограниченный предпросмотр режима Ultrafast: GPT-5.6 Sol отдаётся в API со скоростью до 750 выходных токенов в секунду, что компания оценивает как до 14 раз быстрее стандартного режима. Скорость обеспечивается не дистиллированной или урезанной моделью, а оборудованием Cerebras, поэтому результат должен совпадать с тем Sol, которым клиенты уже пользуются. Доступ ограничен небольшой группой клиентов API, пока наращивается мощность, цены OpenAI не публиковала. В качестве сценариев компания называет реагирование на инциденты, клиентскую поддержку, финансовый анализ и электронную коммерцию — задачи, где ограничением служит задержка, а не сами способности модели.

Почему это важноДо сих пор быстрый ответ означал согласие на худший: меньшая модель, более короткий контекст, узкоспециализированная дообученная версия. Отделение скорости от возможностей меняет набор продуктов, которые вообще можно построить: агент, которому нужно сделать двадцать вызовов инструментов, прежде чем что-то сказать, при стандартной скорости непригоден, а при 750 токенах в секунду совершенно обычен. В объявлении есть и менее громкое признание. Самая быстрая фронтир-выдача OpenAI работает на кремнии конкурента — не на Nvidia и не на той инфраструктуре, в которую компания вкладывает сотни миллиардов долларов.

✓ Проверено · 3 источников

▶ Видео по теме: Why OpenAI Chose Cerebras Over NVIDIA for GPT-5.6 Sol
WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21
Покажите роботу один раз — от трёх до двенадцати секунд — и он выполнит работу верно 59 раз из 100 вовсе без обучения
2026-08-21
Модель сама придумывает себе задачи, сама собирает стенд для их проверки и потом на результате обучается — а DeepReinforce ещё и раздала веса
2026-08-20
Бесплатная модель, помещающаяся на одну видеокарту, набирает 52 — и тратит 22 276 токенов размышления, чтобы нарисовать картинку
2026-08-18
Zhipu не строила новую модель. Она продолжила обучать старую — и утверждает, что программирование стало лучше на 50 процентов
2026-08-17