aiminute. ← Все новости ИИ
Индустрия AI Minute Newsroom 2026-08-19

Тот же чип, та же фабрика, примерно вдвое выше частота — и стойка, потребляющая столько же, сколько сорок домов

Тот же чип, та же фабрика, примерно вдвое выше частота — и стойка, потребляющая столько же, сколько сорок домов

18 августа Cerebras представила CS-4 — первую машину платформы стоечного масштаба, которую компания называет Nexus. Стойка вмещает до трёх пластин размером с обеденную тарелку и в сумме даёт 750 петафлопс разреженных вычислений FP16, 129,6 петабайта в секунду пропускной способности памяти, 7,2 терабита в секунду ввода-вывода и 132 гигабайта памяти на самой пластине. Компания заявляет о скорости до двух раз выше, чем у CS-3, и до тридцатикратного превосходства над системами на видеокартах по числу токенов в секунду на одного пользователя на передовых моделях. Кремний не новый: та же 5-нанометровая разработка TSMC, и The Register подсчитывает, что удвоение получено главным образом за счёт примерно двукратного повышения тактовой частоты, до величины около 2,8 гигагерца, из-за чего каждая пластина потребляет, по оценке, 33 киловатта, а полная стойка — от 120 до 140. Первые системы заработают до конца квартала. Cerebras также объединяет свои стойки с системами AMD Helios и чипами AWS Trainium: те берут на себя ту половину работы, где читается запрос, а Cerebras пишет ответ.

Почему это важноЗаголовочную цифру стоит читать внимательно. Значение в 750 петафлопс опирается на разреженность, которая, как правило, мало помогает выводу языковых моделей, а пиковая пропускная способность памяти может быть теоретической, а не достижимой; The Register указывает на оба обстоятельства. Не вызывает сомнений другое — направление: быстрее всего доставить модель одному нетерпеливому пользователю теперь помогают не дополнительные чипы, а более горячие, и счёт за электричество здесь честная мера. Стойка на 140 киловатт — не машина, которую вставляют в существующий машинный зал. Это повод построить другой зал.

✓ Проверено · 3 источников

▶ Видео по теме: Beyond GPUs: Cerebras' Wafer-Scale Engine for Lightning-Fast AI Inference
WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Лучшая модель Китая отстаёт от американской на три процента.
2026-10-06
Банки берут чипы Nvidia в залог по кредитам на дата-центры Азии.
2026-10-06
ChatGPT подписывает поддельные карикатуры именами реальных авторов.
2026-10-06
Qualcomm купит лицензию на метод Huawei по склейке пластин.
2026-10-06
Wikimedia подозревает агентов OpenAI в майском сбое.
2026-10-06