Индустрия
AI Minute Newsroom
2026-08-19
Тот же чип, та же фабрика, примерно вдвое выше частота — и стойка, потребляющая столько же, сколько сорок домов
18 августа Cerebras представила CS-4 — первую машину платформы стоечного масштаба, которую компания называет Nexus. Стойка вмещает до трёх пластин размером с обеденную тарелку и в сумме даёт 750 петафлопс разреженных вычислений FP16, 129,6 петабайта в секунду пропускной способности памяти, 7,2 терабита в секунду ввода-вывода и 132 гигабайта памяти на самой пластине. Компания заявляет о скорости до двух раз выше, чем у CS-3, и до тридцатикратного превосходства над системами на видеокартах по числу токенов в секунду на одного пользователя на передовых моделях. Кремний не новый: та же 5-нанометровая разработка TSMC, и The Register подсчитывает, что удвоение получено главным образом за счёт примерно двукратного повышения тактовой частоты, до величины около 2,8 гигагерца, из-за чего каждая пластина потребляет, по оценке, 33 киловатта, а полная стойка — от 120 до 140. Первые системы заработают до конца квартала. Cerebras также объединяет свои стойки с системами AMD Helios и чипами AWS Trainium: те берут на себя ту половину работы, где читается запрос, а Cerebras пишет ответ.
Почему это важноЗаголовочную цифру стоит читать внимательно. Значение в 750 петафлопс опирается на разреженность, которая, как правило, мало помогает выводу языковых моделей, а пиковая пропускная способность памяти может быть теоретической, а не достижимой; The Register указывает на оба обстоятельства. Не вызывает сомнений другое — направление: быстрее всего доставить модель одному нетерпеливому пользователю теперь помогают не дополнительные чипы, а более горячие, и счёт за электричество здесь честная мера. Стойка на 140 киловатт — не машина, которую вставляют в существующий машинный зал. Это повод построить другой зал.
✓ Проверено · 3 источников
▶ Видео по теме: Beyond GPUs: Cerebras' Wafer-Scale Engine for Lightning-Fast AI Inference
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Лучшая модель Китая отстаёт от американской на три процента.
2026-10-06Банки берут чипы Nvidia в залог по кредитам на дата-центры Азии.
2026-10-06ChatGPT подписывает поддельные карикатуры именами реальных авторов.
2026-10-06Qualcomm купит лицензию на метод Huawei по склейке пластин.
2026-10-06Wikimedia подозревает агентов OpenAI в майском сбое.
2026-10-06