Industria
AI Minute Newsroom
2026-08-19
El mismo chip, la misma fábrica, más o menos el doble de reloj, y un armario que consume tanto como cuarenta casas
Cerebras anunció el CS-4 el 18 de agosto, la primera máquina de lo que llama la plataforma Nexus a escala de armario. Cada armario aloja hasta tres de sus obleas del tamaño de un plato y suma 750 petaflops de cómputo disperso en FP16, 129,6 petabytes por segundo de ancho de banda de memoria, 7,2 terabits por segundo de entrada y salida y 132 gigabytes de memoria sobre la propia oblea. La compañía dice que es hasta el doble de rápido que el CS-3 y entrega hasta 30 veces más tokens por segundo y por usuario que los sistemas basados en tarjetas gráficas en modelos de frontera. El silicio no es nuevo: es el mismo diseño de 5 nanómetros de TSMC, y The Register calcula que la duplicación viene sobre todo de hacerlo funcionar a casi el doble de frecuencia, unos 2,8 gigahercios, lo que lleva cada oblea a unos 33 kilovatios estimados y un armario completo a entre 120 y 140. Los primeros sistemas entran en servicio a finales de este trimestre. Cerebras también empareja sus armarios con sistemas AMD Helios y chips AWS Trainium, que se encargan de la mitad del trabajo dedicada a leer la petición mientras Cerebras escribe la respuesta.
Por qué importaConviene leer con cuidado la cifra del titular. Los 750 petaflops dependen de la dispersión, que por norma no ayuda mucho a la inferencia de modelos de lenguaje, y el pico de ancho de banda de memoria puede ser teórico más que alcanzable; The Register señala ambas cosas. Lo que no está en duda es la dirección: la forma más rápida de servir un modelo a un usuario impaciente ya no es poner más chips sino chips más calientes, y la factura eléctrica es la medida honesta. Un armario que consume 140 kilovatios no es una máquina que se enchufa en una sala de datos existente. Es un motivo para construir otra sala.
✓ Verificado · 3 fuentes
▶ Vídeo relacionado: Beyond GPUs: Cerebras' Wafer-Scale Engine for Lightning-Fast AI Inference
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
El mejor modelo chino se queda a tres por ciento del estadounidense.
2026-10-06Los bancos aceptan chips de Nvidia como garantía de créditos en Asia.
2026-10-06ChatGPT firma sus viñetas falsas con el nombre de dibujantes reales.
2026-10-06Qualcomm licenciará el método de Huawei para apilar dos obleas.
2026-10-06Wikimedia sospecha de agentes de OpenAI por la caída de mayo.
2026-10-06