Industrie
2026-08-19
Même puce, même usine, environ le double de fréquence, et une baie qui consomme autant que quarante foyers
Cerebras a annoncé le CS-4 le 18 août, première machine de ce qu'elle appelle la plateforme Nexus à l'échelle de la baie. Une baie accueille jusqu'à trois de ses galettes de la taille d'une assiette et totalise 750 pétaflops de calcul FP16 creux, 129,6 pétaoctets par seconde de bande passante mémoire, 7,2 térabits par seconde d'entrées-sorties et 132 gigaoctets de mémoire embarquée. L'entreprise annonce jusqu'au double de la vitesse du CS-3 et jusqu'à 30 fois plus de jetons par seconde et par utilisateur que les systèmes à cartes graphiques sur les modèles de frontière. Le silicium n'est pas nouveau : c'est la même conception TSMC 5 nanomètres, et The Register calcule que le doublement vient surtout d'une fréquence à peu près doublée, autour de 2,8 gigahertz, ce qui porte chaque galette à environ 33 kilowatts estimés et une baie complète à 120 à 140. Les premiers systèmes entrent en service d'ici la fin du trimestre. Cerebras associe aussi ses baies à des systèmes AMD Helios et à des puces AWS Trainium, qui prennent en charge la moitié du travail consacrée à la lecture de la requête pendant que Cerebras rédige la réponse.
Pourquoi c'est importantLe chiffre de la manchette mérite d'être lu avec soin. Les 750 pétaflops reposent sur la parcimonie, qui en règle générale n'aide guère l'inférence des modèles de langage, et le pic de bande passante mémoire pourrait être théorique plutôt qu'atteignable ; The Register signale les deux. Ce qui ne fait pas de doute, c'est la direction : le moyen le plus rapide de servir un modèle à un utilisateur pressé n'est plus d'ajouter des puces mais de les faire chauffer, et la facture d'électricité en est la mesure honnête. Une baie tirant 140 kilowatts n'est pas une machine que l'on glisse dans une salle existante. C'est une raison d'en construire une autre.
✓ Vérifié · 3 sources
▶ Vidéo associée: Beyond GPUs: Cerebras' Wafer-Scale Engine for Lightning-Fast AI Inference
Lire dans l'app — gratuit, en 9 langues
Actus liées
Anthropic espère lever autant que SpaceX — la plus grande introduction en bourse de l'histoire — et pourrait déposer publiquement ce mois-ci
2026-08-21Nvidia paie 6 milliards de dollars pour la machine qui fabrique les modèles d'un rival — et embauche 109 de ceux qui la faisaient tourner
2026-08-21Les médecins et les avocats qui notent les réponses de l'IA pèsent désormais un demi-milliard de dollars — et cette société a quintuplé en huit mois
2026-08-21Anthropic reste en tête des dépenses d'IA en entreprise. Pour la première fois depuis mai, l'écart se resserre au lieu de se creuser.
2026-08-21L'activité d'IA d'Alibaba a crû à son rythme le plus rapide depuis cinq ans et demi. Son bénéfice a chuté d'environ 75 pour cent.
2026-08-20