Cerebras CS-4 : accélérateur IA jusqu'à 30x plus rapide que les GPU
Original : Cerebras CS-4
Pourquoi c'est important
Le CS-4 redéfinit les standards d'inférence IA à grande échelle face aux GPU dominants.
Cerebras a lancé le CS-4, un accélérateur IA rack-scale intégrant trois puces WSE-3 Turbo. Il offre jusqu'à 30x plus de rapidité d'inférence que les GPU et 10x plus de débit par watt que le CS-3. Les premières livraisons débutent ce trimestre.
Cerebras a annoncé le CS-4, sa nouvelle solution rack-scale d'accélération IA basée sur la plateforme Nexus. Le système intègre trois puces Wafer-Scale Engine WSE-3 Turbo, chacune offrant jusqu'à 2x la vitesse de la génération précédente. Selon Cerebras, le CS-4 délivre jusqu'à 30x plus d'inférence que les systèmes GPU en production, et génère plus de 1 000 tokens par seconde sur des modèles dépassant 10 000 milliards de paramètres, avec une latence inter-wafer de seulement 2 microsecondes.
La conception repose sur un « Wafer-Scale Backpack » modulaire qui regroupe refroidissement liquide, conversion d'énergie et électronique de contrôle dans un boîtier 3D compact avec 50 % de composants en moins. L'alimentation est placée à seulement 0,5 mm du processeur, contre environ 50 mm sur les cartes GPU conventionnelles, réduisant les pertes d'énergie et permettant de doubler la puissance fournie au WSE-3T. Le déploiement en datacenter est simplifié grâce à la séparation des couches infrastructure et calcul, ramenant le temps d'installation de plusieurs jours à quelques heures. Les premières livraisons sont prévues pour ce trimestre.