Une nouvelle ère pour l'intelligence artificielle : Nvidia lance les serveurs Groq 3 LPX
Nvidia a officiellement confirmé que son accélérateur dédié à l'inférence IA, baptisé Groq 3 LPX, est désormais produit en masse. Cette technologie a été développée grâce à l'acquisition du personnel et des licences de Groq, pour un montant de près de 18,5 milliards d'euros. Les nouveaux accélérateurs Nvidia Groq 3 LPX sont conçus pour s'intégrer directement à la plateforme Nvidia Vera Rubin existante. Un seul rack serveur peut accueillir jusqu'à 256 accélérateurs LPX, offrant ainsi une densité de puissance de calcul extrêmement élevée.
Nebius est le premier client cloud à utiliser ces nouveaux systèmes de serveurs dans son infrastructure. Au sein de son « usine à puces », les baies LPX seront installées en parallèle avec des processeurs Nvidia Vera et des accélérateurs graphiques Nvidia Rubin. Cette combinaison d'équipements devrait offrir une efficacité exceptionnelle pour le traitement des modèles d'intelligence artificielle les plus exigeants. Malgré ces promesses de hautes performances, il reste à voir comment le système se comportera en conditions réelles de charge prolongée et si l'intégration entre les différents types de puces se fera sans goulots d'étranglement.
Les mesures effectuées par la plateforme indépendante Artificial Analysis ont déjà révélé des résultats impressionnants. Lors de tests réalisés avec le modèle Google Gemma 4 31B et un volume de contexte de 100 000 éléments, le système a atteint une vitesse de 3 400 jetons de sortie par seconde. Ces chiffres représentent un bond en avant significatif en termes de vitesse de réponse des systèmes d'IA.
L'industrie spatiale s'intéresse également aux nouveaux matériels de Nvidia. SpaceX a révélé que son prochain système d'intelligence artificielle avancé fonctionnera sur des processeurs Nvidia Vera. Ce projet prévoit son exploitation au sein de futurs centres de données orbitaux, ce qui représente un défi technologique inédit et particulièrement risqué.














