Accueil Cloud computing AWS se tourne vers Qualcomm pour ses puces IA malgré ses propres...

AWS se tourne vers Qualcomm pour ses puces IA malgré ses propres accélérateurs Inferentia

Ce visuel a été créé grâce à l'IA.

Amazon a passé des années à développer ses propres accélérateurs pour réduire le coût de l’intelligence artificielle dans AWS. Le groupe ouvre pourtant une autre voie : il va travailler avec Qualcomm sur plusieurs générations de puces personnalisées destinées à l’inférence, dans le cadre d’un accord pouvant représenter jusqu’à 60 milliards de dollars d’achats.

Jusqu’à 60 milliards de dollars de puces et d’équipements

L’accord ne porte pas sur une seule génération de processeurs. Qualcomm annonce une collaboration avec Amazon sur plusieurs générations de silicium personnalisé destiné aux grands data centers IA d’AWS.

Le travail se concentrera notamment sur l’inférence, c’est-à-dire l’exécution de modèles déjà entraînés. Les deux groupes développeront également des solutions d’interconnexion optique pouvant atteindre 1,6 Tbit/s, destinées à faire circuler toujours plus rapidement les données entre les équipements des data centers.

Selon Reuters, Amazon pourrait acheter jusqu’à 60 milliards de dollars de puces et de produits associés à Qualcomm. Le fabricant américain lui accorde parallèlement des warrants lui permettant d’acquérir environ 4 milliards de dollars de ses actions.

AWS possède pourtant déjà sa propre puce d’inférence

Le choix interpelle parce qu’AWS a précisément développé Inferentia pour ce type de calcul. La deuxième génération, Inferentia2, équipe les instances EC2 Inf2 et a été conçue spécifiquement pour l’inférence des modèles de deep learning et d’IA générative. AWS la présente toujours comme son accélérateur maison destiné à fournir de fortes performances à moindre coût pour les grands modèles de langage, la génération d’images ou encore la reconnaissance vocale.

Inferentia n’est d’ailleurs pas un produit abandonné dans un coin du catalogue. En juin dernier, AWS a encore étendu sa prise en charge dans les instances gérées Amazon ECS, aux côtés de Trainium1 et Trainium2.

L’accord avec Qualcomm ne peut donc pas être lu, à ce stade, comme l’abandon d’Inferentia. Amazon n’a fait aucune annonce en ce sens.

Amazon ne mise plus sur une seule architecture

Il montre en revanche qu’AWS ne compte pas satisfaire l’explosion des besoins en inférence uniquement avec son propre silicium. Le groupe possède déjà Trainium pour l’entraînement et Inferentia pour l’inférence, tout en proposant dans EC2 de nombreuses instances équipées de GPU Nvidia. Qualcomm vient désormais s’ajouter à cette combinaison avec des composants conçus spécifiquement avec Amazon.

Pour Qualcomm, l’opération ouvre une porte beaucoup plus inhabituelle. Le groupe, historiquement associé aux puces pour smartphones, cherche à prendre pied dans les data centers et s’est fixé pour objectif d’atteindre 15 milliards de dollars de chiffre d’affaires dans ce secteur d’ici 2029, rapporte Reuters.