Présentation

Les entreprises de matériel informatique sont confrontées à une demande croissante d'infrastructures pour l'intelligence artificielle (IA) qui dépasse les prévisions les plus optimistes. Selon Vik Malyala, directeur commercial de Super Micro Computer Inc, les plans établis il y a quelques mois sont déjà obsolètes en raison de l'évolution rapide de la technologie.

Contexte technique

Le passage d'une approche de génération assistée par récupération unique à une approche d'IA agente a modifié les besoins des entreprises en matière de piles de calcul presque du jour au lendemain. Cela a entraîné une forte demande de processeurs graphiques (GPU) et de processeurs centraux (CPU). Les contraintes d'approvisionnement, en particulier en termes de mémoire, ont obligé Supermicro à travailler directement avec des fournisseurs tels que Micron, Samsung et SK Hynix pour sécuriser les allocations.

Implications et limites

Les contraintes d'approvisionnement ont également modifié les attentes des clients en termes de délais de livraison et de prix. Les entreprises doivent maintenant prendre en compte des délais de livraison plus longs, allant au-delà de 9 ou 10 jours. Le carnet de commandes de Supermicro, qui s'élève à 60 milliards de dollars, reflète l'adoption croissante de l'IA dans les banques, les services financiers et les environnements de calcul d'entreprise.

Architecture et performances

Les charges de travail agentes nécessitent une orchestration CPU-intensive, ce qui a entraîné une attention accrue sur la conception de l'infrastructure. Les entreprises ont besoin de la meilleure infrastructure de calcul pour orchestrer les charges de travail et réduire les coûts. Les partenariats, tels que celui entre Supermicro et AMD, sont essentiels pour répondre à la demande croissante d'infrastructures IA et pour fournir des solutions performantes et efficaces.