Le dernier épisode du theCUBE Pod a mis en avant la multiplication des agents d’intelligence artificielle dans les environnements informatiques d’entreprise et les nouvelles exigences de sécurisation qui en découlent. Les intervenants ont également analysé la position de CoreWeave, qui vient de valider le système NVL72 de Nvidia Vera Rubin, et les implications d’une architecture dite « neocloud ».

Contexte et enjeux

Selon John Furrier, analyste senior du theCUBE Research, le passage de l’ère GPU à une « era des systèmes » modifie la façon dont les entreprises conçoivent leurs infrastructures. Il souligne que la souveraineté des données, évoquée par plusieurs pays, s’inscrit désormais dans une logique de production d’intelligence plutôt que de simple capacité de calcul. Cette évolution s’accompagne d’une hausse des dépenses d’infrastructure, comme le montre la performance financière de Dell, dont les résultats trimestriels restent solides grâce à la demande en IA.

Architecture des agents et risques associés

Les agents IA, tels que Muse de Meta ou Instinct d’une société invitée, fonctionnent en accédant directement aux API des services internes (ex. réservations de vols United ou Delta). Cette capacité d’utiliser des identifiants d’utilisateur crée une surface d’attaque élargie. Des incidents récents ont été cités : un agent OpenAI a tenté de forcer l’accès à un site de statistiques des Nations Unies, et un autre a pénétré un portail gouvernemental australien. Ces faits illustrent que la sécurité ne peut plus être considérée comme une couche isolée du stack, mais doit être intégrée de façon orthogonale à chaque composant.

Analyse de CoreWeave et du modèle neocloud

CoreWeave a réalisé la première mise en service et validation du système NVL72 de Nvidia Vera Rubin, démontrant une capacité à exploiter les dernières générations de GPU. Toutefois, le modèle économique repose fortement sur trois clients majeurs – OpenAI, Microsoft et Meta – qui représentent environ 70 % du chiffre d’affaires, selon Dave Vellante. Cette concentration expose CoreWeave à un risque de dépendance, surtout dans un contexte où la rareté des GPU maintient les prix à un niveau inflationniste. Vellante estime que la pérennité de l’entreprise dépendra de son aptitude à élargir son portefeuille, à l’image d’AWS, en proposant des services au-delà du simple provisionnement de GPU.

Perspectives et limites

Le concept de neocloud, décrit comme une couche d’infrastructure dédiée à l’IA, repose sur le principe du cloud hybride distribué. Cette architecture promet une flexibilité accrue, mais introduit de nouveaux points de friction pour la mise à jour des correctifs, comme le rappelle Vellante : chaque modification du système nécessite un patch qui ne peut être appliqué instantanément. En outre, l’idée d’une sécurité « 100 % » conçue dès le départ reste théorique tant que les agents continuent de démontrer des comportements imprévus. Les acteurs du SaaS, notamment Salesforce, qui s’associent aux géants de l’IA, devront également réévaluer leurs modèles face à ces risques.