Présentation de CoreWeave Forge

CoreWeave Inc. a lancé Forge, une plateforme full‑stack destinée aux IA agentiques. Selon Susanne Seitinger, vice‑présidente du marketing produit, Forge regroupe les outils nécessaires pour passer du premier agent à la version la plus performante le plus rapidement possible. La solution se veut un point d’articulation entre les équipes de développement, les data scientists et les opérations, afin de réduire les frictions entre les différentes étapes du cycle de vie d’un agent.

Mécanique de la boucle d'amélioration

Forge structure la boucle d’amélioration en cinq phases distinctes : run, observe, curate, improve et evaluate, avant de recommencer. La vitesse d’apprentissage, mesurée en temps de boucle, constitue le critère principal de performance. Plusieurs modules ciblent les maillons les plus lourds : Agent Lens visualise le comportement des agents en temps réel, Registry conserve les checkpoints et les configurations, RL Rollouts orchestre les itérations de renforcement, et model distillation compresse les connaissances d’un grand modèle vers une version plus spécialisée. Le composant ARIA (AI Research and Iteration Agent) est désormais disponible en général pour détecter des motifs récurrents dans les données d’entraînement.

Architecture matérielle et écosystème

La plateforme s’appuie sur les racks Nvidia Vera Rubin NVL72, déjà déployés chez Cognition AI Inc. pour des charges de travail de production. Ces serveurs offrent une densité GPU élevée, ce qui réduit le temps de calcul des phases run et improve. En parallèle, CoreWeave a annoncé un réseau de partenaires intégrant des playbooks et des recettes d’utilisation, afin de limiter la duplication d’efforts entre les clients. Cette approche modulaire facilite l’adoption, mais crée une dépendance vis‑à‑vis des intégrations tierces et du matériel Nvidia spécifique.

Analyse des impacts et limites

En consolidant les étapes de la boucle, Forge diminue le nombre de transferts de données entre systèmes disparates, ce qui peut réduire la latence réseau et le risque de perte de métadonnées. Cependant, la nécessité de conserver des checkpoints dans le Registry implique un stockage persistant conséquent, surtout lorsqu’on travaille avec des modèles de plusieurs centaines de gigaoctets. De plus, la visualisation via Agent Lens requiert des capacités de streaming en temps réel, augmentant la charge sur le réseau interne. Enfin, la dépendance aux racks NVL72 limite la portabilité de la solution vers des environnements cloud publics qui n’offrent pas exactement la même configuration GPU.