Présentation

GMI Cloud, startup taïwanaise spécialisée dans l’infrastructure GPU à la demande, a annoncé la clôture d’une levée de fonds de 263 M$ destinée à soutenir son expansion mondiale. La société a finalisé un tour de financement de série B de 223 M$ mené par le fonds ARCHIV, avec la participation de Nvidia, Redwood, DSC Investment, KT Corp., Kyobo Life, KB Investment et Trend Micro. En parallèle, elle a obtenu une ligne de crédit de 440 M$ auprès de ChinaTrust Commercial Bank. Ces capitaux visent à renforcer la présence du fournisseur dans la région Asie‑Pacifique et à ouvrir de nouveaux sites aux États-Unis et au Japon.

Architecture et fonctionnement

Le service d’infrastructure‑as‑a‑service de GMI Cloud repose sur un système propriétaire de gestion basé sur Kubernetes, baptisé Cluster Engine. Cette couche d’orchestration automatise l’allocation des ressources GPU et le provisioning des instances, permettant aux développeurs de déployer des clusters préconfigurés en quelques secondes. La plateforme propose les GPU Nvidia les plus récents, notamment les H100, H200 et les nouvelles puces Vera Rubin, qui offrent des performances de calcul tensoriel supérieures pour les charges d’entraînement et d’inférence d’IA.

Le modèle d’accès « on‑demand » élimine la nécessité de configurer manuellement les environnements, contrairement aux clouds traditionnels où chaque nœud doit être préparé à la main. Cette automatisation repose sur des définitions de profils de workload qui décrivent les exigences en mémoire, bande passante et puissance de calcul, traduites en politiques de scheduling Kubernetes.

Performances et perspectives économiques

GMI Cloud indique que son revenu récurrent annuel (ARR) devrait croître de dix fois d’ici la fin de l’année par rapport à décembre 2025, et a déjà enregistré une multiplication par cinq de l’ARR sur les douze derniers mois. La plateforme d’inférence traite plus de 4 trillions de tokens chaque semaine, ce qui reflète une utilisation intensive des modèles de langage à grande échelle. Parmi les clients majeurs figurent Higgsfield, OpenRouter, Nous Research, Fireworks AI et Trend Micro, attestant d’une adoption dans des secteurs variés.

La proximité géographique de GMI Cloud avec les usines taïwanaises de serveurs AI assure un approvisionnement rapide en matériel, réduisant les délais de mise en service des nouveaux clusters. Cette chaîne d’approvisionnement sécurisée est présentée comme un facteur clé de fiabilité, essentiel pour les entreprises qui planifient leurs lancements produits en fonction des dates de disponibilité du matériel.

Risques et limites

Malgré une croissance rapide, le modèle dépend fortement de la disponibilité continue des GPU Nvidia, dont les cycles de production sont soumis à des contraintes de capacité mondiale. Une pénurie ou un retard de livraison pourrait affecter la capacité de GMI Cloud à honorer ses engagements de déploiement. De plus, l’expansion rapide dans de nouvelles régions implique des défis de conformité locale, notamment en matière de souveraineté des données et de régulations sur les exportations de technologies de calcul haute performance. Enfin, la concurrence avec d’autres néoclouds spécialisés, tels que CoreWeave et Nebius, impose une pression sur les prix et sur l’innovation des services de gestion de clusters.