Contexte et objectifs
ThinkOn Inc. a annoncé l’extension de son modèle cloud basé sur VMware afin de proposer une infrastructure d’IA privée adaptée aux exigences de souveraineté canadienne. Le service soutient la Plateforme IA souveraine du Canada, qui alimente plusieurs milliers d’employés fédéraux répartis dans 23 ministères. Selon le fondateur Craig McLellan, l’entreprise reçoit entre trois et quatre sollicitations chaque semaine, dont la moitié concernent des projets d’IA privée, ce qui indique une demande croissante pour un contrôle local des données.
Architecture du plan de contrôle
Le socle technique repose sur VMware Cloud Foundation, utilisé comme plan de contrôle unique pour les clouds privés classiques et les nouveaux services d’IA. Cette couche unifiée orchestre le provisionnement, la gestion du réseau et la sécurité, tout en s’appuyant sur des centres de données situés au Canada et sur des ingénieurs domestiques. En conservant le même plan de contrôle, ThinkOn garantit que les politiques de conformité et les processus documentés s’appliquent de façon identique aux charges de travail traditionnelles et aux modèles d’apprentissage automatique.
Souveraineté, conformité et coûts
Le critère de souveraineté, tel que le définit McLellan, est la capacité d’accéder sans restriction à l’infrastructure sous‑jacent. En combinant le contrôle VMware avec des installations physiques canadiennes, ThinkOn répond aux exigences de juridiction et de chaîne d’approvisionnement. Les clients évaluent également ce modèle comme une alternative aux services d’IA à la demande, dont les coûts varient selon l’utilisation. En conservant les ressources en interne, les organisations peuvent stabiliser leurs dépenses et éviter les fluctuations liées aux tarifs de cloud public.
Gestion des GPU et performances
ThinkOn adapte la capacité des unités de traitement graphique (GPU) aux besoins spécifiques de chaque charge de travail. L’entreprise ne se limite pas aux GPU de dernière génération (B‑series ou H‑series) ; elle propose aussi des GPU de la série A, qui offrent des performances suffisantes pour des modèles moins exigeants tout en réduisant les coûts d’exploitation. Cette granularité permet aux clients d’optimiser le rapport performance‑prix, car ils ne paient que pour la puissance réellement requise. Le même plan de contrôle VMware assure que la répartition des GPU, qu’ils soient de la série A ou H, reste cohérente avec les politiques de sécurité et de conformité déjà en place.