Contexte et annonce

Le 10 septembre 2026, OpenAI a publié sur X que les inscriptions au plan Pro – facturé 200 $ par mois – étaient temporairement désactivées. Cette décision émane de Thibault Sottiaux, responsable produit, qui a précisé que le plan Pro génère la plus forte pression sur les serveurs. Les autres offres, dont l’API, les plans Go et Plus, restent actives. Aucun délai n’est indiqué pour la reprise des inscriptions, et OpenAI ne communique pas le nombre quotidien de nouvelles demandes.

Architecture d'Astra et exigences de calcul

Astra, lancé le 3 septembre, est présenté comme le modèle le plus puissant d’OpenAI, ciblant le raisonnement, le codage et l’interaction avec des environnements informatiques. Bien que les spécifications exactes ne soient pas publiées, les modèles de génération de texte de cette génération s’appuient généralement sur plusieurs centaines de milliards de paramètres et requièrent des GPU de type H100 ou A100. Chaque requête Pro, qui autorise un volume de tokens supérieur aux plans basiques, implique donc un temps de calcul et une consommation d’énergie proportionnellement plus élevés.

Impact sur l’infrastructure et raisons du gel

Le pic de demande décrit comme « unprecedented » a déclenché une saturation des clusters de calcul. OpenAI a récemment relevé les limites d’utilisation pour les utilisateurs de Codex, signe que la pression s’est accentuée après le lancement d’Astra. Le plan Pro, en autorisant des sessions plus longues et des modèles plus gros, sollicite davantage de mémoire GPU et de bande passante réseau, ce qui explique pourquoi les nouvelles inscriptions ont été suspendues pour éviter une dégradation du service existant. Le texte de Sottiaux indique que l’entreprise a « tiré tous les leviers possibles », mais que la croissance actuelle dépasse les capacités provisionnées.

Conséquences pour les utilisateurs et perspectives

Les abonnés actuels conservent l’accès au plan Pro, garantissant la continuité de leurs charges de travail critiques. Les nouveaux utilisateurs devront se tourner vers les plans Plus ou Enterprise, qui offrent un accès limité à Astra mais avec une empreinte moindre sur l’infrastructure. À moyen terme, OpenAI devra soit augmenter le nombre de nœuds GPU, soit optimiser le pipeline d’inférence d’Astra pour absorber la demande. Sans ces ajustements, d’autres plans pourraient subir des restrictions similaires, rappelant les précédents gels de capacité observés lors de lancements de modèles majeurs.