Contexte de la course à l'IA
Depuis plusieurs années, les laboratoires d’IA de frontière opèrent comme dans une compétition où le premier à maîtriser une intelligence artificielle générale (IAG) ou des modèles de superintelligence détient un avantage commercial et stratégique. Cette dynamique s’appuie sur l’augmentation exponentielle du budget de calcul, les modèles de plus de 1 trillion de paramètres et les performances mesurées par les benchmarks de compréhension du langage. Les incitations financières, illustrées par les levées de fonds de plusieurs dizaines de milliards de dollars, ont renforcé une logique de vitesse maximale.
Essai d’Amodei et appel à la modération
Dans un texte de près de 4 000 mots publié ce week‑end, Dario Amodei, co‑fondateur d’Anthropic, a demandé explicitement de « ralentir le rythme d’amélioration des capacités des modèles d’IA ». Il cite le risque d’une « course vers le bas » où les incitations commerciales accentuent les scénarios catastrophiques. L’essai s’appuie sur des observations concrètes : la réduction du temps de formation de modèles de 12 mois à moins de trois mois, et la multiplication des itérations de fine‑tuning sans validation de sécurité exhaustive.
Réactions des grands acteurs et propositions concrètes
Sam Altman, co‑fondateur et CEO d’OpenAI, a confirmé sur les réseaux sociaux que des discussions internes sur le pacing étaient déjà en cours. Demis Hassabis, scientifique en chef d’Alphabet et co‑fondateur de DeepMind, a qualifié l’essai d’« orientation correcte » et a rappelé son appel à la création d’un organisme de normalisation sectoriel. Satya Nadella, CEO de Microsoft, a annoncé la diffusion prochaine d’un code de conduite « humanist AI », destiné à encadrer les critères de sécurité, de transparence et de gouvernance avant chaque mise à jour majeure. Elon Musk, malgré ses critiques antérieures, a partagé le texte d’Amodei avec le commentaire « Dario a raison ». Ces prises de position convergent vers deux leviers : la mise en place d’un cadre de standards communs et la réduction volontaire du débit de publication de modèles au‑delà d’un seuil de paramètres défini.
Analyse des impacts techniques et limites du ralentissement
Freiner le rythme de déploiement implique de re‑évaluer les cycles de calcul. Un modèle de 500 M paramètres nécessite environ 10 000 GPU‑heures ; passer à 1 B paramètres double ce coût, ce qui rend la décision de ralentir directement liée à la disponibilité de ressources d’infrastructure. Le ralentissement pourrait toutefois retarder la collecte de données de sécurité, notamment les tests de robustesse contre les attaques d’injection de prompts. En outre, la coordination internationale reste incertaine : sans mécanisme contraignant, chaque entreprise peut choisir un seuil différent, créant un effet de fuite de cerveaux vers les juridictions moins régulées. Enfin, la réduction du rythme de publication ne garantit pas la diminution du risque de « déploiement accidentel », car les modèles déjà entraînés continuent d’être exploités via des API publiques. Ainsi, l’appel à la modération doit s’accompagner d’une architecture de gouvernance capable de surveiller les versions, d’imposer des audits de sécurité et de publier des rapports de conformité afin d’éviter une fragmentation du contrôle de la technologie.