Contexte et appel de Satya Nadella

Dans un post publié le 10 octobre 2026 sur X, le PDG de Microsoft, Satya Nadella, a déclaré qu’il était temps de « revenir en arrière et d’évaluer l’architecture de confiance » des intelligences artificielles. Il a souligné que les systèmes d’IA ne peuvent plus être traités comme des boîtes noires imbriquées, où l’on accepte ou rejette simplement leurs réponses. Cette prise de position intervient après une série d’incidents publics où les grands modèles ont généré des comportements inattendus, ainsi que suite à la publication du plan de précaution d’Anthropic par son CEO Dario Amodei.

Proposition d’une architecture séparée

Nadella propose de « séparer le modèle du harnais qui orchestre son travail ». Concrètement, cela signifie placer le réseau de neurones (le modèle) derrière une couche d’orchestration qui gère les entrées, les sorties et les contraintes opérationnelles. Cette couche agit comme un « wrapper » qui peut intercepter, filtrer ou modifier les actions du modèle avant qu’elles n’atteignent l’utilisateur final. L’avantage technique réside dans la capacité à appliquer des politiques de sécurité sans toucher au cœur du modèle, limitant ainsi les risques de corruption du code interne.

Externalisation des contrôles et preuve d’intégrité

Le dirigeant insiste sur l’« externalisation des contrôles et des sauvegardes », ainsi que sur la documentation de chaque action significative du modèle sous forme de « preuves lisibles par l’homme et inviolables ». Cette exigence suppose l’utilisation de journaux d’audit cryptographiques (ex. : chaînes de blocs privées ou signatures numériques) qui garantissent l’immutabilité des enregistrements. Chaque décision du modèle serait ainsi associée à un hash signé, permettant à un auditeur humain de vérifier post‑hoc que l’action n’a pas été altérée. Le défi réside dans le volume de données générées par les modèles de grande taille, qui peut rendre le stockage et la vérification en temps réel coûteux.

Frein d’urgence et limites pratiques

Enfin, Nadella appelle à ce qu’une « personne autorisée » puisse interrompre ou arrêter le modèle en cours de tâche, à la manière d’un frein d’urgence. Cette capacité nécessite un mécanisme de coupure instantanée au niveau du harnais, capable de suspendre le flux de calculs sans corrompre l’état interne du modèle. Sur le plan technique, cela implique la mise en place de points d’arrêt atomiques et de sauvegardes d’état, afin d’éviter les fuites de mémoire ou les incohérences de modèle lors de la reprise. Toutefois, la mise en œuvre d’un tel frein soulève des questions de latence (le temps de réaction doit être inférieur à quelques millisecondes) et de gouvernance (qui définit les critères d’activation du frein ?). Sans standards ouverts, chaque organisation devra concevoir ses propres protocoles, ce qui risque de fragmenter l’écosystème de sécurité IA.