Présentation de CAISI

Le directeur du Centre pour les normes et l'innovation en intelligence artificielle (CAISI), Chris Fall, a démissionné après seulement trois mois en fonction. L'agence a confirmé cette information à plusieurs médias. Avant de diriger le CAISI, Fall était directeur du Bureau des sciences du Département de l'énergie pendant le premier mandat de Trump et avait été directeur par intérim de l'Agence de recherche avancée en énergie du DOE.

Contexte technique

Le CAISI, qui opère sous l'égide du National Institute of Standards and Technology, est l'organisation principale pour développer des normes techniques et des méthodes de test pour les modèles d'intelligence artificielle, ainsi que pour évaluer les risques de cybersécurité. Cependant, ce n'est pas l'agence qui était au centre de la récente controverse sur les risques liés aux modèles. En juin, le Département du commerce américain a invoqué une directive de contrôle des exportations obscure qui a forcé Anthropic à retirer ses modèles Mythos et Fable du marché.

Implications et limites

La démission de Fall intervient alors que la Maison Blanche a signé un décret exécutif pour un nouveau programme de surveillance de la sécurité de l'IA appelé « Gold Eagle », qui crée un centre de coordination pour la vulnérabilité de la cybersécurité. Le CAISI n'a pas été mentionné parmi les organisations fédérales participant à ce programme. Par ailleurs, après que les modèles d'Anthropic aient été libérés de l'interdiction, le PDG de Google DeepMind, Demis Hassabis, a appelé à la création d'un organisme de régulation indépendant pour les normes de l'IA, sur le modèle de FINRA, mission similaire à celle pour laquelle le CAISI a été créé.

Analyse scientifique

Le CAISI a publié quelques rapports sur les capacités des modèles de poids ouvert chinois Z.ai's GLM-5.2 et DeepSeek V4 Pro, mais n'a pas fourni beaucoup d'informations sur ses processus de test. Depuis le 9 juillet, TechCrunch a envoyé plusieurs demandes d'information au Département du commerce et à NIST sur la façon dont les évaluations des modèles de langage fonctionnent, mais n'a pas reçu de réponse. Cela soulève des questions sur la transparence et l'efficacité du CAISI dans son rôle de développement de normes et de test pour les modèles d'IA.