Présentation

Anthropic PBC et Nvidia Corp. se sont opposés aux interdictions générales des modèles d'IA open-weight, encourageant les régulateurs à se concentrer sur les risques et les utilisations spécifiques. Les modèles open-weight sont ceux dont les développeurs publient les paramètres formés, appelés « poids », qui sont les valeurs numériques et les vecteurs appris pendant la formation qui déterminent le comportement d'un modèle.

Contexte technique

Les modèles open-weight sont publiés pour que les utilisateurs et les entreprises puissent les exécuter localement ou dans leur propre cloud, éliminant ainsi le besoin d'accéder aux modèles fermés développés et déployés par les grands développeurs de modèles d'IA tels qu'OpenAI PBC ou Anthropic. Des exemples bien connus de modèles open-weight incluent Meta Platforms Inc.'s Llama, Mistral AI SAS's modèles, Alibaba Group Holding Ltd.'s Qwen et DeepSeek's modèles.

Fonctionnement et architecture

Les poids des modèles open-weight agissent comme des curseurs qui peuvent être ajustés pour façonner les sorties et les performances d'un modèle. Parce qu'ils sont accessibles, les poids peuvent être affinés avec des données propriétaires, permettant aux développeurs de personnaliser le modèle pour des objectifs et des utilisations spécifiques. Le PDG d'Anthropic, Dario Amodei, a souligné que la société n'a jamais plaidé en faveur d'une interdiction des modèles open-weight, mais plutôt pour un contrôle de l'infrastructure et du comportement autour des modèles.

Implications et limites

Les préoccupations d'Anthropic concernant la distillation suivent les craintes que ses plus grands et plus puissants modèles, Mythos et Fable, aient été utilisés secrètement pour former des modèles d'IA étrangers. Le PDG de Nvidia, Jensen Huang, a partagé une lettre ouverte signée par la société et d'autres leaders de l'industrie, argumentant que les modèles open-weight soutiennent l'innovation, la concurrence, le contrôle des clients et la souveraineté. Les signataires ont déclaré que ce type de modèle ne devrait pas faire face à des restrictions supplémentaires qui limiteraient son utilité dans l'industrie logicielle et d'IA plus large.