Contexte du protocole MCP et émergence du bloat

Le Model Context Protocol (MCP), publié par Anthropic, fournit un standard ouvert permettant aux agents d’intelligence artificielle d’interroger des sources de données tierces. Depuis son adoption, chaque fournisseur de stockage a déployé son propre serveur MCP afin d’exposer ses volumes. Cette multiplication de points d’accès crée ce que Komprise appelle le « MCP bloat », c’est‑à‑dire une surcharge de définitions d’outils qui ralentit les réponses des agents et augmente la consommation de tokens.

Architecture de l’Universal File MCP de Komprise

Komprise propose le Universal File MCP, une couche d’abstraction unique qui interroge n’importe quel dépôt – NAS, stockage objet, cloud ou applications – via une interface unique. Le composant s’appuie sur le Komprise Global Metadatabase afin d’harmoniser le schéma des métadonnées entre les différents silos. Les requêtes sont d’abord résolues au niveau des métadonnées, ce qui permet de déterminer quels fichiers sont réellement pertinents avant d’engager le transfert de données.

Mécanismes de réduction des tokens et de filtrage du bruit

Le système intègre un module d’extraction de métadonnées, nommé AI Preparation & Process Automation, qui enrichit chaque fichier d’informations contextuelles. En chargeant d’abord ces métadonnées, les agents peuvent identifier les fichiers cibles et éviter les boucles de traitement redondantes. Des filtres de bruit sont appliqués pour exclure les données non pertinentes, limitant ainsi le nombre de tokens consommés lors des itérations de réponse. Cette approche répond aux constats de McKinsey selon lesquels près de 60 % de la consommation de tokens provient de la « response refinement ».

Cas d’usage et implications opérationnelles

Dans un scénario clinique, un modèle de langage peut demander des images de pathologie ; le Universal File MCP ne renvoie que les fichiers correspondant aux critères KAPPA et aux permissions de l’utilisateur. Un professionnel de la sécurité peut, de même, interroger le système pour identifier des fichiers non conformes ou des archives de recherche, en filtrant par mots‑clés de projet. En centralisant l’accès, Komprise élimine la nécessité de déployer plusieurs serveurs MCP, ce qui réduit la latence et les coûts associés aux tokens tout en maintenant le contrôle d’accès granulaire.