Présentation du problème

À Quesma, nous recherchons les économies d'agents IA : ce que coûte vraiment la programmation agente et ce que vous pouvez faire à ce sujet. Pour cette recherche, j'ai mis en place ma propre configuration de recherche approfondie, un pipeline d'agents qui construit une base de connaissances que je peux vraiment faire confiance.

Contexte technique

Mon objectif était de comprendre l'état complet de la soi-disant tokenomique. Je voulais savoir quels systèmes de surveillance existent, comment les équipes gèrent leurs dépenses en IA et quels outils et pratiques d'optimisation fonctionnent vraiment, à la fois dans les documents et dans le monde réel.

J'ai commencé de la manière habituelle, avec /deep-research. J'ai donné la grande question ouverte et laissé tourner. Après environ 30 minutes de recherche, j'ai atteint la limite et j'ai dû attendre quelques heures pour qu'elle se réinitialise. Et je n'avais aucun résultat.

Implémentation de la solution

Pour résoudre ce problème, j'ai utilisé toutes les abonnements que je payais déjà. J'ai étendu le plugin claude-mem pour prendre en charge Codex et Antigravity localement, afin que les trois outils puissent utiliser une mémoire partagée pendant les sessions.

case "$VENDOR" in
      codex)       OUT="$(codex exec --sandbox read-only "$PROMPT")" ;;
      antigravity) OUT="$(agy --model "Gemini 3.1 Pro (High)" -p "$PROMPT")" ;;
   esac
   echo "$OUT"

J'ai également mis en œuvre des règles explicites dans le cadre de recherche pour que chaque constatation doive passer avant de pouvoir être partagée.

Résultats et analyse

Grâce à cette technique, j'ai pu exécuter la recherche de manière continue pendant environ 10 fois plus longtemps qu'initialement avec Fable uniquement, mesuré simplement comme le temps pendant lequel je peux maintenir les agents en fonctionnement avant que l'un des trois abonnements atteigne la limite.

Le résultat est une base de connaissances que je peux faire confiance, contenant des centaines de notes validées sur la tarification, les outils, les benchmarks et les pratiques.