Présentation d'Echo
Le système Echo est une expérience visant à créer un système d'IA unique à partir d'un pool de modèles de poids ouverts, plutôt que de choisir un seul modèle pour chaque tâche. L'objectif est d'obtenir des résultats similaires à ceux des systèmes d'IA les plus performants, mais à un coût inférieur.
Fonctionnement d'Echo
Le système Echo fonctionne en sélectionnant, pour chaque requête, le montant de calcul à allouer, les modèles à utiliser et la façon de combiner leurs sorties. Certains prompts nécessitent une quantité relativement faible d'inférence, tandis que d'autres bénéficient de la collaboration de plusieurs modèles sur différentes parties du problème.
GLM-5.2, Kimi K2.7
Les modèles utilisés dans Echo sont complémentaires, ce qui signifie qu'un modèle plus faible peut encore être très utile pour certains problèmes ou en combinaison avec d'autres modèles.
Évaluation et résultats
Les résultats montrent que Echo performe mieux que le meilleur modèle individuel de son pool et atteint des résultats similaires à ceux du système Fable, mais à environ un tiers du coût d'inférence. Cependant, il reste des cas où Echo prend des décisions d'allocation ou de combinaison incorrectes, et les tests se poursuivent pour améliorer le système.
Test et interface
Une interface de chat et une API compatible OpenAI ont été mises en place pour permettre aux utilisateurs de tester Echo en dehors de l'environnement d'évaluation. Les utilisateurs sont invités à essayer le système et à signaler les cas de défaillance ou les allocations inhabituelles.