Présentation de la série MiMo-V2.6

Xiaomi Corp. a publié le 22 septembre 2026 la famille de modèles génératifs MiMo‑V2.6, entièrement open‑source. La gamme comprend trois déclinaisons : le modèle phare MiMo‑V2.6‑Pro, une version allégée MiMo‑V2.6‑Flash et une variante ultra‑rapide Pro‑UltraSpeed, annoncée comme capable de produire du texte jusqu’à vingt fois plus rapidement que le Pro tout en conservant la même qualité de sortie.

Architecture et capacités omnimodales

Les deux modèles « omnimodaux » acceptent texte, image, vidéo et audio dans une même session et disposent d’une fenêtre contextuelle de 1 million de tokens. Le Pro intègre un encodeur vision de 681 M paramètres, un AudioTokenizer de 308 M paramètres et un encodeur de patch audio de 127 M paramètres, capable de distinguer la parole des bruits de fond. Cette combinaison permet à un agent unique de lire une instruction, analyser une capture d’écran ou une séquence vidéo, raisonner et exécuter une action sans passer par plusieurs modèles spécialisés.

Performances sur les benchmarks d’agentic AI

Sur l’Artificial Analysis Intelligence Index, le MiMo‑V2.6‑Pro obtient un score de 46,32, dépassant les modèles open‑source Kimi K3 et Qwen 3.8 Max. En comparaison avec les systèmes propriétaires, il se situe légèrement en dessous de Claude Fable 5.1 et GPT‑6 Astra. Sur des tests d’agentic AI, les résultats sont plus proches des leaders : 53,1 sur AutomationBench contre 50,3 pour Claude Opus 5, 31,6 sur Agents’ Last Exam, à égalité avec Opus 5, et 89,9 sur Terminal Bench 2.1, légèrement supérieur au 89,1 d’Opus 5.

Analyse économique et disponibilité

Le modèle Flash est tarifé à 0,14 $ / 1 M tokens d’entrée et 0,28 $ / 1 M tokens de sortie. Le Pro coûte 0,435 $ / 1 M d’entrée et 0,87 $ / 1 M de sortie. La version UltraSpeed, qui offre la génération 20 fois plus rapide, passe à 4,35 $ / 1 M d’entrée et 8,70 $ / 1 M de sortie. Xiaomi affirme que ces tarifs représentent entre 1/20 et 1/60 du prix des modèles concurrents d’OpenAI (GPT‑6 Astra) et d’Anthropic (Claude Fable 5.1), qui facturent entre 10 $ et 50 $ / 1 M tokens. Les modèles sont accessibles via l’AI Studio, MiMo Desktop, MiMo Code et la plateforme OpenRouter, qui propose un contexte unifié de 1,05 M tokens via une API unifiée.