Xiaomi MiMo-V2.6 Pro et Flash : classement open weight, prix et CodeMidas
MiMo-V2.6 propose deux modèles multimodaux renforcés par RL à grande échelle, au tarif API officiel de V2.5. Pro vise les flux complexes et longs ; Flash sert de référence initiale pour bureau, code et traitements fréquents. Tous deux annoncent 1M de contexte, 128K de sortie maximale, des entrées texte/image/audio/vidéo et une sortie texte. Pro, Flash
Au lancement, Xiaomi indiquait MiMo-V2.6-Pro premier parmi les modèles à poids ouverts de l'indice Artificial Analysis, à 46 ; AA affichait aussi 46 le 22 septembre 2026. Ce n'est pas une preuve de victoire sur toute tâche réelle : analyse de documents officiels et de CodeMidas, pas de test indépendant. AA, publication
Pro ou Flash ?
| Élément | Pro | Flash |
|---|---|---|
| ID API | mimo-v2.6-pro |
mimo-v2.6-flash |
| Positionnement | Flux complexes, raisonnement long, tâches pro | Grand volume, maîtrise du coût |
| Entrée / sortie | Texte, image, audio, vidéo / texte | Texte, image, audio, vidéo / texte |
| Contexte / maximum | 1M / 128K tokens | 1M / 128K tokens |
| À tester d'abord | Modifs multi-fichiers, recherche, planification | Extraction, résumé, code courant, lots |
Établissez une base avec Flash, puis envoyez ses échecs à Pro. Pour les erreurs coûteuses, comparez les livrables acceptés ; « Flash » ne garantit pas une latence moindre partout. Ce site ne route que Pro et Flash : UltraSpeed existe chez Xiaomi mais n'est pas disponible sur ce site.
AA 46 et deux séries DeepSWE distinctes
L'indice AA réduit les candidats mais ne remplace ni tests de dépôt, ni outils navigateur, ni contrôles de livraison. AA groupe par classe et, pour les poids ouverts, par taille ; un premier de groupe ne dépasse donc pas forcément tous les modèles fermés. Vérifiez la page AA actuelle.

| Mesure publiée | Pro | Flash |
|---|---|---|
| DeepSWE v1.1 | 71.9 | 67.9 |
| ProgramBench | 26.5 | 26.0 |
| Terminal Bench 2.1 | 89.9 | 87.6 |
| MiMo Visual Coding | 72.3 | 71.5 |
Ce sont des données de lancement, pas notre comparaison. La Live RL donne une autre série DeepSWE : 58.4 → 72.6 (Pro), 48.8 → 65.7 (Flash). Les checkpoints et réglages ne sont pas entièrement explicités ; ne fusionnez pas ces séries. Live RL
Live RL à 3,47 M$ et CodeMidas
En moins de six jours, Xiaomi a déclaré environ 2,62 M$ pour Pro et 0,85 M$ pour Flash, soit 3,47 M$, 30 étapes chacun. C'est le coût de cette ronde RL, pas le coût total de R&D, préentraînement, données ou infrastructure. Détail Plus d'échantillons/tokens, tâches code/agent/vision/cybersécurité et calcul d'évaluation/récompense ont été mobilisés. Un Flash moins cher à entraîner n'implique pas un meilleur ROI : mesurez le coût par tâche acceptée.
Le papier CodeMidas construit des tâches de code exécutables et notables : il décrit une implémentation existante, retire le cœur à reconstruire et garde interface, structure et dépendances ; l'original séparé produit le résultat attendu et valide la soumission.

Voir Figure 1 et méthodes. Le processus vérifie exécution, fuites de cache/artefacts et faux jugements. Il rapporte 5 545 tâches, 3 185 dépôts, 23 langages ; ses essais principaux utilisent MiMo-V2.5, pas V2.6, et ne s'additionnent pas aux environnements RL du lancement.
Prix, évaluation, API et FAQ
Au 22 septembre 2026, l'API RMB officielle facture par million de tokens. Pro, Flash
| API directe officielle | Entrée cache | Entrée non cache | Sortie |
|---|---|---|---|
| Pro | ¥0.025 | ¥3 | ¥6 |
| Flash | ¥0.02 | ¥1 | ¥2 |
La Batch API est une offre offline distincte, pas des requêtes ordinaires concurrentes. La capture publique du site donne mimo-v2.6-pro 4× / ¥1.6 et mimo-v2.6-flash 2× / ¥0.8 par million : document. Ne mélangez pas ces grilles ; consultez les prix en direct.
coût = entrée cache × prix cache + entrée non cache × prix entrée + sortie × prix sortie. Pro avec 1M d'entrée, 90 % cache et 0,1M sortie : 0.9 × 0.025 + 0.1 × 3 + 0.1 × 6 = ¥0.9225; sans cache : ¥3.6. Exemple seulement, non applicable aux multiplicateurs. « 95,7 % de cache » et « cinq tâches pour ¥9 » sont des expériences tierces non reproduites.
Testez mêmes révision, permissions et critères : 3D (proportion/fichier), frontend (responsive/boutons), bug dépôt (régression), données (lignes traçables), recherche (sources ouvrables et faits séparés). Suivez premier passage, temps, correction humaine et coût total ÷ tâches acceptées. MiMo Desktop gère ses propres prompts/outils/contexte.
curl "https://api.llm-token.cn/v1/chat/completions" -H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" -d '{"model":"mimo-v2.6-flash","messages":[{"role":"user","content":"Donne trois critères exécutables pour un import CSV : encodage, valeurs nulles et doublons."}],"stream":false}'
Pour Pro, changez seulement model; enregistrez modèle, usage et facture. Les paramètres audio/vidéo/outils suivent l'API choisie. Pro, Flash, achat, recharge.
Pro est-il le meilleur open weight ?
Seulement dans le cadre AA du lancement, à 46 ; pas pour chaque dépôt, langue, client ou tâche.
Flash remplace-t-il Pro ?
Testez-le pour résumés, extraction, code courant ; comparez Pro pour dépendances multi-étapes et reprises coûteuses.
Multimodal produit-il directement image, audio ou vidéo ?
Non : la sortie officielle est texte ; les exemples web/3D/vidéo emploient souvent code et outils externes.
Qu'est-ce qui est ouvert, et le lien avec CodeMidas ?
Poids Pro/Flash, rapport et ressources RL : voir la collection MiMo-V2.6. CodeMidas est une recherche liée, dont les essais MiMo-V2.5 restent séparés.
Comment lire les prix ?
Vérifiez Base URL, clé, fournisseur, prix et facture ; Xiaomi sépare cache/entrée/sortie, le site utilise des multiplicateurs.
Sources
Analyse vérifiée le 22 septembre 2026, sans duel de modèles exécuté. Lancement, AA, CodeMidas, texte, prix publics. Les images sont le pipeline et la capture de lancement ; les notes tierces sans lien n'ont servi qu'à concevoir l'évaluation.
À lire aussi : guide Qwen3.8-Omni-Flash.