Xiaomi MiMo-V2.6 Pro y Flash: ranking open weight, precios y CodeMidas
MiMo-V2.6 ofrece dos modelos multimodales mejorados con RL a gran escala y mantiene el precio oficial de API de V2.5. Pro se orienta a trabajo complejo y de largo recorrido; Flash es un buen primer punto de referencia para oficina, código y lotes frecuentes. Ambos declaran contexto de 1M, salida máxima de 128K, entrada de texto, imagen, audio y vídeo, y salida de texto. Pro, Flash
En el lanzamiento Xiaomi informó que MiMo-V2.6-Pro encabezaba los modelos de pesos abiertos en el índice compuesto de Artificial Analysis con 46 puntos; la página de AA también mostraba 46 el 22 de septiembre de 2026. No prueba que gane toda tarea real: este artículo analiza material oficial y el paper CodeMidas, no una comparativa independiente. AA, lanzamiento
Pro frente a Flash
| Elemento | Pro | Flash |
|---|---|---|
| ID API | mimo-v2.6-pro |
mimo-v2.6-flash |
| Uso declarado | Flujos complejos, razonamiento largo, tareas profesionales | Alto volumen y control de coste |
| Entrada / salida | Texto, imagen, audio, vídeo / texto | Texto, imagen, audio, vídeo / texto |
| Contexto / salida | 1M / 128K tokens | 1M / 128K tokens |
| Primera evaluación | Cambios multiarchivo, investigación, planes complejos | Extracción, resúmenes, código rutinario, lotes |
Use Flash para una línea base y derive a Pro sus fallos. Compare entregables aceptados cuando el error sea caro; “Flash” no asegura menor latencia en toda red, cliente o longitud. Este sitio sólo enruta Pro y Flash: Xiaomi tiene UltraSpeed, pero no está disponible en este sitio.
AA 46: alcance del ranking y límites
El índice compuesto de AA reduce candidatos; no sustituye comprobar repositorios, herramientas de navegador, reintentos o entregables. AA agrupa por clase de modelo y, para pesos abiertos, también por tamaño de parámetros. Por ello un número 1 de grupo no significa superar a todos los modelos cerrados. Consulte la página y metodología actual. Para migrar, mandan las aceptaciones reales: tests de código, celdas trazables y citas que abren.
Benchmarks de código: no mezcle dos series DeepSWE

Captura de material de lanzamiento, no prueba independiente del sitio.
| Métrica | Pro | Flash |
|---|---|---|
| DeepSWE v1.1 | 71.9 | 67.9 |
| ProgramBench | 26.5 | 26.0 |
| Terminal Bench 2.1 | 89.9 | 87.6 |
| MiMo Visual Coding | 72.3 | 71.5 |
Las diferencias pequeñas justifican probar Flash, no asumir equivalencia en producción. En la Live RL, DeepSWE v1.1 pasa de 58.4 a 72.6 en Pro y de 48.8 a 65.7 en Flash. No son la misma serie que la tabla; faltan detalles completos de checkpoints y configuración, así que no se deben fusionar. Live RL
Live RL de 3,47 M USD y CodeMidas
Xiaomi divulgó menos de seis días de entrenamiento: unos 2,62 M USD para Pro y 0,85 M USD para Flash, 3,47 M USD total, 30 pasos cada uno. Es el coste de esta ronda de RL, no I+D, preentrenamiento, datos ni infraestructura totales. Detalle La ampliación incluyó más muestras/tokens por actualización, tareas de código, agente general, visión y ciberseguridad, y más cómputo para evaluación y recompensas. Menor gasto de Flash no equivale a mejor ROI: mida coste por tarea aceptada.
El paper CodeMidas convierte código existente en tareas ejecutables y calificables: describe el comportamiento de una implementación funcional, retira el núcleo que debe reconstruirse y conserva interfaz, estructura y dependencias; el original separado genera resultados esperados y valida entregas.

Flujo del paper; Figura 1 y métodos. También verifica ejecución, fugas en artefactos/cachés y errores del validador. Informa 5.545 tareas de 3.185 repositorios y 23 lenguajes; sus experimentos principales usan MiMo-V2.5, no son resultados V2.6 ni se suman a los entornos RL del lanzamiento. Prepare criterios ejecutables: “parece correcto” no basta.
Precios API: caché oficial frente a multiplicadores del sitio
V2.6 mantiene los precios V2.5. A 22 de septiembre de 2026, la API oficial en RMB cobra por millón de tokens, no por solicitud. Pro, Flash
| API oficial directa | Entrada en caché | Entrada sin caché | Salida |
|---|---|---|---|
| Pro | ¥0.025 | ¥3 | ¥6 |
| Flash | ¥0.02 | ¥1 | ¥2 |
La Batch API tiene tarifas offline distintas; no equivale a solicitudes normales concurrentes ni confirma la misma interfaz aquí. La instantánea pública del sitio del 22 de septiembre usa otra base: mimo-v2.6-pro 4× / ¥1.6 y mimo-v2.6-flash 2× / ¥0.8 por millón de tokens. Documento. No mezcle estas filas con caché/entrada/salida; revise precios en vivo y factura.
coste = entrada en caché × precio caché + entrada sin caché × precio entrada + salida × precio salida. Para Pro, 1M de entrada con 90% caché y 0,1M de salida: 0.9 × 0.025 + 0.1 × 3 + 0.1 × 6 = ¥0.9225; sin caché: 1 × 3 + 0.1 × 6 = ¥3.6. Es ejemplo, no factura ni estimación de multiplicadores. “95.7% de caché” o “cinco tareas por unos ¥9” son experiencias de terceros no reproducidas.
Evaluación real, ejemplo y FAQ
Pruebe ambos con la misma versión, permisos y aceptación: modelado 3D (proporciones y archivo), frontend (responsive y botones), arreglo de repositorio (fallo desaparece y regresión pasa), datos de oficina (cada fila rastreable) e investigación larga (citas abren y separa hechos de inferencias). Registre primera aprobación, tiempo, corrección humana y coste; coste total ÷ tareas aceptadas supera comparar sólo tokens. MiMo Desktop incorpora prompts, herramientas y contexto propios, por lo que no representa toda integración API.
curl "https://api.llm-token.cn/v1/chat/completions" -H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" -d '{"model":"mimo-v2.6-flash","messages":[{"role":"user","content":"Enumera tres criterios ejecutables para importar CSV: codificación, nulos y duplicados."}],"stream":false}'
Cambie sólo a mimo-v2.6-pro, conserve el input y registre modelo, uso y factura. Audio, vídeo y herramientas dependen de la documentación del servicio. Guía Pro, Flash, compra, recarga.
¿Es Pro el modelo abierto más fuerte?
Sólo en el encuadre AA del lanzamiento: 46; no en todo repositorio, idioma, cliente o tarea.
¿Flash sustituye Pro?
Evalúelo en resúmenes, extracción y código rutinario; compare Pro en dependencia multietapa, razonamiento complejo o retrabajo costoso.
¿Multimodal genera imagen, audio o vídeo directamente?
No: aquí la salida oficial es texto; casos web/3D/vídeo suelen usar código y herramientas externas.
¿Qué se abrió?
Pesos Pro/Flash, informe técnico y recursos RL; revise la colección MiMo-V2.6, licencias, dependencias y cómputo.
¿Relación de CodeMidas?
Investigación relacionada sobre tareas RL ejecutables; sus experimentos MiMo-V2.5 se citan separados de V2.6.
¿Cómo comparar precios?
Confirme Base URL, key, proveedor, precio vigente y factura: Xiaomi separa caché/entrada/salida; el sitio usa multiplicadores.
Fuentes y verificación
Análisis editorial comprobado el 22 de septiembre de 2026, sin enfrentamiento de modelos ejecutado. Las imágenes son el flujo CodeMidas y la captura de lanzamiento; notas de terceros sin enlace sólo inspiraron preguntas de evaluación.
Lectura relacionada: guía Qwen3.8-Omni-Flash.