Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Volver al blog

Xiaomi MiMo-V2.6 Pro y Flash: ranking open weight, precios y CodeMidas

MiMo-V2.6Xiaomi AICodeMidasaprendizaje por refuerzoselección de modelos

MiMo-V2.6 ofrece dos modelos multimodales mejorados con RL a gran escala y mantiene el precio oficial de API de V2.5. Pro se orienta a trabajo complejo y de largo recorrido; Flash es un buen primer punto de referencia para oficina, código y lotes frecuentes. Ambos declaran contexto de 1M, salida máxima de 128K, entrada de texto, imagen, audio y vídeo, y salida de texto. Pro, Flash

En el lanzamiento Xiaomi informó que MiMo-V2.6-Pro encabezaba los modelos de pesos abiertos en el índice compuesto de Artificial Analysis con 46 puntos; la página de AA también mostraba 46 el 22 de septiembre de 2026. No prueba que gane toda tarea real: este artículo analiza material oficial y el paper CodeMidas, no una comparativa independiente. AA, lanzamiento

Pro frente a Flash

Elemento Pro Flash
ID API mimo-v2.6-pro mimo-v2.6-flash
Uso declarado Flujos complejos, razonamiento largo, tareas profesionales Alto volumen y control de coste
Entrada / salida Texto, imagen, audio, vídeo / texto Texto, imagen, audio, vídeo / texto
Contexto / salida 1M / 128K tokens 1M / 128K tokens
Primera evaluación Cambios multiarchivo, investigación, planes complejos Extracción, resúmenes, código rutinario, lotes

Use Flash para una línea base y derive a Pro sus fallos. Compare entregables aceptados cuando el error sea caro; “Flash” no asegura menor latencia en toda red, cliente o longitud. Este sitio sólo enruta Pro y Flash: Xiaomi tiene UltraSpeed, pero no está disponible en este sitio.

AA 46: alcance del ranking y límites

El índice compuesto de AA reduce candidatos; no sustituye comprobar repositorios, herramientas de navegador, reintentos o entregables. AA agrupa por clase de modelo y, para pesos abiertos, también por tamaño de parámetros. Por ello un número 1 de grupo no significa superar a todos los modelos cerrados. Consulte la página y metodología actual. Para migrar, mandan las aceptaciones reales: tests de código, celdas trazables y citas que abren.

Benchmarks de código: no mezcle dos series DeepSWE

Tabla de benchmarks de lanzamiento MiMo-V2.6, con DeepSWE, ProgramBench, Terminal Bench y programación visual

Captura de material de lanzamiento, no prueba independiente del sitio.

Métrica Pro Flash
DeepSWE v1.1 71.9 67.9
ProgramBench 26.5 26.0
Terminal Bench 2.1 89.9 87.6
MiMo Visual Coding 72.3 71.5

Las diferencias pequeñas justifican probar Flash, no asumir equivalencia en producción. En la Live RL, DeepSWE v1.1 pasa de 58.4 a 72.6 en Pro y de 48.8 a 65.7 en Flash. No son la misma serie que la tabla; faltan detalles completos de checkpoints y configuración, así que no se deben fusionar. Live RL

Live RL de 3,47 M USD y CodeMidas

Xiaomi divulgó menos de seis días de entrenamiento: unos 2,62 M USD para Pro y 0,85 M USD para Flash, 3,47 M USD total, 30 pasos cada uno. Es el coste de esta ronda de RL, no I+D, preentrenamiento, datos ni infraestructura totales. Detalle La ampliación incluyó más muestras/tokens por actualización, tareas de código, agente general, visión y ciberseguridad, y más cómputo para evaluación y recompensas. Menor gasto de Flash no equivale a mejor ROI: mida coste por tarea aceptada.

El paper CodeMidas convierte código existente en tareas ejecutables y calificables: describe el comportamiento de una implementación funcional, retira el núcleo que debe reconstruirse y conserva interfaz, estructura y dependencias; el original separado genera resultados esperados y valida entregas.

Proceso CodeMidas para entornos RL desde código: diseño, tests, consistencia de ejecución y filtrado de trayectorias; conserva 5.545 tareas

Flujo del paper; Figura 1 y métodos. También verifica ejecución, fugas en artefactos/cachés y errores del validador. Informa 5.545 tareas de 3.185 repositorios y 23 lenguajes; sus experimentos principales usan MiMo-V2.5, no son resultados V2.6 ni se suman a los entornos RL del lanzamiento. Prepare criterios ejecutables: “parece correcto” no basta.

Precios API: caché oficial frente a multiplicadores del sitio

V2.6 mantiene los precios V2.5. A 22 de septiembre de 2026, la API oficial en RMB cobra por millón de tokens, no por solicitud. Pro, Flash

API oficial directa Entrada en caché Entrada sin caché Salida
Pro ¥0.025 ¥3 ¥6
Flash ¥0.02 ¥1 ¥2

La Batch API tiene tarifas offline distintas; no equivale a solicitudes normales concurrentes ni confirma la misma interfaz aquí. La instantánea pública del sitio del 22 de septiembre usa otra base: mimo-v2.6-pro 4× / ¥1.6 y mimo-v2.6-flash 2× / ¥0.8 por millón de tokens. Documento. No mezcle estas filas con caché/entrada/salida; revise precios en vivo y factura.

coste = entrada en caché × precio caché + entrada sin caché × precio entrada + salida × precio salida. Para Pro, 1M de entrada con 90% caché y 0,1M de salida: 0.9 × 0.025 + 0.1 × 3 + 0.1 × 6 = ¥0.9225; sin caché: 1 × 3 + 0.1 × 6 = ¥3.6. Es ejemplo, no factura ni estimación de multiplicadores. “95.7% de caché” o “cinco tareas por unos ¥9” son experiencias de terceros no reproducidas.

Evaluación real, ejemplo y FAQ

Pruebe ambos con la misma versión, permisos y aceptación: modelado 3D (proporciones y archivo), frontend (responsive y botones), arreglo de repositorio (fallo desaparece y regresión pasa), datos de oficina (cada fila rastreable) e investigación larga (citas abren y separa hechos de inferencias). Registre primera aprobación, tiempo, corrección humana y coste; coste total ÷ tareas aceptadas supera comparar sólo tokens. MiMo Desktop incorpora prompts, herramientas y contexto propios, por lo que no representa toda integración API.

curl "https://api.llm-token.cn/v1/chat/completions" -H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" -d '{"model":"mimo-v2.6-flash","messages":[{"role":"user","content":"Enumera tres criterios ejecutables para importar CSV: codificación, nulos y duplicados."}],"stream":false}'

Cambie sólo a mimo-v2.6-pro, conserve el input y registre modelo, uso y factura. Audio, vídeo y herramientas dependen de la documentación del servicio. Guía Pro, Flash, compra, recarga.

¿Es Pro el modelo abierto más fuerte?

Sólo en el encuadre AA del lanzamiento: 46; no en todo repositorio, idioma, cliente o tarea.

¿Flash sustituye Pro?

Evalúelo en resúmenes, extracción y código rutinario; compare Pro en dependencia multietapa, razonamiento complejo o retrabajo costoso.

¿Multimodal genera imagen, audio o vídeo directamente?

No: aquí la salida oficial es texto; casos web/3D/vídeo suelen usar código y herramientas externas.

¿Qué se abrió?

Pesos Pro/Flash, informe técnico y recursos RL; revise la colección MiMo-V2.6, licencias, dependencias y cómputo.

¿Relación de CodeMidas?

Investigación relacionada sobre tareas RL ejecutables; sus experimentos MiMo-V2.5 se citan separados de V2.6.

¿Cómo comparar precios?

Confirme Base URL, key, proveedor, precio vigente y factura: Xiaomi separa caché/entrada/salida; el sitio usa multiplicadores.

Fuentes y verificación

Análisis editorial comprobado el 22 de septiembre de 2026, sin enfrentamiento de modelos ejecutado. Las imágenes son el flujo CodeMidas y la captura de lanzamiento; notas de terceros sin enlace sólo inspiraron preguntas de evaluación.

Lectura relacionada: guía Qwen3.8-Omni-Flash.