Xiaomi MiMo V2.6: Pro y Flash llegan con IA para agentes

2 0
Xiaomi MiMo V2.6 inteligencia artificial

Xiaomi MiMo V2.6 llega con nuevos modelos de IA enfocados en agentes

Xiaomi presentó la familia MiMo V2.6, una nueva generación de modelos de inteligencia artificial diseñada especialmente para tareas que van más allá de una conversación tradicional.

La compañía lanzó dos modelos principales, MiMo-V2.6-Pro y MiMo-V2.6-Flash, además de una versión destilada de 9B parámetros. La propuesta está enfocada en programación, investigación, automatización, uso de herramientas y tareas de larga duración.

Uno de los puntos más importantes es que Pro y Flash cuentan con una ventana de contexto de 1 millón de tokens y pueden trabajar con texto, imágenes, video y audio.

MiMo V2.6 Pro y Flash no buscan exactamente lo mismo

Xiaomi plantea diferentes versiones dependiendo del tipo de trabajo.

El MiMo-V2.6-Pro es el modelo más potente de la familia, con 1.02 billones de parámetros totales y 42,000 millones activos. Está pensado para tareas complejas de ingeniería, investigación, ciberseguridad y agentes que necesitan trabajar durante periodos prolongados.

Por otro lado, el MiMo-V2.6-Flash cuenta con 309,000 millones de parámetros totales y 15,000 millones activos. Su objetivo es ofrecer mayor eficiencia para automatizaciones de alto volumen y flujos de trabajo donde el costo es especialmente importante.

También existe MiMo-V2.6-Distill-Qwen-9B, un modelo más pequeño basado en Qwen que está pensado para experimentos locales, educación, investigación y ajuste fino.

Una IA pensada para trabajar con diferentes tipos de contenido

Una de las características más importantes de MiMo V2.6 es su capacidad multimodal.

Los modelos Pro y Flash pueden recibir texto, imágenes, video y audio, además de trabajar con una ventana de contexto de hasta 1 millón de tokens.

La API también incluye funciones como razonamiento profundo, llamadas a herramientas, streaming, salida estructurada, búsqueda web y almacenamiento en caché del contexto.

Esto permite que los modelos estén orientados a tareas que requieren analizar grandes cantidades de información o mantener el contexto durante procesos más largos.

Xiaomi apuesta por agentes de IA

MiMo V2.6 fue desarrollado con un enfoque claro en los agentes de inteligencia artificial.

Xiaomi documentó un proceso de aprendizaje por refuerzo de seis días que combinó tareas de programación, agentes generales, trabajo visual y ciberseguridad.

Durante este proceso, Pro y Flash completaron 30 pasos cada uno a lo largo de aproximadamente 750,000 trayectorias. Xiaomi reportó costos de entrenamiento de alrededor de 2.62 millones de dólares para Pro y 850,000 dólares para Flash. 

La compañía plantea que este entrenamiento busca mejorar aspectos como la planificación, el uso de herramientas, la verificación de resultados y la capacidad de adaptarse a diferentes entornos.

MiMo V2.6 también llega con pesos abiertos

Otro aspecto importante es que los checkpoints de aprendizaje por refuerzo de Pro y Flash están disponibles como pesos abiertos bajo licencia MIT.

Xiaomi también publicó entornos de apoyo y recursos de entrenamiento.

Sin embargo, que los pesos estén disponibles no significa que ejecutar estos modelos sea gratuito. El usuario que quiera autoalojarlos debe hacerse cargo del cómputo y de la operación necesaria para ejecutarlos.

Para quienes buscan una alternativa más accesible para experimentar localmente, el modelo Distill-Qwen-9B representa la opción más pequeña de la familia.

Xiaomi MiMo V2.6 Pro

¿Cuánto cuesta utilizar MiMo V2.6?

Xiaomi ofrece MiMo V2.6 mediante una API de pago. La diferencia de precio entre Pro y Flash es uno de los elementos más importantes para elegir entre ambos.

ModeloEntrada nueva / 1MSalida / 1MEnfoque
MiMo V2.6 Pro$0.435$0.87Trabajo complejo y de alto valor
MiMo V2.6 Flash$0.14$0.28Trabajo frecuente o a gran escala
Pro UltraSpeed$4.35$8.70Trabajo donde importa la velocidad

Los precios corresponden a las tarifas indicadas en el artículo para cada millón de tokens. La opción Pro UltraSpeed ofrece la capacidad de Pro con hasta 20 veces más velocidad de salida, pero tiene un costo considerablemente mayor.

Además, para determinados trabajos offline, la Batch API de Xiaomi cobra el 50 % de las tarifas en tiempo real.

Los primeros benchmarks muestran resultados competitivos

Los resultados iniciales de MiMo V2.6 muestran un desempeño destacado en diferentes pruebas enfocadas en agentes.

Según los datos publicados en el artículo, MiMo V2.6 Pro obtuvo 46.32 puntos en el Composite Intelligence Index de Artificial Analysis.

BenchmarkProFlash
DeepSWE v1.171.967.9
AutomationBench v1.0.653.152.3
Toolathlon-Verified76.973.6
OSWorld-Verified82.080.8

Los resultados muestran que Flash puede mantener buena parte de la capacidad de agente de Pro en algunas pruebas, aunque el artículo advierte que muchos resultados fueron reportados por el propio proveedor y que las evaluaciones independientes todavía son limitadas.

¿Qué modelo MiMo V2.6 conviene utilizar?

La elección depende principalmente del tipo de trabajo.

MiMo V2.6 Pro está pensado para tareas complejas de programación, planificación, investigación y orquestación de múltiples herramientas.

MiMo V2.6 Flash, en cambio, busca ser una opción más económica para automatizaciones repetitivas, extracción, clasificación, resúmenes y trabajos multiagente.

Por último, Distill-Qwen-9B está orientado a experimentos locales, educación, investigación y ajuste fino.

La propia recomendación del artículo es comenzar con Flash en una evaluación pequeña basada en tareas reales y utilizar Pro para los trabajos donde la capacidad adicional realmente haga diferencia.

Xiaomi quiere que MiMo trabaje, no solo converse

Con MiMo V2.6, Xiaomi apuesta por una familia de modelos enfocada en una idea cada vez más importante dentro de la inteligencia artificial: los sistemas capaces de realizar tareas completas mediante agentes.

Pro busca ofrecer el mayor nivel de capacidad para trabajos complejos, mientras que Flash apuesta por reducir el costo de las tareas repetitivas y de alto volumen. A esto se suma un modelo destilado de 9B para quienes quieran experimentar localmente.

La combinación de contexto de 1 millón de tokens, capacidades multimodales, uso de herramientas, pesos abiertos y precios relativamente agresivos hace que MiMo V2.6 sea una propuesta interesante para este tipo de aplicaciones.

Eso sí, los benchmarks iniciales deben tomarse como un punto de partida y no como una garantía de rendimiento. La mejor manera de saber qué modelo funciona realmente es probarlo con las tareas y herramientas que se utilizarán en el día a día.

Deja una respuesta

Share via
Copy link