Xiaomi ha hecho oficial el lanzamiento de MiMo-V2.6, la nueva generación de su familia de modelos de lenguaje omnimodal. El sistema destaca por su capacidad para procesar y relacionar texto, imágenes, vídeo y audio de manera simultánea dentro de una extensa ventana de contexto que alcanza el millón de tokens.
La principal innovación arquitectónica de esta entrega radica en la escala aplicada a su entrenamiento mediante aprendizaje por refuerzo (Group Relative Policy Optimization). Este enfoque permite al modelo autocorregir sus cadenas de razonamiento de forma autónoma, mejorando la precisión en la resolución de problemas complejos.
Eficiencia computacional y variantes de alto rendimiento
La suite incluye dos configuraciones principales: MiMo-V2.6-Pro, diseñada para tareas de alta demanda analítica, y MiMo-V2.6-Flash-RL, optimizada para respuestas ultrarrápidas con un consumo reducido de tokens por consulta. Ambas variantes han sido preparadas para ejecutar tareas complejas de visión por computadora y generación de entornos tridimensionales.
Asimismo, los modelos muestran un desempeño destacado en programación interactiva y control robótico, consolidando la apuesta de la firma asiática por integrar inteligencia artificial avanzada en su ecosistema de dispositivos conectados y sistemas de automatización industrial.
Ecosistema abierto y cliente de escritorio
Para facilitar la adopción del modelo en el sector profesional, la compañía ha acompañado el lanzamiento con el despliegue de la aplicación MiMo Desktop Client, así como el acceso directo a sus endpoints a través de API.
Con estructuras de costes altamente competitivas, Xiaomi busca democratizar el acceso a herramientas omnimodales de vanguardia, posicionándose como un actor relevante en el desarrollo de software y modelos de código abierto a nivel global.
Fuente: Xiaomi MIMO

.png)

