El MiMo-V2-Flash de Xiaomi representa un avance en el diseño eficiente de modelos de IA, con un total de 309 mil millones de parámetros, de los cuales solo 15 mil millones están activos durante la inferencia. Esta arquitectura Mixture-of-Experts ofrece un rendimiento excepcional manteniendo requisitos de hardware razonables para su implementación local. En esta guía completa, te mostraremos varios métodos para ejecutar MiMo-V2-Flash localmente en tu máquina.
Alrededor de 5 min