Xiaomi amplia il proprio impegno nel settore dell’intelligenza artificiale con il rilascio di nuovi modelli omnimodali progettati per lavorare con testi, immagini e video. La società ha inoltre reso disponibili strumenti destinati allo sviluppo, alla generazione di ambienti tridimensionali e all’utilizzo su computer Windows e Mac.
xiaomi mimo-v2.6 pro e flash: le novità principali
La nuova famiglia comprende MiMo-V2.6 Pro e MiMo-V2.6-Flash. Entrambi i modelli possono essere impiegati in applicazioni basate su contenuti testuali, visivi e video, oltre che per attività di programmazione. La versione Pro rappresenta il modello più avanzato sviluppato da Xiaomi, mentre la variante Flash è stata pensata per offrire risposte rapide e costi inferiori.
Xiaomi ha scelto di rendere disponibili i pesi dei modelli, seguendo un approccio open source. L’azienda ha inoltre pubblicato oltre 7.000 ambienti per il reinforcement learning e il relativo framework completo, mettendo a disposizione una base più ampia per lo sviluppo e l’addestramento di sistemi di intelligenza artificiale.
mimo-v2.6 pro ai vertici dei benchmark
Secondo Xiaomi, MiMo-V2.6 Pro è il modello open source con il punteggio più elevato nell’Artificial Analysis Intelligence Index. Nella classifica risulta davanti a Qwen3.8 Max e mantiene una distanza ridotta rispetto a modelli proprietari e di nuova generazione valutati con le impostazioni di massimo impegno.
il confronto con i principali modelli ai
Il modello Xiaomi si colloca poco al di sotto di Claude Opus 5, GPT-5.6 Sol e Meta Muse Spark. Il risultato evidenzia l’obiettivo della società di competere nel settore dei modelli linguistici e multimodali con nomi già affermati come DeepSeek, Claude, ChatGPT e Gemini.
vibe world e generazione di ambienti 3d
Tra le capacità dichiarate figura il ragionamento spaziale tridimensionale, dimostrato attraverso un’esperienza chiamata “Vibe World”. A partire da una semplice immagine, da un video o da una descrizione testuale, MiMo-V2.6 può creare ambienti 3D interattivi, compresi scenari con caratteristiche simili a quelle di un videogioco.
Il sistema può inoltre generare modelli destinati a Blender e utilizzare flussi provenienti da più videocamere per controllare un braccio robotico Franka Panda. Le funzioni non si limitano alla componente visiva: il modello è in grado di produrre anche musica e di comporre brani dimostrativi con una qualità adatta a una presentazione preliminare.
strumenti disponibili anche su windows e mac
Parallelamente alla pubblicazione dei modelli e delle risorse per il reinforcement learning, Xiaomi sta distribuendo applicazioni desktop per Windows e Mac. La disponibilità degli strumenti su più piattaforme accompagna l’apertura del progetto e consente di utilizzare le funzionalità di MiMo-V2.6 anche al di fuori dei dispositivi mobili.











Lascia un commento