← Blog
·4 min di lettura

MiMo-V2.6-Pro, GLM-5.3 Prime, Qwen3.8 Max Prime: chi è davvero open-weight questa settimana

Due lanci con lo stesso suffisso — "Prime" — hanno dominato i titoli di questa settimana, ma nessuno dei due è un nuovo rilascio di pesi. Il vero cambiamento nella classifica open-weight arriva da un nome che in pochi aspettavano: Xiaomi.

Modelli openNotizieLicenze
MiMo-V2.6-Pro, GLM-5.3 Prime, Qwen3.8 Max Prime: chi è davvero open-weight questa settimana

Questa settimana i titoli erano tutti per due lanci con lo stesso suffisso — "Prime" — uno di Z.ai e uno di Alibaba. Nessuno dei due, però, è un rilascio di nuovi pesi: sono corsie API più veloci di modelli già esistenti. La vera notizia open-weight della settimana, arrivata con molto meno clamore, è che un produttore di smartphone ha appena scavalcato tutti i laboratori AI cinesi più noti in cima alla classifica dei modelli con pesi pubblici.

MiMo-V2.6-Pro: Xiaomi in cima alla classifica open-weight

Il 21 settembre 2026 Xiaomi ha pubblicato su Hugging Face MiMo-V2.6-Pro, un modello Mixture-of-Experts sparso da 1,02 trilioni di parametri totali, di cui solo 42 miliardi attivi per token, sotto licenza MIT pura — uso commerciale libero, nessuna soglia, nessuna clausola nascosta. Secondo Artificial Analysis, il modello segna 46 punti sull'Intelligence Index, il punteggio più alto mai raggiunto da un modello open-weight: supera sia GLM-5.3 di Z.ai sia Kimi K3 di Moonshot, entrambi fermi a 44, e si piazza sesto in classifica assoluta contando anche i modelli chiusi. Il dettaglio che ha sorpreso di più gli osservatori è il costo di addestramento dichiarato — circa 3 milioni di dollari — molto più basso di quanto normalmente associato a un modello di questa taglia, con un rapporto qualità-prezzo che Artificial Analysis colloca sulla frontiera di Pareto tra intelligenza e costo per token. Xiaomi ha pubblicato in parallelo anche MiMo-V2.6-Flash, una variante più economica pensata per volumi più alti.

GLM-5.3 Prime e Qwen3.8 Max Prime: due lanci che non sono nuovi pesi

Il 23 settembre 2026 Z.ai ha lanciato GLM-5.3 Prime, una variante ad alta velocità di GLM-5.3 che eredita tutte le capacità del modello base ma eroga 1,5-2 volte il throughput grazie a un'accelerazione dell'inferenza, con contesto fino a 1 milione di token e reasoning sempre attivo — non disattivabile, con tre livelli di sforzo (basso, alto, massimo, quest'ultimo di default). Non è un checkpoint nuovo: è un prodotto API, prezzato 2,80 $ per milione di token in input e 8,80 $ in output, pensato per workload di coding e orchestrazione agentica a lungo orizzonte.

Lo stesso giorno, dopo l'annuncio del 22 settembre alla Yunqi Conference di Hangzhou, Alibaba ha attivato Qwen3.8 Max Prime, una corsia più veloce dello stesso Qwen3.8-Max — il modello MoE sparso da 2,4 trilioni di parametri diventato, il 13 agosto, il primo modello di classe "Max" della famiglia Qwen a essere reso open-weight, sotto Apache 2.0. Qwen3.8 Max Prime usa gli stessi pesi, la stessa finestra di contesto da 1 milione di token e gli stessi strumenti del modello base: cambiano solo velocità e prezzo, che raddoppia rispetto alla versione standard (4 $ contro 2 $ per milione di token in input, 12 $ contro 6 $ in output). Anche qui, nessun peso nuovo da scaricare.

La licenza di GLM-5.3 non è MIT: la clausola che conta per chi fattura molto

Vale la pena tornare sulla licenza del modello base GLM-5.3 (753 miliardi di parametri, pubblicato su Hugging Face il 28 agosto), perché è un caso che dimostra ancora una volta quanto sia rischioso fidarsi dell'etichetta. Z.ai non ha usato MIT o Apache 2.0, ma un documento su misura — la "GLM-5.3 License" — che nella sostanza concede gli stessi diritti di una MIT (uso, copia, modifica, distribuzione, sublicenza, vendita, inclusi pesi, parametri, file di configurazione e codice di addestramento e inferenza), con un'unica clausola aggiuntiva che fa la differenza: gli operatori Model-as-a-Service che superano una determinata soglia di fatturato devono sottoporsi a una verifica di sicurezza. Due giorni prima, lo stesso laboratorio aveva invece rilasciato GLM-5.3-Flash — 320 miliardi di parametri totali, 18 attivi, il primo modello nativamente multimodale (testo, immagini, video) della serie GLM-5 — sotto licenza MIT pura, senza quella clausola. Stesso laboratorio, stessa settimana, due licenze diverse per due modelli della stessa famiglia.

Cosa conta per chi valuta un'architettura AI oggi

È il lavoro che facciamo ogni settimana con i nostri clienti: distinguere un vero rilascio di pesi da una nuova corsia API con lo stesso nome del modello, leggere la licenza esatta di ogni release — non quella della release precedente — e costruire un'architettura dove il modello giusto gira dove deve girare, con i vostri dati che restano vostri, indipendentemente da quale laboratorio abbia addestrato il modello o da quale classifica guidi questa settimana.

Fonti

Vuoi parlarne applicato al tuo caso?

Prenota una call →Altri articoli
Continua a leggere

Modelli open vs modelli chiusi: cosa cambia davvero per i tuoi dati sensibili

Un modello chiuso e uno open-weight non sono due varianti dello stesso prodotto: cambiano chi vede i tuoi dati e chi controlla il sistema. Ecco come decidere caso per caso.

nLPD, GDPR e intelligenza artificiale: la checklist per chi decide in azienda

Adottare uno strumento AI senza aver verificato dove finiscono i dati è il modo più rapido per trasformare un guadagno di produttività in un problema di conformità. Ecco cosa controllare prima.