← Blog
·4 min di lettura

I pesi di Kimi K3 sono online: perché ospitarli voi stessi conta più del modello

I pesi completi di Kimi K3 — 2,8 trilioni di parametri, il rilascio open-weight più grande di sempre — sono online da oggi. Ma la scelta che conta per un'azienda non è quale modello scaricare: è dove farlo girare.

Modelli openNotizieSovranità dei dati
I pesi di Kimi K3 sono online: perché ospitarli voi stessi conta più del modello

Nella nostra rassegna di due settimane fa raccontavamo l'annuncio di Kimi K3: benchmark pubblicati, podio scosso, ma pesi non ancora scaricabili. Oggi, 27 luglio 2026, quella fase è chiusa: Moonshot ha pubblicato su Hugging Face i pesi completi del modello, circa 594 GB in formato MXFP4, rendendo Kimi K3 il rilascio open-weight più grande mai reso disponibile al pubblico. Ma la notizia che conta davvero per chi decide un'architettura AI in azienda non è il numero di parametri: è cosa cambia, concretamente, tra usare l'API di Moonshot e far girare quegli stessi pesi sulla propria infrastruttura.

La differenza non è più teorica: oggi è scaricabile

Finché un modello esiste solo come API, la distinzione tra "dove è stato addestrato" e "dove viene eseguito" resta un argomento da consulente. Da oggi, con i pesi di K3 pubblicamente disponibili, quella distinzione diventa una scelta operativa che ogni azienda può fare concretamente: scaricare il modello e farlo girare sulla propria infrastruttura, o su un cloud sovrano svizzero, invece di inviare i propri prompt ai server di un fornitore cinese.

Perché l'auto-hosting non è un dettaglio tecnico

Il quadro normativo cinese non è ambiguo su questo punto: la Legge sull'intelligence nazionale del 2017 impone a ogni organizzazione cinese di cooperare con le richieste dei servizi di intelligence, e la Legge sulla sicurezza dei dati (2021) e la Legge sulla cybersicurezza (2017) aggiungono obblighi di localizzazione dei dati. Questi obblighi ricadono sull'azienda che fornisce il servizio, non sulla giurisdizione dei server fisici — motivo per cui affidarsi all'API di un fornitore cinese, indipendentemente da dove si trovino tecnicamente i suoi datacenter, espone a un rischio che nessun contratto elimina davvero. Il Centro nazionale cinese per la sicurezza informatica aveva già segnalato Kimi nel 2025 per raccolta di dati non pertinenti al servizio, e un caso documentato ha visto il chatbot rivelare a un utente non correlato il curriculum completo di un altro — nome, telefono, storico lavorativo.

Quando invece si scaricano i pesi e li si esegue sulla propria infrastruttura, i prompt non lasciano mai il perimetro dell'azienda: quel quadro normativo, per quanto reale, diventa irrilevante rispetto al flusso dei vostri dati, perché non c'è più alcun server di Moonshot nel percorso. È esattamente la distinzione tra origine del modello ed esecuzione del modello di cui scrivevamo nella rassegna precedente — solo che oggi, per la prima volta su un modello di questa scala, è una scelta che potete attuare fin da subito.

La licenza: stessa struttura di K2, da verificare comunque riga per riga

K3 dovrebbe ereditare la Modified MIT License già vista su K2.7 Code, con la clausola di attribuzione che scatta oltre 100 milioni di utenti attivi mensili o 20 milioni di dollari di fatturato mensile — una soglia irrilevante per la maggior parte delle aziende. Ma il testo esatto della licenza pubblicata insieme ai pesi di K3 va letto per intero prima dell'adozione, non dato per identico a quello della release precedente: i laboratori cambiano i termini da una versione all'altra più spesso di quanto ci si aspetti.

Un punto di attenzione prima di portarlo in produzione

Test indipendenti citati nei giorni precedenti al rilascio hanno rilevato un tasso di allucinazione attorno al 51% su alcuni benchmark, un dato che non compariva nei grafici ufficiali diffusi da Moonshot. Non è un motivo per scartare il modello, ma è un motivo per testarlo sul vostro caso d'uso specifico prima di qualunque adozione in produzione — soprattutto su contenuti regolamentati, dove un'allucinazione non è un fastidio ma un rischio di conformità.

Nel frattempo, Mistral sceglie la strada opposta: tutto Apache 2.0

Nella stessa settimana, Mistral AI ha confermato che l'intera famiglia Mistral 3 — i modelli densi da 3, 8 e 14 miliardi di parametri e il modello di punta Large 3 — è rilasciata sotto licenza Apache 2.0, senza soglie di utenti o fatturato e senza clausole di attribuzione condizionate. È un laboratorio europeo, con un quadro di conformità già più vicino a quello di un'azienda svizzera, e una licenza che non richiede la stessa attenzione riga per riga necessaria con Kimi K3. Non compete sulla stessa scala di parametri, ma per molti casi d'uso è oggi l'alternativa più semplice da giustificare in un audit di conformità.

Cosa fare, in pratica, se valutate un modello aperto oggi

È esattamente il lavoro che facciamo ogni settimana con i nostri clienti: verificare la licenza prima che diventi un problema, portare i pesi dentro il vostro perimetro invece di inviare i vostri dati fuori, e costruire un'architettura dove il modello gira dove deve girare — indipendentemente da chi lo ha addestrato e da dove.

Fonti

Vuoi parlarne applicato al tuo caso?

Prenota una call →Altri articoli
Continua a leggere

Modelli open vs modelli chiusi: cosa cambia davvero per i tuoi dati sensibili

Un modello chiuso e uno open-weight non sono due varianti dello stesso prodotto: cambiano chi vede i tuoi dati e chi controlla il sistema. Ecco come decidere caso per caso.

nLPD, GDPR e intelligenza artificiale: la checklist per chi decide in azienda

Adottare uno strumento AI senza aver verificato dove finiscono i dati è il modo più rapido per trasformare un guadagno di produttività in un problema di conformità. Ecco cosa controllare prima.