ai.malagoli.me / content / blog/cinque-modelli-open-nove-giorni-agosto-2026.md
sito.md
IT/FR/DE/EN
scarica .md ↓
// perché questa pagina

Questa è la versione che leggono le AI.

Il Markdown è il formato in cui i modelli linguistici leggono davvero il web: niente CSS, niente JavaScript, niente impaginazione — solo struttura e contenuto. È la stessa pagina della versione originale, servita nella forma che un'AI capisce meglio.

text/markdown0 kB CSSllms.txt ✓sorgente .md ↗
---
title: "Ox Alpha aveva un nome: GLM-5.3, Hy4 e altri quattro modelli open in nove giorni"
description: "Tra il 20 e il 28 agosto 2026 sono usciti cinque modelli open-weight — tra cui il mistero Ox Alpha svelato come GLM-5.3-Flash, i pesi completi di GLM-5.3, Hy4 di Tencent e la retromarcia di licenza di MiniMax. Cosa cambia per chi valuta un'architettura AI oggi."
date: 2026-08-31
tags: [Modelli open, Notizie, Licenze]
url: "https://ai.malagoli.me/blog/cinque-modelli-open-nove-giorni-agosto-2026"
locale: it_CH
image: "/blog/cinque-modelli-open-nove-giorni-agosto-2026.svg"
---

# Ox Alpha aveva un nome: GLM-5.3, Hy4 e altri quattro modelli open in nove giorni

<!-- 2026-08-31 · Modelli open · Notizie · Licenze -->

In nove giorni, cinque rilasci open-weight hanno confermato che il divario di capacità con i modelli chiusi si sta chiudendo più in fretta del previsto — e hanno anche mostrato, con un caso concreto, perché la licenza di ieri non garantisce quella di domani.


Nella nostra rassegna della settimana scorsa scrivevamo di Ox Alpha, il modello comparso senza nome su OpenRouter e OpenCode, e concludevamo con un avvertimento netto: se non potete nominare l'azienda che lo gestisce, non inviategli segreti industriali né dati sensibili. Il mistero è durato una settimana: il 26 agosto Zhipu (Z.ai) ha rivelato che Ox Alpha era in realtà GLM-5.3-Flash, fatto girare in incognito su un cluster di circa 100.000 chip prodotti in Cina, capace di processare 100mila miliardi di token al giorno durante il test in stealth. È solo il primo di cinque rilasci open-weight comparsi in appena nove giorni, tra il 20 e il 28 agosto, che insieme raccontano meglio di qualunque classifica dove sta andando il mercato dei modelli aperti — e perché la licenza resta, ancora una volta, la variabile che conta più del podio.

## Ox Alpha aveva un nome, ed era sotto licenza MIT fin dall'inizio

GLM-5.3-Flash è un modello Mixture-of-Experts da 320 miliardi di parametri totali, di cui solo 18 miliardi attivi per token: il primo modello nativamente multimodale della famiglia GLM-5, con supporto a testo, immagini, video e documenti visivi in input intercalati. Prima della rivelazione ufficiale, il modello aveva già processato 62mila miliardi di token in incognito e, nei primi tre giorni su OpenRouter, ha superato gli 11mila miliardi di token — il lancio più grande mai registrato sulla piattaforma. Le azioni di Zhipu a Hong Kong sono salite di oltre il 12% nella seduta successiva all'annuncio. Ma il dato che conta per chi valuta un'adozione aziendale è un altro: i pesi sono su Hugging Face sotto licenza MIT pulita, senza clausole di utilizzo accettabile né soglie nascoste. Il caso Ox Alpha si chiude, dunque, nel modo migliore possibile — ma il fatto che ci sia voluta una settimana per sapere chi c'era dietro resta la lezione da portarsi a casa: finché non conoscete il fornitore, il vostro avvertimento di due settimane fa vale ancora.

## I pesi completi di GLM-5.3 arrivano, ma sotto una licenza diversa da quella del fratello minore

Il 28 agosto Z.ai ha pubblicato anche i pesi completi di GLM-5.3, il modello da 753 miliardi di parametri di cui scrivevamo due settimane fa a proposito delle oltre mille vulnerabilità critiche trovate durante il post-training e della conseguente revisione di sicurezza. Qui, però, la sorpresa è nella licenza: a differenza di GLM-5.2 e dello stesso GLM-5.3-Flash, entrambi sotto MIT pulita, GLM-5.3 arriva con una licenza scritta apposta — il testo è quasi identico a MIT, tranne una clausola aggiunta: chi opera un servizio di tipo Model-as-a-Service con oltre 10 miliardi di dollari di fatturato deve sottoporsi a una revisione di sicurezza prima di offrire il modello ai propri clienti. È una soglia pensata esplicitamente per i grandi hyperscaler, non per un'azienda che lo ospita internamente — ma è un altro promemoria che, all'interno della stessa famiglia di modelli dello stesso laboratorio, due release pubblicate a due giorni di distanza possono avere due licenze diverse. Verificare quella del modello specifico che scaricate resta l'unico modo per saperlo con certezza.

## Tencent entra in scena con Hy4 Preview, e sceglie la strada più semplice: Apache 2.0

Lo stesso 28 agosto Tencent ha rilasciato e reso open-source Hy4 Preview, un modello Mixture-of-Experts da 770 miliardi di parametri totali con 49 miliardi attivi per token e una finestra di contesto oltre il milione di token. Secondo test comparativi indipendenti, guida la classifica SWE-bench Pro e batte sia GLM-5.3 sia Kimi K3 in valutazioni di ingegneria del software condotte alla cieca. Un dettaglio che vale la pena notare: Tencent dichiara di aver usato Hy4 durante il proprio sviluppo per automatizzare parte dell'ottimizzazione dei metodi di addestramento, e il modello ha contribuito a ottimizzare la propria stessa infrastruttura di inferenza, con un aumento di throughput misurato del 31,8%. Sul piano della licenza, però, la scelta di Tencent è quella più semplice da valutare di tutta questa rassegna: Apache 2.0 genuina e senza restrizioni, la stessa licenza già vista su gran parte della famiglia Qwen. Nessuna soglia di fatturato, nessuna clausola di revisione, nessuna sorpresa da cercare tra le righe.

## Qwen3.8-Flash-Next: anteprima dell'architettura Qwen4, licenza da verificare scheda per scheda

Il 26 agosto Alibaba ha rilasciato Qwen3.8-Flash-Next, un'anteprima dell'architettura che erediterà Qwen4: 176 miliardi di parametri totali — di cui 51 miliardi in una nuova tabella di embedding indicizzata su bigrammi e trigrammi, pensata come asse di scalabilità meno costoso computazionalmente rispetto al solo Mixture-of-Experts — con soli 6 miliardi di parametri attivi per token. È un modello pensato per girare su hardware più contenuto rispetto ai giganti da trilioni di parametri visti nelle scorse settimane. Sulla licenza, però, le fonti che abbiamo verificato non concordano: alcune riportano Apache 2.0, altre la Qwen Community License 1.0, più restrittiva su alcuni scenari di utilizzo su larga scala. È esattamente il tipo di discrepanza che raccomandiamo sempre di risolvere leggendo il file di licenza pubblicato con quello specifico checkpoint su Hugging Face, non un riassunto di terzi — la nostra stessa regola, applicata a un caso reale di questa settimana.

## Il caso MiniMax: il permissivo di ieri non garantisce quello di domani

Il caso più istruttivo della settimana, per chi si occupa di conformità più che di benchmark, riguarda MiniMax. L'azienda aveva costruito la propria reputazione tra gli sviluppatori rilasciando M2 sotto licenza MIT nell'ottobre 2025 e M2.5 alle stesse condizioni nel febbraio 2026. Con M2.7, reso ampiamente disponibile in queste settimane, quella serie di rilasci permissivi si è interrotta: il modello resta scaricabile, ma sotto una licenza "Modified-MIT" che riserva l'uso libero solo a scopi personali e di ricerca non commerciale — qualunque impiego commerciale, incluso l'auto-hosting a fini di business o il fine-tuning per un prodotto a pagamento, richiede ora un'autorizzazione scritta preventiva da MiniMax. La comunità di sviluppatori ha reagito duramente, definendo l'operazione "open-source di facciata" proprio perché il nome "Modified-MIT" continua a evocare l'apertura della licenza originale pur cambiandone la sostanza. Il contesto non è irrilevante: il cambio arriva pochi mesi dopo la quotazione di MiniMax alla Borsa di Hong Kong, a gennaio 2026.

È il caso più concreto che abbiamo visto finora di un principio che ripetiamo da mesi: la licenza di un modello non è una proprietà stabile della famiglia o del laboratorio, è una condizione legata a quella specifica release, che può cambiare da una versione all'altra senza preavviso. Un'azienda che avesse costruito un prodotto commerciale su M2 o M2.5 confidando che lo stesso regime permissivo si sarebbe automaticamente esteso a M2.7 si ritroverebbe oggi fuori conformità — non per una scelta sbagliata al momento dell'adozione, ma per non aver riverificato la licenza a ogni nuova versione prima di aggiornare la propria infrastruttura.

## Il quadro dietro i cinque rilasci: il divario di capacità si chiude, quello di prezzo no

Presi insieme, questi cinque rilasci confermano una tendenza più ampia osservata da diversi analisti indipendenti in queste settimane: il divario di capacità tra i migliori modelli open-weight e i migliori modelli chiusi si è ristretto molto più rapidamente del divario di prezzo, che resta enorme. Su benchmark comparabili, i modelli open oggi restano indietro rispetto ai modelli chiusi di frontiera di pochi punti percentuali, a una frazione del costo per token. Non è un dettaglio da addetti ai lavori: secondo le stime più recenti, i modelli open-weight instradano ormai oltre metà dei token di inferenza in produzione a livello globale, contro una quota marginale di appena due anni fa. Per un'azienda che sta ancora valutando se un'architettura open-first sia matura abbastanza per un caso d'uso reale, il segnale di questa settimana è che la domanda si è spostata: non più "il modello open è abbastanza capace", ma "quale licenza specifica governa il modello che sto per adottare, e resterà valida alla prossima versione".

## Cosa verificare, in pratica, prima di scegliere uno di questi modelli

- Non fidatevi della licenza "storica" di una famiglia di modelli: GLM-5.3-Flash e GLM-5.3, pubblicati a due giorni di distanza dallo stesso laboratorio, hanno licenze diverse. Verificate quella pubblicata con il checkpoint specifico che intendete usare.

- Se le fonti secondarie non concordano sulla licenza — come nel caso di Qwen3.8-Flash-Next questa settimana — andate sempre al file di licenza originale su Hugging Face prima di costruirci sopra qualunque cosa.

- Il caso MiniMax dimostra che una licenza permissiva su una versione precedente non è una garanzia per quella successiva: se il vostro prodotto dipende da un modello open, ricontrollate la licenza a ogni aggiornamento prima di distribuirlo, non solo alla prima adozione.

- Se non conoscete il fornitore dietro un modello — come è stato per una settimana con Ox Alpha — trattatelo come un fornitore non identificato a tutti gli effetti: nessun dato sensibile, nessun segreto industriale, finché non emerge un nome e un contratto verificabile.

È esattamente il controllo che facciamo ogni settimana per i nostri clienti: non fermarci al nome del laboratorio o al posizionamento in classifica, ma leggere la licenza pubblicata quel giorno specifico con quel checkpoint specifico — perché, come dimostra il caso MiniMax, la licenza che vale oggi non è una garanzia per quella di domani, e costruire un'architettura che resta conforme richiede di ricontrollarla a ogni versione, non solo alla prima adozione.

### Fonti

- [South China Morning Post — le azioni di Zhipu salgono dopo la rivelazione di Ox Alpha come GLM-5.3-Flash su chip cinesi](https://www.scmp.com/tech/big-tech/article/3365433/zhipu-ai-shares-jump-viral-ox-alpha-model-revealed-glm-53-flash-chinese-chips)

- [TechNode — Zhipu identifica Ox Alpha come GLM-5.3-Flash e rilascia i pesi del modello](https://technode.com/2026/08/27/zhipu-identifies-ox-alpha-as-glm-5-3-flash-and-releases-model-weights/)

- [The New Stack — GLM-5.3 diventa open weight, ma la nuova licenza guarda agli hyperscaler](https://thenewstack.io/zai-glm-weights-license/)

- [Tencent — annuncio ufficiale del rilascio open-source di Hy4 Preview](https://www.tencent.com/tencent-releases-and-open-sources-tencent-hy4-preview/)

- [Simon Willison — note tecniche sul rilascio di Hy4 Preview](https://simonwillison.net/2026/Aug/29/hy4/)

- [MarkTechPost — Alibaba rilascia Qwen3.8-Flash-Next, anteprima dell'architettura Qwen4](https://www.marktechpost.com/2026/08/26/alibabas-qwen-team-releases-qwen3-8-flash-next-a-125b-multimodal-moe-with-6b-active-parameters-previewing-the-qwen4-architecture/)

- [Decrypt — MiniMax rilascia un modello agente all'avanguardia, poi cambia silenziosamente la licenza](https://decrypt.co/364225/minimax-m27-agent-model-license-change)

- [Requesty — cinque rilasci open weight in nove giorni e il collasso del premio di capacità](https://www.requesty.ai/blog/open-weight-frontier-august-2026-glm-qwen-hy4)


- [tutti gli articoli](/markdown.md)
- [versione impaginata](/blog/cinque-modelli-open-nove-giorni-agosto-2026)

© 2026 ai.malagoli.me · dati ospitati in Svizzera · CH ✓
[Privacy Policy](/privacy) · [Cookie Policy](/cookie-policy)

torna al sito →