---
title: "Ox Alpha avait bien un nom : GLM-5.3, Hy4 et quatre autres modèles ouverts en neuf jours"
description: "Entre le 20 et le 28 août 2026, cinq modèles open-weight sont sortis — dont le mystère Ox Alpha révélé comme GLM-5.3-Flash, les poids complets de GLM-5.3, Hy4 de Tencent et le revirement de licence de MiniMax. Ce que cela change pour qui évalue une architecture IA aujourd'hui."
date: 2026-08-31
tags: [Modèles ouverts, Actualités, Licences]
url: "https://ai.malagoli.me/fr/blog/cinque-modelli-open-nove-giorni-agosto-2026"
locale: fr_CH
image: "/blog/cinque-modelli-open-nove-giorni-agosto-2026.svg"
---

# Ox Alpha avait bien un nom : GLM-5.3, Hy4 et quatre autres modèles ouverts en neuf jours

<!-- 2026-08-31 · Modèles ouverts · Actualités · Licences -->

En neuf jours, cinq sorties open-weight ont confirmé que l'écart de capacité avec les modèles fermés se referme plus vite que prévu — et ont aussi montré, avec un cas concret, pourquoi la licence d'hier ne garantit pas celle de demain.

***

Dans notre revue de la semaine dernière, nous parlions d'Ox Alpha, ce modèle apparu sans nom sur OpenRouter et OpenCode, et nous concluions par un avertissement sans détour : si vous ne pouvez pas nommer l'entreprise qui l'exploite, ne lui envoyez ni secrets industriels ni données sensibles. Le mystère aura duré exactement une semaine : le 26 août, Zhipu (Z.ai) a révélé qu'Ox Alpha était en réalité GLM-5.3-Flash, exécuté incognito sur un cluster d'environ 100 000 puces produites en Chine, capable de traiter 100 000 milliards de tokens par jour pendant l'essai furtif. Ce n'est que la première de cinq sorties open-weight condensées en neuf jours, entre le 20 et le 28 août — ensemble, elles racontent mieux que n'importe quel classement où va le marché des modèles ouverts, et pourquoi la licence compte, une fois de plus, plus que le podium.

## Ox Alpha avait bien un nom, et il était sous licence MIT dès le premier jour

GLM-5.3-Flash est un modèle Mixture-of-Experts de 320 milliards de paramètres au total, dont seulement 18 milliards actifs par token : le premier modèle nativement multimodal de la famille GLM-5, gérant texte, images, vidéo et documents visuels en entrée entrelacée. Avant la révélation officielle, le modèle avait déjà traité 62 000 milliards de tokens en incognito, et lors de ses trois premiers jours sur OpenRouter il a dépassé les 11 000 milliards de tokens — le plus gros lancement jamais enregistré sur la plateforme. L'action Zhipu a clôturé en hausse de plus de 12 % à Hong Kong le lendemain de l'annonce. Mais le détail qui compte pour une entreprise évaluant une adoption est ailleurs : les poids sont sur Hugging Face sous licence MIT pure, sans clause d'usage acceptable ni seuil caché. Le cas Ox Alpha se referme donc de la meilleure façon possible — mais le fait qu'il ait fallu une semaine pour savoir qui se cachait derrière reste la leçon à retenir : tant que vous ne connaissez pas le fournisseur, notre avertissement d'il y a deux semaines reste valable.

## Les poids complets de GLM-5.3 arrivent, sous une licence différente de celle de son petit frère

Le 28 août, Z.ai a également publié les poids complets de GLM-5.3, le modèle de 753 milliards de paramètres dont nous parlions il y a deux semaines à propos des plus de mille vulnérabilités critiques trouvées pendant le post-entraînement et de la revue de sécurité qui en a résulté. Ici, pourtant, la surprise vient de la licence : contrairement à GLM-5.2 et à GLM-5.3-Flash lui-même, tous deux sous MIT pure, GLM-5.3 arrive avec une licence rédigée sur mesure — un texte presque identique à MIT, à l'exception d'une clause ajoutée : tout opérateur de service Model-as-a-Service dépassant 10 milliards de dollars de chiffre d'affaires doit se soumettre à une revue de sécurité avant de proposer le modèle à ses clients. C'est un seuil clairement pensé pour les grands hyperscalers, pas pour une entreprise qui l'héberge en interne — mais c'est un nouveau rappel qu'au sein d'une même famille de modèles issue du même laboratoire, deux sorties publiées à deux jours d'intervalle peuvent porter deux licences différentes. Vérifier celle du modèle précis que vous téléchargez reste le seul moyen d'en être certain.

## Tencent entre en scène avec Hy4 Preview, et choisit la voie la plus simple : Apache 2.0

Ce même 28 août, Tencent a publié et open-sourcé Hy4 Preview, un modèle Mixture-of-Experts de 770 milliards de paramètres au total, 49 milliards actifs par token, avec une fenêtre de contexte dépassant le million de tokens. Selon des tests comparatifs indépendants, il domine le classement SWE-bench Pro et bat à la fois GLM-5.3 et Kimi K3 lors d'évaluations d'ingénierie logicielle menées à l'aveugle. Un détail à noter : Tencent affirme avoir utilisé Hy4 durant son propre développement pour automatiser une partie de l'optimisation des méthodes d'entraînement, et le modèle a même contribué à optimiser sa propre infrastructure d'inférence, avec un gain de débit mesuré de 31,8 %. Côté licence, en revanche, Tencent fait le choix le plus simple à évaluer de toute cette revue : une Apache 2.0 authentique et sans restriction, la même licence déjà largement utilisée dans la famille Qwen. Aucun seuil de chiffre d'affaires, aucune clause de revue, aucune surprise cachée dans les petites lignes.

## Qwen3.8-Flash-Next : un aperçu de l'architecture Qwen4, licence à vérifier fiche par fiche

Le 26 août, Alibaba a publié Qwen3.8-Flash-Next, un aperçu de l'architecture qui succédera à Qwen4 : 176 milliards de paramètres au total — dont 51 milliards dans une nouvelle table d'embedding indexée sur des bigrammes et trigrammes, pensée comme un axe de mise à l'échelle moins coûteux en calcul que le seul Mixture-of-Experts — avec seulement 6 milliards de paramètres actifs par token. C'est un modèle conçu pour fonctionner sur du matériel bien plus modeste que les géants à plusieurs milliers de milliards de paramètres vus ces dernières semaines. Côté licence, cependant, les sources que nous avons vérifiées ne concordent pas : certaines mentionnent Apache 2.0, d'autres la Qwen Community License 1.0, plus restrictive dans certains scénarios de déploiement à grande échelle. C'est exactement le type de divergence que nous recommandons toujours de résoudre en lisant le fichier de licence publié avec ce checkpoint précis sur Hugging Face, et non un résumé tiers — notre propre règle, appliquée à un cas réel de cette semaine.

## Le cas MiniMax : la permissivité d'hier ne garantit pas celle de demain

Le cas le plus instructif de la semaine, pour qui s'occupe de conformité plus que de benchmarks, concerne MiniMax. L'entreprise avait bâti sa réputation auprès des développeurs en publiant M2 sous licence MIT en octobre 2025, puis M2.5 aux mêmes conditions en février 2026. Avec M2.7, rendu largement disponible ces dernières semaines, cette série de sorties permissives s'est interrompue : le modèle reste téléchargeable, mais sous une licence « Modified-MIT » qui réserve l'usage libre aux seules fins personnelles et de recherche non commerciale — tout usage commercial, y compris l'auto-hébergement à des fins professionnelles ou le fine-tuning pour un produit payant, exige désormais une autorisation écrite préalable de MiniMax. La communauté des développeurs a réagi vivement, qualifiant l'opération de « faux open source », précisément parce que le nom « Modified-MIT » continue d'évoquer l'ouverture de la licence originale tout en en changeant discrètement la substance. Le contexte n'est pas anodin : ce changement intervient quelques mois après l'introduction en bourse de MiniMax à Hong Kong, en janvier 2026.

C'est le cas le plus concret que nous ayons vu jusqu'ici d'un principe que nous répétons depuis des mois : la licence d'un modèle n'est pas une propriété stable de sa famille ou de son laboratoire, c'est une condition attachée à cette version précise, qui peut changer d'une version à l'autre sans préavis. Une entreprise qui aurait bâti un produit commercial sur M2 ou M2.5 en supposant que le même régime permissif s'étendrait automatiquement à M2.7 se retrouverait aujourd'hui hors conformité — non pas à cause d'un mauvais choix au moment de l'adoption, mais faute d'avoir revérifié la licence à chaque nouvelle version avant de mettre à jour son infrastructure.

## La tendance derrière ces cinq sorties : l'écart de capacité se referme, pas celui des prix

Pris ensemble, ces cinq lancements confirment une tendance plus large relevée par plusieurs analystes indépendants ces dernières semaines : l'écart de capacité entre les meilleurs modèles open-weight et les meilleurs modèles fermés s'est réduit bien plus vite que l'écart de prix, qui reste énorme. Sur des benchmarks comparables, les modèles ouverts n'accusent plus aujourd'hui que quelques points de pourcentage de retard sur les modèles fermés de pointe, pour une fraction du coût par token. Ce n'est pas un détail réservé aux spécialistes : selon les dernières estimations, les modèles open-weight acheminent désormais plus de la moitié des tokens d'inférence en production à l'échelle mondiale, contre une part marginale il y a deux ans à peine. Pour une entreprise qui se demande encore si une architecture open-first est assez mature pour un cas d'usage réel, le signal de cette semaine est que la question a changé de nature : ce n'est plus « le modèle ouvert est-il assez capable », mais « quelle licence précise régit le modèle que je m'apprête à adopter, et tiendra-t-elle encore à la prochaine version ».

## Ce qu'il faut vérifier, concrètement, avant de choisir l'un de ces modèles

- Ne vous fiez pas à la licence « historique » d'une famille de modèles : GLM-5.3-Flash et GLM-5.3, publiés à deux jours d'intervalle par le même laboratoire, portent des licences différentes. Vérifiez celle publiée avec le checkpoint précis que vous comptez utiliser.
- Si les sources secondaires ne s'accordent pas sur la licence — comme pour Qwen3.8-Flash-Next cette semaine — allez toujours consulter le fichier de licence original sur Hugging Face avant de construire quoi que ce soit dessus.
- Le cas MiniMax montre qu'une licence permissive sur une version ne garantit rien pour la suivante : si votre produit dépend d'un modèle ouvert, revérifiez la licence à chaque mise à jour avant de la déployer, pas seulement lors de l'adoption initiale.
- Si vous ne connaissez pas le fournisseur derrière un modèle — comme ce fut le cas pendant une semaine avec Ox Alpha — traitez-le comme un fournisseur non identifié à tous égards : aucune donnée sensible, aucun secret industriel, tant qu'un nom vérifiable et un contrat n'ont pas émergé.

C'est exactement le contrôle que nous effectuons chaque semaine pour nos clients : ne pas s'arrêter au nom du laboratoire ou à sa position dans les classements, mais lire la licence publiée ce jour précis pour ce checkpoint précis — car, comme le montre le cas MiniMax, la licence valable aujourd'hui ne garantit pas celle de demain, et construire une architecture qui reste conforme exige de la revérifier à chaque version, pas seulement lors de l'adoption initiale.

### Sources

- [South China Morning Post — l'action Zhipu bondit après la révélation d'Ox Alpha comme GLM-5.3-Flash sur puces chinoises](https://www.scmp.com/tech/big-tech/article/3365433/zhipu-ai-shares-jump-viral-ox-alpha-model-revealed-glm-53-flash-chinese-chips)
- [TechNode — Zhipu identifie Ox Alpha comme GLM-5.3-Flash et publie les poids du modèle](https://technode.com/2026/08/27/zhipu-identifies-ox-alpha-as-glm-5-3-flash-and-releases-model-weights/)
- [The New Stack — GLM-5.3 de Z.ai devient open weight, mais sa nouvelle licence vise les hyperscalers](https://thenewstack.io/zai-glm-weights-license/)
- [Tencent — annonce officielle de la publication open source de Hy4 Preview](https://www.tencent.com/tencent-releases-and-open-sources-tencent-hy4-preview/)
- [Simon Willison — notes techniques sur la sortie de Hy4 Preview](https://simonwillison.net/2026/Aug/29/hy4/)
- [MarkTechPost — Alibaba publie Qwen3.8-Flash-Next, un aperçu de l'architecture Qwen4](https://www.marktechpost.com/2026/08/26/alibabas-qwen-team-releases-qwen3-8-flash-next-a-125b-multimodal-moe-with-6b-active-parameters-previewing-the-qwen4-architecture/)
- [Decrypt — MiniMax publie un modèle agent à la pointe, puis change discrètement la licence](https://decrypt.co/364225/minimax-m27-agent-model-license-change)
- [Requesty — cinq sorties open weight en neuf jours et l'effondrement de la prime de capacité](https://www.requesty.ai/blog/open-weight-frontier-august-2026-glm-qwen-hy4)

***

- [tous les articles](/fr/markdown.md)
- [version mise en page](/fr/blog/cinque-modelli-open-nove-giorni-agosto-2026)

© 2026 ai.malagoli.me · données hébergées en Suisse · CH ✓
[Politique de confidentialité](/fr/privacy) · [Politique de cookies](/fr/cookie-policy)
