Dans notre dernier tour d'horizon, mi-juillet, nous écrivions que le podium des modèles open-weight changeait presque chaque mois. Cela n'a tenu que quelques jours : entre le 15 et le 16 juillet 2026, deux sorties ont de nouveau déplacé l'équilibre — l'une venue de Chine, l'autre d'un laboratoire américain tout juste fondé. Pour qui doit décider d'une architecture AI en entreprise, la question intéressante n'est pas de savoir lequel des deux est "le meilleur", mais ce que disent leurs licences et ce que cela change concrètement pour rester conforme.
Kimi K3 : le plus grand modèle ouvert jamais publié
Moonshot AI a présenté le 16 juillet Kimi K3, un modèle Mixture-of-Experts d'environ 2,8 billions de paramètres au total (près de 900 experts, dont seulement 16 actifs par token), avec un contexte allant jusqu'à 1 million de tokens et des capacités natives de vision. Selon des benchmarks indépendants cités par plusieurs médias, il se classe aujourd'hui quatrième parmi tous les modèles — fermés ou ouverts — juste derrière les deux modèles de pointe les plus récents et devant des concurrents fermés établis. La réaction des marchés n'est pas passée inaperçue : les actions des principaux fabricants de semi-conducteurs ont nettement chuté dans les jours suivants, et plusieurs observateurs ont parlé d'un second "moment DeepSeek".
La licence, cependant, n'est pas la licence MIT ou Apache 2.0 "propre" à laquelle on pourrait s'attendre en lisant seulement les titres : Moonshot utilise depuis longtemps une Modified MIT License, qui autorise librement l'usage commercial, le fine-tuning et la redistribution, mais impose d'afficher visiblement le nom du modèle dans l'interface si le produit commercial qui l'intègre dépasse 100 millions d'utilisateurs actifs mensuels ou 20 millions de dollars de revenu mensuel. Pour l'immense majorité des entreprises, ce seuil reste théorique, mais il doit tout de même être lu avant d'adopter le modèle, et non présumé. Les poids complets sont attendus pour le 27 juillet 2026 : au moment où nous écrivons, Kimi K3 est annoncé et vérifié par des benchmarks, mais pas encore téléchargeable.
Inkling : le premier modèle ouvert de Thinking Machines Lab
La veille, le 15 juillet, Thinking Machines Lab — le laboratoire fondé par Mira Murati, ex-directrice technique d'OpenAI — a publié Inkling, son premier modèle public, et il est open-weight : environ 975 milliards de paramètres au total dans une architecture MoE, avec seulement 6 experts sur 256 actifs par token (environ 41 milliards de paramètres actifs), nativement multimodal en texte, image et audio, entraîné sur 45 000 milliards de tokens. La licence est Apache 2.0, sans seuil ni clause cachée : usage commercial, modification et redistribution libres dès le premier utilisateur.
C'est un signal qui mérite d'être noté au-delà des caractéristiques techniques : un laboratoire américain de premier plan, disposant de capitaux importants et sans besoin de générer des revenus immédiats, a choisi l'ouverture comme premier produit public plutôt qu'un modèle fermé accessible uniquement par API — jusqu'ici la norme chez les laboratoires américains, à l'exception partielle de Meta. Parmi les objectifs déclarés de l'équipe figurent la maîtrise des coûts d'inférence et une meilleure résistance du modèle à la censure.
Pendant ce temps, Alibaba ne reste pas les bras croisés
La même semaine, Alibaba a dévoilé un aperçu de Qwen3.8-Max, un modèle de 2,4 billions de paramètres, en annonçant que les poids de cette nouvelle génération seront eux aussi publiés — dans la continuité de la stratégie déjà observée avec la série 3.6, toujours sous licence Apache 2.0. C'est une nouvelle confirmation qu'à ce stade, le rythme des sorties open-weight se mesure en jours, pas en mois.
Ce qui compte vraiment pour une entreprise qui décide aujourd'hui
- Courir après l'annonce de la semaine n'est pas une stratégie : à ce rythme, le modèle que vous choisissez aujourd'hui comme "le meilleur" risque de ne plus l'être dans un mois. Ce qui compte, c'est une architecture qui permette de le remplacer sans tout reconstruire.
- Les licences restent très différentes les unes des autres même lorsqu'elles paraissent toutes "permissives" : la Modified MIT de Kimi K3 comporte des seuils d'attribution que l'Apache 2.0 d'Inkling et de Qwen n'a pas. Il faut les lire une par une, sans se fier à l'étiquette.
- La réaction des marchés aux sorties chinoises est un rappel pratique, pas seulement financier : une architecture pensée pour être agnostique au modèle — où le modèle est interchangeable et où vos données restent sous votre contrôle, sur votre propre infrastructure ou un cloud souverain suisse — vous protège de la volatilité d'un secteur qui change de leader toutes les quelques semaines.
- Les échéances de l'AI Act n'attendent pas la prochaine sortie : les sanctions pour les modèles à usage général s'appliquent dès août 2026, dans quelques jours. Vérifier la conformité de votre architecture maintenant coûte bien moins cher que de découvrir un problème plus tard.
C'est le travail que nous faisons chaque semaine avec nos clients : suivre ces sorties, lire les licences avant qu'elles ne deviennent un problème, et construire une architecture où le bon modèle tourne là où il doit tourner — avec vos données qui restent les vôtres, quel que soit celui qui mène le podium cette semaine-là.
- Kimi K3 — guide de démarrage officiel sur la Kimi API Platform (Moonshot AI) ↗
- Licence Modified MIT des modèles Kimi — dépôt officiel sur GitHub ↗
- Axios — "China just erased America's AI lead", sur la réaction des marchés à Kimi K3 ↗
- Inkling — annonce officielle de Thinking Machines Lab ↗
- Inkling — poids du modèle sur Hugging Face ↗
- Qwen3.8-Max (Alibaba) — aperçu et annonce de la publication des poids ↗