---
title: "MiMo-V2.6-Pro, GLM-5.3 Prime, Qwen3.8 Max Prime: wer diese Woche wirklich offene Gewichte liefert"
description: "Diese Woche standen zwei Starts namens "Prime" — von Z.ai und Alibaba — im Rampenlicht, doch keiner davon ist eine neue Gewichte-Veröffentlichung, sondern nur eine schnellere API-Spur für bereits existierende Modelle. Die eigentliche Veränderung im Open-Weight-Ranking kommt von Xiaomi. Was das für die Compliance eines Schweizer Unternehmens bedeutet."
date: 2026-09-28
tags: [Offene Modelle, Nachrichten, Lizenzen]
url: "https://ai.malagoli.me/de/blog/mimo-v26-pro-glm-53-prime-qwen38-max-prime-settembre-2026"
locale: de_CH
image: "/blog/mimo-v26-pro-glm-53-prime-qwen38-max-prime-settembre-2026.svg"
---

# MiMo-V2.6-Pro, GLM-5.3 Prime, Qwen3.8 Max Prime: wer diese Woche wirklich offene Gewichte liefert

<!-- 2026-09-28 · Offene Modelle · Nachrichten · Lizenzen -->

Zwei Starts mit demselben Suffix — "Prime" — beherrschten diese Woche die Schlagzeilen, doch keiner ist eine neue Gewichte-Veröffentlichung. Die eigentliche Verschiebung im Open-Weight-Ranking kommt von einem Namen, den kaum jemand erwartet hätte: Xiaomi.

***

Die Schlagzeilen dieser Woche drehten sich ganz um zwei Starts mit demselben Suffix — "Prime" —, einen von Z.ai, einen von Alibaba. Keiner der beiden ist jedoch eine Veröffentlichung neuer Gewichte: Beide sind lediglich schnellere API-Spuren für bereits existierende Modelle. Die eigentliche Open-Weight-Nachricht der Woche, die deutlich weniger Aufmerksamkeit bekam, ist, dass ein Smartphone-Hersteller soeben alle bekannten chinesischen KI-Labore an die Spitze des Open-Weight-Rankings verdrängt hat.

## MiMo-V2.6-Pro: Xiaomi an der Spitze des Open-Weight-Rankings

Am 21. September 2026 veröffentlichte Xiaomi auf Hugging Face MiMo-V2.6-Pro, ein spärliches Mixture-of-Experts-Modell mit 1,02 Billionen Gesamtparametern, von denen nur 42 Milliarden pro Token aktiv sind, unter einer reinen MIT-Lizenz — freie kommerzielle Nutzung, keine Schwellenwerte, keine versteckten Klauseln. Laut Artificial Analysis erreicht das Modell 46 Punkte im Intelligence Index, den höchsten Wert, den je ein Open-Weight-Modell erzielt hat: Es übertrifft sowohl GLM-5.3 von Z.ai als auch Kimi K3 von Moonshot, beide bei 44 Punkten, und belegt in der Gesamtwertung — inklusive geschlossener Modelle — Platz sechs. Am meisten überraschte die Beobachter der angegebene Trainingsaufwand — rund 3 Millionen Dollar —, deutlich niedriger als üblicherweise bei einem Modell dieser Größe angenommen, mit einem Preis-Leistungs-Verhältnis, das Artificial Analysis auf der Pareto-Grenze zwischen Intelligenz und Kosten pro Token einordnet. Parallel veröffentlichte Xiaomi auch MiMo-V2.6-Flash, eine günstigere Variante für höhere Volumina.

## GLM-5.3 Prime und Qwen3.8 Max Prime: zwei Starts ohne neue Gewichte

Am 23. September 2026 brachte Z.ai GLM-5.3 Prime auf den Markt, eine Hochgeschwindigkeitsvariante von GLM-5.3, die alle Fähigkeiten des Basismodells erbt, aber dank Inferenzbeschleunigung den 1,5- bis 2-fachen Durchsatz liefert, mit einem Kontext von bis zu 1 Million Token und permanent aktivem Reasoning — nicht abschaltbar, mit drei Anstrengungsstufen (niedrig, hoch, maximal, Letzteres als Standard). Es handelt sich nicht um einen neuen Checkpoint, sondern um ein API-Produkt, das mit 2,80 $ pro Million Input-Token und 8,80 $ pro Million Output-Token bepreist ist und auf Coding- und langfristige agentenbasierte Orchestrierung zielt.

Am selben Tag, nach der Ankündigung vom 22. September auf der Yunqi Conference in Hangzhou, aktivierte Alibaba Qwen3.8 Max Prime, eine schnellere Spur desselben Qwen3.8-Max — des spärlichen MoE-Modells mit 2,4 Billionen Parametern, das am 13. August als erstes Modell der "Max"-Klasse der Qwen-Familie unter Apache 2.0 als Open-Weight-Modell veröffentlicht wurde. Qwen3.8 Max Prime nutzt dieselben Gewichte, dasselbe 1-Millionen-Token-Kontextfenster und dieselben Werkzeuge wie das Basismodell: Es ändern sich nur Geschwindigkeit und Preis, der sich gegenüber der Standardversion etwa verdoppelt (4 $ statt 2 $ pro Million Input-Token, 12 $ statt 6 $ Output). Auch hier: keine neuen Gewichte zum Herunterladen.

## Die Lizenz von GLM-5.3 ist keine MIT-Lizenz: die Klausel, die bei hohem Umsatz zählt

Es lohnt sich, auf die Lizenz des Basismodells GLM-5.3 zurückzukommen (753 Milliarden Parameter, am 28. August auf Hugging Face veröffentlicht), denn dieser Fall zeigt erneut, wie riskant es ist, sich auf das Etikett zu verlassen. Z.ai verwendete weder MIT noch Apache 2.0, sondern ein maßgeschneidertes Dokument — die "GLM-5.3 License" —, das inhaltlich dieselben Rechte wie eine MIT-Lizenz gewährt (Nutzung, Kopieren, Ändern, Verbreiten, Unterlizenzierung, Verkauf, ausdrücklich einschließlich Gewichte, Parameter, Konfigurationsdateien sowie Trainings- und Inferenzcode), mit einer zusätzlichen Klausel, die den Unterschied macht: Model-as-a-Service-Betreiber oberhalb eines bestimmten Umsatzschwellenwerts müssen sich einer Sicherheitsprüfung unterziehen. Zwei Tage zuvor hatte dasselbe Labor hingegen GLM-5.3-Flash veröffentlicht — 320 Milliarden Gesamtparameter, 18 Milliarden aktiv, das erste nativ multimodale Modell (Text, Bild, Video) der GLM-5-Serie — unter einer reinen, unveränderten MIT-Lizenz, ohne diese Klausel. Gleiches Labor, gleiche Woche, zwei unterschiedliche Lizenzen für zwei Modelle derselben Familie.

## Was für Unternehmen zählt, die heute eine KI-Architektur bewerten

- Ein Name, der auf "Prime", "Turbo" oder "Speed" endet, bedeutet oft nur eine schnellere API-Spur, keinen neuen herunterladbaren Checkpoint: Prüfen Sie immer, ob tatsächlich ein Gewichte-Repository existiert, bevor Sie von einer offenen Veröffentlichung sprechen.
- Das Open-Weight-Ranking wechselt schnell den Besitzer — diese Woche führt es ein Unterhaltungselektronik-Hersteller an, nicht eines der bekannten KI-Labore: Binden Sie eine Architektur nicht an das Ranking eines einzigen Monats.
- Auch innerhalb derselben Modellfamilie können sich Lizenzen erheblich unterscheiden: Das GLM-5.3-Flaggschiff verlangt oberhalb eines Umsatzschwellenwerts eine Sicherheitsprüfung, GLM-5.3-Flash nicht. Lesen Sie jede einzelne Veröffentlichung, nicht nur das Familienetikett.
- Ein deutlich niedrigerer angegebener Trainingsaufwand, wie bei MiMo-V2.6-Pro, sagt nichts über die Qualität für Ihren konkreten Anwendungsfall aus: Prüfen Sie das immer mit einem echten Test, nicht mit dem Entwicklungsbudget des Anbieters.

Genau das ist die Arbeit, die wir jede Woche mit unseren Kunden leisten: eine echte Gewichte-Veröffentlichung von einer neuen API-Spur mit demselben Modellnamen zu unterscheiden, die genaue Lizenz jeder einzelnen Veröffentlichung zu lesen — nicht die der vorherigen — und eine Architektur zu bauen, in der das richtige Modell dort läuft, wo es laufen muss, während Ihre Daten Ihre bleiben, unabhängig davon, welches Labor das Modell trainiert hat oder welches Ranking es diese Woche anführt.

### Quellen

- [VentureBeat — "Better than DeepSeek": Xiaomi's MiMo-V2.6-Pro debuts as the top open weights model in the world](https://venturebeat.com/technology/better-than-deepseek-xiaomis-mimo-v2-6-pro-debuts-as-the-top-open-weights-model-in-the-world-alongside-cheaper-v2-6-flash)
- [Artificial Analysis — Modellseite MiMo-V2.6-Pro](https://artificialanalysis.ai/models/mimo-v2-6-pro)
- [Latent Space (AINews) — "Xiaomi MiMo-V2.6-Pro 1T-A42B: the new top Open Weights model, trained for $3M"](https://www.latent.space/p/ainews-xiaomi-mimo-v26-pro-1t-a42b)
- [OpenRouter — GLM 5.3 Prime, technische Daten und Preise](https://openrouter.ai/z-ai/glm-5.3-prime)
- [Digital Applied — "GLM-5.3's Weights Are Out. The Licence Is Not MIT"](https://www.digitalapplied.com/blog/glm-5-3-weights-bespoke-license-not-mit)
- [Hugging Face — zai-org/GLM-5.3-Flash, Text der MIT-Lizenz](https://huggingface.co/zai-org/GLM-5.3-Flash/blob/main/LICENSE)
- [OpenRouter — Qwen3.8 Max Prime, technische Daten und Preise](https://openrouter.ai/qwen/qwen3.8-max-prime)
- [Eigent — "Qwen3.8-Max: Alibaba's 2.4T Open-Weight Coding Model"](https://www.eigent.ai/blog/qwen3-8-max-open-weight-model)

***

- [alle Artikel](/de/markdown.md)
- [formatierte Version](/de/blog/mimo-v26-pro-glm-53-prime-qwen38-max-prime-settembre-2026)

© 2026 ai.malagoli.me · Daten gehostet in der Schweiz · CH ✓
[Datenschutzerklärung](/de/privacy) · [Cookie-Richtlinie](/de/cookie-policy)
