MiniMax M3: Das Open-Weight-Modell, das man wirklich selbst betreiben kann
Während Kimi K3 mehr als 64 Beschleuniger benötigt und die Gewichte von Qwen3.8-Max noch nicht verfügbar waren, stach ein Open-Weight-Modell als wirklich praxistauglich fürs Self-Hosting im August 2026 hervor. Doch die Landschaft hat sich seither verändert.
🆕 Update vom 9.8.: Qwen3.8-27B ist jetzt verfügbar!
Alibaba hat Qwen3.8-27B als Open Weights auf Hugging Face veröffentlicht. Das ist die "kleinere" Schwester von Qwen3.8-Max (2,4T), aber immer noch ein leistungsstarkes Modell, das auf deutlich bescheidenerer Hardware läuft.
| Modell | Status | VRAM-Bedarf (INT4) | Anwendungsfall |
|---|---|---|---|
| Qwen3.8-27B | ✅ Jetzt verfügbar (HF) | ~14 GB | Kleine Teams/Enthusiasten – läuft auf 1-2× Consumer-GPU |
| MiniMax M3 | ✅ Verfügbar, #1 bei BenchLM | ~230 GB | Enterprise-Teams mit GPU-Pool |
| Kimi K3 (2,8T) | ✅ Verfügbar, mit Lizenz | 64+ Beschleuniger | Hyperscaler/Staaten |
| Qwen3.8-Max (2,4T) | ⏳ Bald erwartet | TBD (~500+ GB) | Noch unbekannt |
Wofür ist Qwen3.8-27B gut?
- ✅ Codegenerierung und -verständnis
- ✅ Mehrsprachige Aufgaben (Dänisch inklusive)
- ✅ Mathematisches Reasoning
- ✅ Agentic Workflows (Alibaba nennt "agentic workloads" explizit als Fokusbereich)
Mit nur rund 14 GB VRAM bei INT4-Quantisierung kann ein einzelnes Team oder sogar ein Enthusiast das Modell auf Consumer-Hardware (2× RTX 4090 24GB) oder ein paar gebrauchten A100/H100 betreiben. Das macht es zum perfekten "Sweet Spot" zwischen Leistung und praktischer Nutzbarkeit.
Während MiniMax M3 bei generellem Reasoning und langem Kontext (256K Token) glänzt, punktet Qwen3.8-27B besonders bei Coding, Mathematik und Agenten.
📊 Was ist MiniMax M3?
| Eigenschaft | Detail |
|---|---|
| Modelltyp | MoE (Mixture of Experts) – Hybrid-Architektur |
| Gesamtparameter | ~456B (geschätzt) |
| Aktiv pro Token | ~45B (ca. 10 % der Gesamtgewichte) |
| Kontextfenster | 256K Token |
| Lizenz | Kommerzielle Nutzung erlaubt (kein OSI-Open-Source) |
August 2026: MiniMax stand an der Spitze von BenchLMs August-Ranking als bestes Open-Weight-Modell – bestätigt von zwei unabhängigen Quellen mit einem Score von 68,8.
🧩 Wo passen sie hin?
Die Open-Weights-Bewegung ist erwachsen geworden – inzwischen gibt es Modelle für das gesamte Spektrum:
Willst du maximale Leistung UND hast Zugang zu einem Supernode? → Kimi K3 oder Qwen3.* wartet
Willst du starke Enterprise-Leistung bei vertretbaren Anforderungen? → MiniMax M3 ist bereit
Willst du etwas, das lokal läuft, ohne dass du dein Haus verkaufen musst? → Qwen*.*B ist gerade erschienen
Genau deshalb ergibt das Konzept des Managed Self-Hosting Sinn – nicht jeder soll oder will die Hardware selbst besitzen, aber jeder verdient Zugang zu den besten offenen Modellen unter verantwortungsvollen Bedingungen.
Wenn "offen" nicht ganz offen ist
Versteckte Lizenzbedingungen treffen die großen Cloud-Anbieter am härtesten – aber kleine Hosting-Provider in der EU können sie für dich umschiffen.
Das Trilemma in der EU
Chinesisches Modell? Teure Hardware? Oder eine minderwertige Lösung? Mit Liviate musst du dich nicht entscheiden – wir hosten die besten offenen Modelle auf europäischer Infrastruktur mit voller Compliance.
Alibaba vs. DeepSeek: Chinas Zwei-Fronten-Krieg um KI
Während Alibaba mit der Qwen-Familie breit aufgestellt ist, vom kleinen 27B bis zum riesigen Max, setzt DeepSeek mit der V4-Pro-Serie auf Effizienz und Reasoning.
Mistral Shieldstral: Sicherheitswächter für Bilder und Text
Mistral hat Shieldstral gelauncht – einen Sicherheitsfilter, der speziell für Open-Weight-Modelle in Enterprise-Umgebungen entwickelt wurde.
GPU-Hoarding
Vier Unternehmen horten Milliarden an Nvidia-GPU-Chips – Meta allein besitzt über 500.000 H100-Äquivalente.
Fazit
Die Open-Weights-Bewegung hat einen Reifegrad erreicht, bei dem die Diskussion nicht mehr darum geht, ob offene Modelle mit geschlossenen Frontier-Modellen mithalten können – die Antwort ist ja.
Die Frage ist jetzt: Wer kann sie in der Praxis tatsächlich verantwortungsvoll betreiben?
Der Weg nach vorn:
- Modelle, die groß genug für ernsthafte Aufgaben sind
- Modelle, die klein genug für den praktischen Einsatz sind
- Ein kombinierter, neutraler Host, der Compliance, Isolation und Support sicherstellt – damit Kunden sich Investitionen in Millionenhöhe sparen
Freiheit + Kontrolle + Infrastruktur = Liviate.