← Blog

MiniMax M3: Das Open-Weight-Modell, das man wirklich selbst betreiben kann – mit Qwen3.8-27B-Update

Mads Kristiansen

CTO, Liviate

MiniMax M3: Das Open-Weight-Modell, das man wirklich selbst betreiben kann

Während Kimi K3 mehr als 64 Beschleuniger benötigt und die Gewichte von Qwen3.8-Max noch nicht verfügbar waren, stach ein Open-Weight-Modell als wirklich praxistauglich fürs Self-Hosting im August 2026 hervor. Doch die Landschaft hat sich seither verändert.

🆕 Update vom 9.8.: Qwen3.8-27B ist jetzt verfügbar!

Alibaba hat Qwen3.8-27B als Open Weights auf Hugging Face veröffentlicht. Das ist die "kleinere" Schwester von Qwen3.8-Max (2,4T), aber immer noch ein leistungsstarkes Modell, das auf deutlich bescheidenerer Hardware läuft.

Modell Status VRAM-Bedarf (INT4) Anwendungsfall
Qwen3.8-27B ✅ Jetzt verfügbar (HF) ~14 GB Kleine Teams/Enthusiasten – läuft auf 1-2× Consumer-GPU
MiniMax M3 ✅ Verfügbar, #1 bei BenchLM ~230 GB Enterprise-Teams mit GPU-Pool
Kimi K3 (2,8T) ✅ Verfügbar, mit Lizenz 64+ Beschleuniger Hyperscaler/Staaten
Qwen3.8-Max (2,4T) ⏳ Bald erwartet TBD (~500+ GB) Noch unbekannt

Wofür ist Qwen3.8-27B gut?

  • ✅ Codegenerierung und -verständnis
  • ✅ Mehrsprachige Aufgaben (Dänisch inklusive)
  • ✅ Mathematisches Reasoning
  • ✅ Agentic Workflows (Alibaba nennt "agentic workloads" explizit als Fokusbereich)

Mit nur rund 14 GB VRAM bei INT4-Quantisierung kann ein einzelnes Team oder sogar ein Enthusiast das Modell auf Consumer-Hardware (2× RTX 4090 24GB) oder ein paar gebrauchten A100/H100 betreiben. Das macht es zum perfekten "Sweet Spot" zwischen Leistung und praktischer Nutzbarkeit.

Während MiniMax M3 bei generellem Reasoning und langem Kontext (256K Token) glänzt, punktet Qwen3.8-27B besonders bei Coding, Mathematik und Agenten.


📊 Was ist MiniMax M3?

Eigenschaft Detail
Modelltyp MoE (Mixture of Experts) – Hybrid-Architektur
Gesamtparameter ~456B (geschätzt)
Aktiv pro Token ~45B (ca. 10 % der Gesamtgewichte)
Kontextfenster 256K Token
Lizenz Kommerzielle Nutzung erlaubt (kein OSI-Open-Source)

August 2026: MiniMax stand an der Spitze von BenchLMs August-Ranking als bestes Open-Weight-Modell – bestätigt von zwei unabhängigen Quellen mit einem Score von 68,8.


🧩 Wo passen sie hin?

Die Open-Weights-Bewegung ist erwachsen geworden – inzwischen gibt es Modelle für das gesamte Spektrum:

Willst du maximale Leistung UND hast Zugang zu einem Supernode? → Kimi K3 oder Qwen3.* wartet

Willst du starke Enterprise-Leistung bei vertretbaren Anforderungen? → MiniMax M3 ist bereit

Willst du etwas, das lokal läuft, ohne dass du dein Haus verkaufen musst? → Qwen*.*B ist gerade erschienen

Genau deshalb ergibt das Konzept des Managed Self-Hosting Sinn – nicht jeder soll oder will die Hardware selbst besitzen, aber jeder verdient Zugang zu den besten offenen Modellen unter verantwortungsvollen Bedingungen.

Wenn "offen" nicht ganz offen ist

Versteckte Lizenzbedingungen treffen die großen Cloud-Anbieter am härtesten – aber kleine Hosting-Provider in der EU können sie für dich umschiffen.

Das Trilemma in der EU

Chinesisches Modell? Teure Hardware? Oder eine minderwertige Lösung? Mit Liviate musst du dich nicht entscheiden – wir hosten die besten offenen Modelle auf europäischer Infrastruktur mit voller Compliance.

Alibaba vs. DeepSeek: Chinas Zwei-Fronten-Krieg um KI

Während Alibaba mit der Qwen-Familie breit aufgestellt ist, vom kleinen 27B bis zum riesigen Max, setzt DeepSeek mit der V4-Pro-Serie auf Effizienz und Reasoning.

Mistral Shieldstral: Sicherheitswächter für Bilder und Text

Mistral hat Shieldstral gelauncht – einen Sicherheitsfilter, der speziell für Open-Weight-Modelle in Enterprise-Umgebungen entwickelt wurde.

GPU-Hoarding

Vier Unternehmen horten Milliarden an Nvidia-GPU-Chips – Meta allein besitzt über 500.000 H100-Äquivalente.


Fazit

Die Open-Weights-Bewegung hat einen Reifegrad erreicht, bei dem die Diskussion nicht mehr darum geht, ob offene Modelle mit geschlossenen Frontier-Modellen mithalten können – die Antwort ist ja.

Die Frage ist jetzt: Wer kann sie in der Praxis tatsächlich verantwortungsvoll betreiben?

Der Weg nach vorn:

  • Modelle, die groß genug für ernsthafte Aufgaben sind
  • Modelle, die klein genug für den praktischen Einsatz sind
  • Ein kombinierter, neutraler Host, der Compliance, Isolation und Support sicherstellt – damit Kunden sich Investitionen in Millionenhöhe sparen

Freiheit + Kontrolle + Infrastruktur = Liviate.

Möchten Sie besprechen, was Ihre KI-Initiativen wirklich blockiert?

Mads Kristiansen führt gerne ein unverbindliches Gespräch.

Termin buchen →