Lokale LLMs · Foto: derekGavey, CC BY 2.0
Mixtral
Zuletzt aktualisiert:
Typ
Modell
Lizenz
Apache-2.0
Quelle
Anwendungsfeld
Lokale LLM-Modelle
Voraussetzungen
Keine besonderen — direkt loslegen.
Der MoE-Pionier von Ende 2023. Heute meist durch Qwen 3 MoE oder Mistral Small ersetzt, aber lizenzrechtlich völlig frei.
So nutzt du es
Am einfachsten per Ollama: ollama pull <modellname> und dann ollama run <modellname> — oder komfortabel mit LM Studio (grafische Oberfläche, Modell-Suche eingebaut). Die Hardware-Angaben unten beziehen sich auf die übliche 4-Bit-Quantisierung (Q4).
Größen & Hardware
- Verfügbare Größen: 8x7B / 8x22B (MoE)
- Empfohlene Hardware (Q4): 8x7B: ~32 GB
Im Detail
Mixtral war Ende 2023 einer der ersten frei verfügbaren Mixture-of-Experts-Ansätze und zeigte, dass man mit acht spezialisierten 7B- bzw. 22B-Experten-Netzwerken die Qualität großer Modelle bei geringerem Rechenaufwand pro Anfrage erreichen kann. Heute ist die Architektur technisch überholt: neuere MoE-Modelle wie Qwen 3 oder dichte Modelle wie Mistral Small liefern bei ähnlichem oder geringerem Speicherbedarf bessere Ergebnisse. Relevant bleibt Mixtral vor allem wegen seiner völlig freien Lizenz und als Referenzpunkt, wie MoE-Modelle grundsätzlich funktionieren. Für neue Projekte gibt es inzwischen fast immer die bessere Wahl.
Praxis-Tipp
Für neue Projekte lohnt sich eher ein Blick auf Qwen 3 oder Mistral Small — Mixtral eignet sich noch, wenn Sie MoE-Architekturen studieren oder aus Lizenzgründen ein älteres, vollständig offenes Modell brauchen.
Siehe auch
Lizenz & Quelle
Erfahrungen & Kommentare.
Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
Llama 3.1
Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.
Llama 3.3
Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.
Llama 4 (Scout / Maverick)
Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.
