Llama 4 (Scout / Maverick)
Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.
Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.
So nutzt du es
Am einfachsten per Ollama: ollama pull <modellname> und dann ollama run <modellname> — oder komfortabel mit LM Studio (grafische Oberfläche, Modell-Suche eingebaut). Die Hardware-Angaben unten beziehen sich auf die übliche 4-Bit-Quantisierung (Q4).
Größen & Hardware
- Verfügbare Größen: Scout 109B MoE (17B aktiv) / Maverick ~400B MoE
- Empfohlene Hardware (Q4): Scout: ab ~64–96 GB, eher Workstation
Im Detail
Metas vierte Llama-Generation setzt auf Mixture-of-Experts: Scout hat 109 Milliarden Parameter, von denen pro Anfrage nur 17 Milliarden aktiv sind, Maverick bringt es auf rund 400 Milliarden. Beide verstehen neben Text auch Bilder und bieten ein sehr großes Kontextfenster für lange Dokumente. Der Haken: Selbst das kleinere Scout braucht mindestens 64–96 GB RAM/VRAM, lohnt sich also erst auf Workstations oder einem gut ausgestatteten Mac Studio – für normale Heim-PCs sind Llama 3.3 oder Qwen 3 die realistischere Wahl. Wer die Hardware hat, bekommt dafür ein vielseitiges Allround-Modell für Chat, Assistenz und Bildanalyse in einem.
Praxis-Tipp
Nur einsetzen, wenn genug RAM/VRAM vorhanden ist (Mac Studio 128 GB+ oder Server-GPU) – sonst erst mit ollama run llama3.3 oder qwen3 starten und bei Bedarf später wechseln.
Siehe auch
Lizenz & Quelle
Erfahrungen & Kommentare.
Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
Llama 3.1
Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.
Llama 3.3
Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.
Qwen 2.5
Alibabas Arbeitspferd: stark in vielen Sprachen (auch Deutsch), Mathe und strukturierten Ausgaben (JSON). Die Apache-Größen sind auch kommerziell völlig frei.
