Lokale LLMs · Foto: derekGavey, CC BY 2.0
Llama 3.2
Zuletzt aktualisiert:
Typ
Modell
Lizenz
Llama 3.2 Community License
Quelle
Anwendungsfeld
Lokale LLM-Modelle
Voraussetzungen
Keine besonderen — direkt loslegen.
Metas Edge-Modelle: das 3B ist ein guter Mini-Chat-Assistent, das 1B taugt für Zusammenfassungen und einfache Aufgaben auf sehr schwacher Hardware.
So nutzt du es
Am einfachsten per Ollama: ollama pull <modellname> und dann ollama run <modellname> — oder komfortabel mit LM Studio (grafische Oberfläche, Modell-Suche eingebaut). Die Hardware-Angaben unten beziehen sich auf die übliche 4-Bit-Quantisierung (Q4).
Größen & Hardware
- Verfügbare Größen: 1B / 3B
- Empfohlene Hardware (Q4): 1B: 2 GB · 3B: 4 GB
Im Detail
Llama 3.2 ist Metas Antwort auf den Bedarf an sehr kleinen, aber brauchbaren Modellen für Geräte mit wenig RAM oder ohne GPU. Das 3B-Modell eignet sich als einfacher Chat-Assistent für Alltagsaufgaben wie Textumformulierung oder kurze Antworten, während das 1B-Modell vor allem für Zusammenfassungen, Klassifikation und einfache Extraktionsaufgaben gedacht ist – dort, wo Geschwindigkeit wichtiger ist als Tiefe. Im Vergleich zu 7B-Modellen fehlt Kontextverständnis und Konsistenz bei komplexeren Aufgaben, dafür läuft es auf Raspberry-Pi-artiger Hardware oder älteren Laptops flüssig. Sinnvoll für Entwickler, die Offline-Funktionen in Apps mit sehr begrenztem Speicher einbauen wollen.
Praxis-Tipp
Für Zusammenfassungen auf schwacher Hardware das 1B-Modell testen, z. B. mit „Fasse folgenden Text in drei Sätzen zusammen: …“.
Siehe auch
Lizenz & Quelle
Erfahrungen & Kommentare.
Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
Llama 3.1
Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.
Llama 3.3
Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.
Llama 4 (Scout / Maverick)
Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.
