Gemma 2
Googles Vorgänger-Generation, immer noch beliebt: 9B schreibt angenehm natürliche Texte, auch auf Deutsch.
Googles Vorgänger-Generation, immer noch beliebt: 9B schreibt angenehm natürliche Texte, auch auf Deutsch.
So nutzt du es
Am einfachsten per Ollama: ollama pull <modellname> und dann ollama run <modellname> — oder komfortabel mit LM Studio (grafische Oberfläche, Modell-Suche eingebaut). Die Hardware-Angaben unten beziehen sich auf die übliche 4-Bit-Quantisierung (Q4).
Größen & Hardware
- Verfügbare Größen: 2B / 9B / 27B
- Empfohlene Hardware (Q4): 9B: 8–12 GB · 27B: 24 GB
Im Detail
Gemma 2 ist die vorletzte Generation von Googles offenen Modellen, wird aber weiterhin gerne genutzt, weil vor allem die 9B-Variante ungewöhnlich natürliche, wenig “roboterhafte” Texte schreibt — auch im Deutschen macht sie im Vergleich zu ähnlich großen Modellen einen runden Eindruck. Es gibt sie in 2B, 9B und 27B, sodass für fast jede Hardware eine Variante passt: 9B läuft mit 8–12 GB VRAM auf einer normalen Consumer-GPU, 27B braucht 24 GB. Für reines Alltags-Chatten und deutschsprachige Texte ist Gemma 2 weiterhin eine solide, unaufgeregte Wahl, auch wenn es nicht mehr Googles neueste Generation ist.
Praxis-Tipp
Für natürlich klingende deutsche Texte (E-Mails, Zusammenfassungen) die 9B-Variante als Alternative zu Llama oder Mistral ausprobieren.
Siehe auch
Lizenz & Quelle
Erfahrungen & Kommentare.
Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
Llama 3.1
Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.
Llama 3.3
Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.
Llama 4 (Scout / Maverick)
Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.
