machichdigital

Lokale LLMs · Foto: derekGavey, CC BY 2.0

ModellLokale LLM-ModelleLizenz: Gemma Terms of Use

Gemma 3 1B / Gemma 3n

Zuletzt aktualisiert:

⧉ –× kopiert⬇ –× heruntergeladenBewertung:

Typ

Modell

Lizenz

Gemma Terms of Use

Anwendungsfeld

Lokale LLM-Modelle

Voraussetzungen

  • Smartphone, Tablet oder anderes Edge-Gerät mit mindestens 2–4 GB freiem Arbeitsspeicher
  • Laufzeitumgebung/App zum lokalen Ausführen von Edge-Modellen auf dem Gerät
  • Grundkenntnisse im Einbinden lokaler KI-Modelle in eine App oder ein eingebettetes System

Einordnung

AufwandEinrichtung & Einarbeitung3/5 · mittelNutzenErtrag im Alltag3/5 · mittelVoraussetzungenWas vorher da sein muss3/5 · mittel1 = gering5 = hoch

Einbindung in eine Ziel-App braucht Aufwand, der Nutzen ist durch die bewusst geringe Modellqualität begrenzt.

Gemma 3n ist speziell für Smartphones/Tablets gebaut (Audio-, Bild- und Text-Eingabe bei minimalem Speicherbedarf) — Googles Edge-Speerspitze.

Größen & Hardware

  • Verfügbare Größen: 1B; 3n: E2B / E4B
  • Empfohlene Hardware (Q4): 2–4 GB

Im Detail

Gemma 3n ist Googles Antwort auf die Frage, wie ein leistungsfähiges Sprachmodell direkt auf Smartphones oder Tablets laufen kann. Die Varianten E2B und E4B nehmen nicht nur Text, sondern auch Audio und Bilder entgegen und kommen dabei mit sehr wenig Arbeitsspeicher (2–4 GB) aus – speziell für mobile Hardware entwickelt statt nur nachträglich verkleinert. Das reine 1B-Textmodell ist die noch schlankere Alternative für Fälle, in denen Multimodalität nicht gebraucht wird. Beide eignen sich für Offline-Assistenten auf Endgeräten, eingebettete Systeme oder Apps, die ohne Cloud-Anbindung auskommen müssen. Für Aufgaben mit hohem Qualitätsanspruch sind sie erwartungsgemäß den größeren Gemma-3- oder Qwen-Modellen unterlegen.

Schritt für Schritt

  1. Je nach Bedarf E2B/E4B (Audio, Bild und Text) oder das reine 1B-Textmodell wählen.
  2. Modell in die Ziel-App oder das eingebettete System für den Offline-Betrieb einbinden.
  3. Bei multimodalen Aufgaben E2B oder E4B testen, bei reinen Textaufgaben das schlankere 1B nutzen.
  4. Speicherverbrauch auf dem Zielgerät im Rahmen von 2–4 GB kontrollieren.
  5. Ergebnisqualität an einfachen, alltagsnahen Aufgaben prüfen statt an anspruchsvollen Fällen.

Beispiel aus der Praxis

Eine Notiz-App nutzt Gemma 3n E4B, um unterwegs ohne Internetverbindung ein Foto einer Tafel zu beschreiben und die zugehörige Sprachnotiz zu transkribieren.

Praxis-Tipp

Für mobile Apps mit Sprach- oder Bildeingabe direkt auf dem Gerät die E4B-Variante von Gemma 3n prüfen, bevor Sie ein größeres Cloud-Modell einplanen.

Stolperfallen

Die Modelle sind für minimalen Speicherbedarf auf mobiler Hardware optimiert, nicht für maximale Qualität — bei anspruchsvollen Aufgaben bleiben sie hinter größeren Gemma-3- oder Qwen-Modellen zurück. Wer Multimodalität gar nicht braucht, sollte das schlankere reine 1B-Textmodell statt E2B/E4B einsetzen.

Siehe auch

Lizenz & Quelle

  • Lizenz: Gemma Terms of Use
  • Quelle: Ollama
  • Quelle: HF

Häufige Fragen.

Läuft das Modell komplett offline?

Ja, genau dafür sind Gemma 3n und das 1B-Modell gebaut — sie eignen sich für Offline-Assistenten und Apps ohne Cloud-Anbindung.

Brauche ich für Bild- und Audioeingaben ein anderes Modell?

Nein, die 3n-Varianten E2B und E4B nehmen Audio, Bild und Text gemeinsam entgegen, ohne separates Modell.

Wie unterscheidet sich das 1B-Modell von 3n?

Das 1B-Modell verarbeitet nur Text und ist damit die noch schlankere Alternative, wenn Multimodalität nicht benötigt wird.

Erfahrungen & Kommentare.

Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.

Lade Kommentare …

Ihre IP-Adresse wird zum Schutz vor Missbrauch gespeichert und nach 14 Tagen automatisch entfernt (Datenschutz).

Passt dazu.

Llama 3.1

Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.

Llama 3.1 Community License♥ –⧉ –

Llama 3.3

Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.

Llama 3.3 Community License♥ –⧉ –

Llama 4 (Scout / Maverick)

Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.

Llama 4 Community License (EU-Einschränkungen für multimodale Nutzung beachten!)♥ –⧉ –