machichdigital

Lokale LLMs · Foto: derekGavey, CC BY 2.0

ModellLokale LLM-ModelleLizenz: Apache-2.0 (0.5–32B)

Qwen2.5-Coder

Zuletzt aktualisiert:

⧉ –× kopiert⬇ –× heruntergeladenBewertung:

Typ

Modell

Lizenz

Apache-2.0 (0.5–32B)

Anwendungsfeld

Lokale LLM-Modelle

Voraussetzungen

Keine besonderen — direkt loslegen.

Der Standard fürs lokale Coden. Das 32B spielt in der Liga proprietärer Modelle; 1.5B/3B eignen sich als flotte Autocomplete-Engine im Editor (z. B. mit Continue.dev).

So nutzt du es

Am einfachsten per Ollama: ollama pull <modellname> und dann ollama run <modellname> — oder komfortabel mit LM Studio (grafische Oberfläche, Modell-Suche eingebaut). Die Hardware-Angaben unten beziehen sich auf die übliche 4-Bit-Quantisierung (Q4).

Größen & Hardware

  • Verfügbare Größen: 0.5 / 1.5 / 3 / 7 / 14 / 32B
  • Empfohlene Hardware (Q4): 7B: 8 GB · 14B: 16 GB · 32B: 24–32 GB

Benutzungsanleitung

Der Standard-Tipp für lokales Programmieren — versteht viele Sprachen, ergänzt Code und erklärt Fehler.

Installation:

ollama run qwen2.5-coder

Varianten: qwen2.5-coder:7b (8 GB RAM), :14b (16 GB), :32b (32 GB+ — nahe Cloud-Niveau).

Wofür gut: Code-Vervollständigung, Fehlersuche, Refactoring, Erklärungen. In Editor-Werkzeugen wie Continue oder Aider als lokales Modell einbindbar — dann verlässt kein Code das Haus.

Kombi-Tipp: Zusammen mit Continue (VS Code) ergibt das einen komplett lokalen Copilot-Ersatz; beide stehen hier im Verzeichnis.

Im Detail

Qwen2.5-Coder hat sich als De-facto-Standard für lokales Programmieren etabliert. Das große 32B-Modell erreicht bei vielen Coding-Benchmarks ein Niveau, das mit proprietären Cloud-Modellen mithalten kann, und eignet sich für komplexe Refactorings oder das Verstehen größerer Codebasen. Die kleinen Varianten mit 1.5B oder 3B sind dagegen für den Live-Einsatz gedacht: Sie sind schnell genug, um als Autocomplete-Engine direkt im Editor zu laufen, etwa eingebunden über Continue.dev, und liefern trotzdem brauchbare Vorschläge. Mit 7B (8 GB) und 14B (16 GB) gibt es solide Mittelklasse-Optionen für alltägliche Programmieraufgaben auf normaler Consumer-Hardware. Wer lokal und ohne Cloud-Abo coden will, kommt an diesem Modell kaum vorbei.

Praxis-Tipp

Die 1.5B- oder 3B-Variante in Continue.dev als Autocomplete einbinden, für größere Refactoring-Aufgaben dann auf 14B oder 32B wechseln.

Siehe auch

Lizenz & Quelle

  • Lizenz: Apache-2.0 (0.5–32B)
  • Quelle: Ollama
  • Quelle: HF

Erfahrungen & Kommentare.

Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.

Lade Kommentare …

Ihre IP-Adresse wird zum Schutz vor Missbrauch gespeichert und nach 14 Tagen automatisch entfernt (Datenschutz).

Passt dazu.

Llama 3.1

Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.

Llama 3.1 Community License♥ –⧉ –

Llama 3.3

Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.

Llama 3.3 Community License♥ –⧉ –

Llama 4 (Scout / Maverick)

Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.

Llama 4 Community License (EU-Einschränkungen für multimodale Nutzung beachten!)♥ –⧉ –