Lokale LLMs · Foto: derekGavey, CC BY 2.0
Devstral 2
Typ
Modell
Lizenz
Modified MIT (siehe Model Card)
Quelle
Anwendungsfeld
Lokale LLM-Modelle
Entwickler, die einen Coding-Agenten mit europäischem Modell betreiben wollen.
Voraussetzungen
Keine besonderen — direkt loslegen.
Mistrals Coding-Modell der zweiten Generation (123 Mrd. Parameter, 256.000 Tokens Kontext) für agentisches Programmieren: liest Repos, plant Änderungen, führt Werkzeuge aus.
Für wen: Entwickler, die einen Coding-Agenten mit europäischem Modell betreiben wollen.
Installation
Mit Ollama: ollama pull devstral-2 (braucht sehr viel Speicher). Server: laut Model Card vLLM mit Tensor-Parallel 8, FP8 möglich. Bequem über die Mistral-API.
Erste Schritte
Devstral 2 ist für Agenten-Werkzeuge gebaut (z. B. OpenHands oder Mistrals eigenes Vibe-CLI): Aufgabe beschreiben, der Agent erkundet das Repo selbst und schlägt Änderungen vor. Vorher unbedingt in einem Git-Branch arbeiten.
Plattformen: Linux-Server mit GPUs (vLLM) · API
Lizenz & Quelle
Erfahrungen & Kommentare.
Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
Llama 3.1
Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.
Llama 3.3
Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.
Llama 4 (Scout / Maverick)
Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.
