machichdigital
ModellLokale LLM-ModelleLizenz: Apache-2.0

Pixtral

Mistrals freies Vision-Modell: verarbeitet Bilder in nativer Auflösung, mehrere Bilder pro Prompt, 128K Kontext.

× kopiert× heruntergeladenBewertung:

Mistrals freies Vision-Modell: verarbeitet Bilder in nativer Auflösung, mehrere Bilder pro Prompt, 128K Kontext.

So nutzt du es

Am einfachsten per Ollama: ollama pull <modellname> und dann ollama run <modellname> — oder komfortabel mit LM Studio (grafische Oberfläche, Modell-Suche eingebaut). Die Hardware-Angaben unten beziehen sich auf die übliche 4-Bit-Quantisierung (Q4).

Größen & Hardware

  • Verfügbare Größen: 12B
  • Empfohlene Hardware (Q4): 12–16 GB

Im Detail

Pixtral ist Mistrals offenes Vision-Sprachmodell: Es verarbeitet Bilder in nativer Auflösung statt sie klein zu skalieren, was Details besser erhält, und akzeptiert mehrere Bilder in einem Prompt für Vergleichs- oder Kontextaufgaben. Der 128K-Kontext erlaubt zusätzlich lange Textpassagen neben den Bildern. Mit 12B Parametern und 12–16 GB RAM-Bedarf ist es für viele Consumer-GPUs erreichbar. Im Vergleich zu ebenfalls multimodalen Modellen wie Llama 4 Scout/Maverick punktet Pixtral vor allem bei der Bildauflösungstreue und der freien Lizenz von Mistral – für OCR, Diagrammanalyse oder Bildbeschreibung auf eigener Hardware eine der besten frei verfügbaren Optionen.

Praxis-Tipp

Bei Diagrammen oder Screenshots mit viel Text im Bild profitiert Pixtral von der nativen Auflösung – nicht vorab herunterskalieren.

Siehe auch

Lizenz & Quelle

  • Lizenz: Apache-2.0
  • Quelle: HF

Erfahrungen & Kommentare.

Funktioniert der Modell bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.

Lade Kommentare …

Ihre IP-Adresse wird zum Schutz vor Missbrauch gespeichert und nach 14 Tagen automatisch entfernt (Datenschutz).

Passt dazu.

Llama 3.1

Der Meta-Klassiker mit 128K Kontext. 8B ist ein sehr solider Allrounder für schwächere Hardware, spricht ordentlich Deutsch.

Llama 3.1 Community License

Llama 3.3

Leistet laut Meta ungefähr so viel wie das riesige 405B-Modell — der Preis-Leistungs-Tipp, wenn man 64 GB (z. B. Mac Studio) hat.

Llama 3.3 Community License

Llama 4 (Scout / Maverick)

Metas MoE-Generation mit sehr großem Kontext und Bildverständnis. Für Heim-Hardware meist zu groß — eher für Server/Mac Studio 128 GB+.

Llama 4 Community License (EU-Einschränkungen für multimodale Nutzung beachten!)