machichdigital

Lokale LLMs · Foto: derekGavey, CC BY 2.0

ToolRunner-ToolsLizenz: MIT

LocalAI

Zuletzt aktualisiert:

⧉ –× kopiert⬇ –× heruntergeladenBewertung:

Typ

Tool

Lizenz

MIT

Anwendungsfeld

Runner-Tools

Voraussetzungen

Keine besonderen — direkt loslegen.

Selbstgehosteter OpenAI-API-Ersatz für den kompletten Stack: LLMs, Embeddings, Whisper, TTS, Bild-Generierung hinter einer API — Drop-in für Apps, die „OpenAI“ erwarten. Läuft auch ohne GPU.

So nutzt du es

Tool über den verlinkten Anbieter installieren (Details und Systemvoraussetzungen im Repo). Diese Programme laden und betreiben lokale Modelle — sie sind der „Player“, das Modell ist die „Musik“.

Plattformen: Docker, Linux, macOS, Windows

Im Detail

LocalAI bildet die OpenAI-API nach, deckt dabei aber weit mehr als Chat ab: Sprachmodelle, Embeddings, Spracherkennung (Whisper), Sprachausgabe (TTS) und Bildgenerierung laufen alle hinter derselben API. Das macht es zum Drop-in-Ersatz für Anwendungen, die fest auf „OpenAI“ programmiert sind – es genügt, die Basis-URL umzubiegen, ohne den Anwendungscode anzupassen. Anders als reine Chat-Tools deckt LocalAI damit ganze Produkt-Stacks ab, etwa eine App mit Chat, Transkription und Bildgenerierung aus einer Hand. Es läuft auch ganz ohne GPU, wird dann aber entsprechend langsamer. Wer nur chatten möchte, ist mit Ollama oder LM Studio einfacher bedient – LocalAI lohnt sich, sobald mehrere KI-Fähigkeiten gleichzeitig gebraucht werden.

Praxis-Tipp

Wenn Ihre bestehende App bereits die OpenAI-Bibliothek nutzt, reicht oft nur das Ändern der API-Basis-URL auf Ihre LocalAI-Instanz, um sie komplett lokal laufen zu lassen.

Siehe auch

Lizenz & Quelle

Erfahrungen & Kommentare.

Funktioniert der Tool bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.

Lade Kommentare …

Ihre IP-Adresse wird zum Schutz vor Missbrauch gespeichert und nach 14 Tagen automatisch entfernt (Datenschutz).

Passt dazu.

Ollama

Der De-facto-Standard. Modelle mit einem Befehl laden und ausführen (ollama run llama3.1), integrierte Modell-Library, OpenAI-kompatible API auf Port 11434. Basis für unzählige andere Tools.

MIT♥ –⧉ –

LM Studio

Die komfortabelste Desktop-GUI: Modelle aus Hugging Face suchen, laden, chatten, Parameter per Regler, RAG per Drag-and-drop, lokaler OpenAI-API-Server. MLX-Support auf Apple Silicon.

Proprietär (App kostenlos, auch für Firmen; SDK/CLI: MIT)♥ –⧉ –

llama.cpp

Die Engine unter fast allem (Ollama, LM Studio, …): C/C++-Inferenz für GGUF-Modelle auf CPU und jeder GPU (CUDA, Metal, Vulkan, ROCm). Wer direkt damit arbeitet, bekommt maximale Kontrolle und die neuesten Features zuerst.

MIT♥ –⧉ –