machichdigital

Lokale LLMs · Foto: derekGavey, CC BY 2.0

ToolRunner-ToolsLizenz: AGPL-3.0 → nur Link

text-generation-webui (oobabooga)

Zuletzt aktualisiert:

⧉ –× kopiert⬇ –× heruntergeladenBewertung:

Typ

Tool

Lizenz

AGPL-3.0 → nur Link

Anwendungsfeld

Runner-Tools

Voraussetzungen

Keine besonderen — direkt loslegen.

Das „Schweizer Taschenmesser“ der LLM-Web-UIs: viele Backends (llama.cpp, Transformers, ExLlama), Charaktere, Erweiterungen, Trainings-/LoRA-Funktionen. Für Bastler, die alles einstellen wollen.

So nutzt du es

Tool über den verlinkten Anbieter installieren (Details und Systemvoraussetzungen im Repo). Diese Programme laden und betreiben lokale Modelle — sie sind der „Player“, das Modell ist die „Musik“.

Plattformen: macOS, Windows, Linux

Im Detail

text-generation-webui, besser bekannt unter dem Namen seines Entwicklers oobabooga, ist die Web-UI für Bastler: Sie unterstützt praktisch jedes gängige Backend (llama.cpp, Transformers, ExLlama, AutoGPTQ) unter einer Oberfläche, bringt Charakterprofile für Rollenspiel-Chats mit und erlaubt sogar eigenes Fine-Tuning bzw. LoRA-Training direkt aus der UI. Diese Fülle an Optionen ist zugleich Stärke und Schwäche: Wer eine schnelle, aufgeräumte Chat-Oberfläche will, ist mit Ollama plus Open WebUI oder LM Studio besser bedient. Wer dagegen genau steuern will, welches Quantisierungsformat, welcher Sampler und welche Erweiterung zum Einsatz kommt, findet hier die mit Abstand meisten Stellschrauben aller lokalen LLM-Oberflächen.

Praxis-Tipp

Für Rollenspiel-Chats ein Charakterprofil anlegen und den passenden Instruction-Template-Modus (z. B. Alpaca oder ChatML) zum geladenen Modell auswählen.

Siehe auch

Lizenz & Quelle

  • Lizenz: AGPL-3.0 → nur Link
  • Quelle: GitHub

Erfahrungen & Kommentare.

Funktioniert der Tool bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.

Lade Kommentare …

Ihre IP-Adresse wird zum Schutz vor Missbrauch gespeichert und nach 14 Tagen automatisch entfernt (Datenschutz).

Passt dazu.

Ollama

Der De-facto-Standard. Modelle mit einem Befehl laden und ausführen (ollama run llama3.1), integrierte Modell-Library, OpenAI-kompatible API auf Port 11434. Basis für unzählige andere Tools.

MIT♥ –⧉ –

LM Studio

Die komfortabelste Desktop-GUI: Modelle aus Hugging Face suchen, laden, chatten, Parameter per Regler, RAG per Drag-and-drop, lokaler OpenAI-API-Server. MLX-Support auf Apple Silicon.

Proprietär (App kostenlos, auch für Firmen; SDK/CLI: MIT)♥ –⧉ –

llama.cpp

Die Engine unter fast allem (Ollama, LM Studio, …): C/C++-Inferenz für GGUF-Modelle auf CPU und jeder GPU (CUDA, Metal, Vulkan, ROCm). Wer direkt damit arbeitet, bekommt maximale Kontrolle und die neuesten Features zuerst.

MIT♥ –⧉ –