text-generation-webui (oobabooga)
Das „Schweizer Taschenmesser" der LLM-Web-UIs: viele Backends (llama.cpp, Transformers, ExLlama), Charaktere, Erweiterungen, Trainings-/LoRA-Funktionen. Für Bastler, die alles einstellen wollen.
Das „Schweizer Taschenmesser“ der LLM-Web-UIs: viele Backends (llama.cpp, Transformers, ExLlama), Charaktere, Erweiterungen, Trainings-/LoRA-Funktionen. Für Bastler, die alles einstellen wollen.
So nutzt du es
Tool über den verlinkten Anbieter installieren (Details und Systemvoraussetzungen im Repo). Diese Programme laden und betreiben lokale Modelle — sie sind der „Player“, das Modell ist die „Musik“.
Plattformen: macOS, Windows, Linux
Im Detail
text-generation-webui, auch „oobabooga“ genannt, ist die vielseitigste unter den lokalen LLM-Oberflächen: Es unterstützt mehrere Backends parallel (llama.cpp, Transformers, ExLlama u. a.), bringt Charakterprofile für Rollenspiele mit, ein Erweiterungssystem für zusätzliche Funktionen und sogar eigene Trainings- und LoRA-Funktionen zum Feintunen von Modellen. Im Vergleich zu schlankeren Tools wie Ollama oder LM Studio ist die Einrichtung komplexer und die Oberfläche technischer, dafür bietet nichts sonst so viele Stellschrauben an einem Ort. Geeignet ist es vor allem für Nutzer, die experimentieren, Modelle feintunen oder verschiedene Backends direkt vergleichen wollen – für den schnellen, unkomplizierten Einstieg sind andere Tools besser.
Praxis-Tipp
Für erste LoRA-Trainingsversuche den integrierten Training-Tab nutzen und mit einem kleinen 7B-Modell sowie einem überschaubaren eigenen Textkorpus starten, bevor man sich an größere Modelle wagt.
Siehe auch
Lizenz & Quelle
- Lizenz: AGPL-3.0 → nur Link
- Quelle: GitHub
Erfahrungen & Kommentare.
Funktioniert der Tool bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
Ollama
Der De-facto-Standard. Modelle mit einem Befehl laden und ausführen (ollama run llama3.1), integrierte Modell-Library, OpenAI-kompatible API auf Port 11434. Basis für unzählige andere Tools.
LM Studio
Die komfortabelste Desktop-GUI: Modelle aus Hugging Face suchen, laden, chatten, Parameter per Regler, RAG per Drag-and-drop, lokaler OpenAI-API-Server. MLX-Support auf Apple Silicon.
llama.cpp
Die Engine unter fast allem (Ollama, LM Studio, …): C/C++-Inferenz für GGUF-Modelle auf CPU und jeder GPU (CUDA, Metal, Vulkan, ROCm). Wer direkt damit arbeitet, bekommt maximale Kontrolle und die neuesten Features zuerst.
