machichdigital

Lokale LLMs · Foto: derekGavey, CC BY 2.0

ToolRunner-ToolsLizenz: AGPL-3.0 → nur Link

KoboldCpp

Zuletzt aktualisiert:

⧉ –× kopiert⬇ –× heruntergeladenBewertung:

Typ

Tool

Lizenz

AGPL-3.0 → nur Link

Anwendungsfeld

Runner-Tools

Voraussetzungen

Keine besonderen — direkt loslegen.

Einzel-Binary auf llama.cpp-Basis mit eigener Web-GUI; beliebt in der Rollenspiel-/Story-Community (Charaktere, Welten, lange Kontexte), kann auch Bilder (Stable Diffusion) und TTS.

So nutzt du es

Tool über den verlinkten Anbieter installieren (Details und Systemvoraussetzungen im Repo). Diese Programme laden und betreiben lokale Modelle — sie sind der „Player“, das Modell ist die „Musik“.

Plattformen: macOS, Windows, Linux

Im Detail

KoboldCpp ist im Kern ein llama.cpp-Server, der als einzelne, portable Binary daherkommt und eine eigene, auf lange Erzähltexte zugeschnittene Web-Oberfläche mitbringt. Die Community dahinter kommt vor allem aus dem Rollenspiel- und interaktiven Story-Bereich: Charakterkarten, persistente Welten und sehr lange Kontexte für ausufernde Geschichten sind Kernstärken. Zusätzlich zur reinen Textgenerierung kann KoboldCpp auch Bilder über Stable Diffusion erzeugen und Text vorlesen (TTS) – alles aus einer Anwendung heraus, ohne separate Tools. Wer nur nüchtern chatten oder RAG betreiben will, ist mit Ollama oder Open WebUI oft besser bedient; wer kreatives Schreiben, Charakter-Rollenspiel oder eine All-in-one-Lösung ohne Installation sucht, findet in KoboldCpp ein ausgereiftes Werkzeug.

Praxis-Tipp

Für längere Rollenspiel-Sessions ein Modell mit großem Kontextfenster laden und die integrierten Charakterkarten-Vorlagen nutzen, statt den Kontext manuell zu pflegen.

Siehe auch

Lizenz & Quelle

  • Lizenz: AGPL-3.0 → nur Link
  • Quelle: GitHub

Erfahrungen & Kommentare.

Funktioniert der Tool bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.

Lade Kommentare …

Ihre IP-Adresse wird zum Schutz vor Missbrauch gespeichert und nach 14 Tagen automatisch entfernt (Datenschutz).

Passt dazu.

Ollama

Der De-facto-Standard. Modelle mit einem Befehl laden und ausführen (ollama run llama3.1), integrierte Modell-Library, OpenAI-kompatible API auf Port 11434. Basis für unzählige andere Tools.

MIT♥ –⧉ –

LM Studio

Die komfortabelste Desktop-GUI: Modelle aus Hugging Face suchen, laden, chatten, Parameter per Regler, RAG per Drag-and-drop, lokaler OpenAI-API-Server. MLX-Support auf Apple Silicon.

Proprietär (App kostenlos, auch für Firmen; SDK/CLI: MIT)♥ –⧉ –

llama.cpp

Die Engine unter fast allem (Ollama, LM Studio, …): C/C++-Inferenz für GGUF-Modelle auf CPU und jeder GPU (CUDA, Metal, Vulkan, ROCm). Wer direkt damit arbeitet, bekommt maximale Kontrolle und die neuesten Features zuerst.

MIT♥ –⧉ –