machichdigital
ToolRunner-ToolsLizenz: AGPL-3.0 → nur Link

Khoj

Selbstgehosteter KI-Assistent für die eigenen Notizen/Dokumente (Obsidian, Markdown, PDF, Notion): semantische Suche + Chat, auch mit lokalen Modellen als Backend.

× kopiert× heruntergeladenBewertung:

Selbstgehosteter KI-Assistent für die eigenen Notizen/Dokumente (Obsidian, Markdown, PDF, Notion): semantische Suche + Chat, auch mit lokalen Modellen als Backend.

So nutzt du es

Tool über den verlinkten Anbieter installieren (Details und Systemvoraussetzungen im Repo). Diese Programme laden und betreiben lokale Modelle — sie sind der „Player“, das Modell ist die „Musik“.

Plattformen: Docker, pip; Obsidian-/Emacs-Plugins, Web

Im Detail

Khoj indexiert die eigene Wissensbasis – Obsidian-Vaults, Markdown, PDFs, Notion – und macht sie per semantischer Suche und Chat durchsuchbar, wahlweise über Web-Oberfläche, Obsidian- oder Emacs-Plugin. Anders als ein allgemeiner RAG-Chat ist Khoj gezielt fürs „Chatten mit dem eigenen zweiten Gehirn“ gebaut und läuft komplett lokal, wenn man Ollama oder llama.cpp als Backend für Embeddings und Generierung wählt; Cloud-APIs sind optional. Sinnvoll für alle mit großen, gewachsenen Notizsammlungen, die Zusammenhänge über viele Dokumente hinweg wiederfinden wollen. Bei sehr großen Vaults braucht die Erstindexierung Zeit, und die Suchqualität hängt stark vom gewählten Embedding-Modell ab.

Praxis-Tipp

Obsidian-Vault per Plugin verbinden, Ollama als lokales Backend wählen, dann z. B. „Was habe ich letzten Monat über Projekt X notiert?“ fragen.

Siehe auch

Lizenz & Quelle

Erfahrungen & Kommentare.

Funktioniert der Tool bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.

Lade Kommentare …

Ihre IP-Adresse wird zum Schutz vor Missbrauch gespeichert und nach 14 Tagen automatisch entfernt (Datenschutz).

Passt dazu.

Ollama

Der De-facto-Standard. Modelle mit einem Befehl laden und ausführen (ollama run llama3.1), integrierte Modell-Library, OpenAI-kompatible API auf Port 11434. Basis für unzählige andere Tools.

MIT

LM Studio

Die komfortabelste Desktop-GUI: Modelle aus Hugging Face suchen, laden, chatten, Parameter per Regler, RAG per Drag-and-drop, lokaler OpenAI-API-Server. MLX-Support auf Apple Silicon.

Proprietär (App kostenlos, auch für Firmen; SDK/CLI: MIT)

llama.cpp

Die Engine unter fast allem (Ollama, LM Studio, …): C/C++-Inferenz für GGUF-Modelle auf CPU und jeder GPU (CUDA, Metal, Vulkan, ROCm). Wer direkt damit arbeitet, bekommt maximale Kontrolle und die neuesten Features zuerst.

MIT