Lokale LLMs · Foto: derekGavey, CC BY 2.0
llm_translate_filter_pipeline.py
Zuletzt aktualisiert:
Typ
Anleitung
Lizenz
MIT
Quelle
Anwendungsfeld
Ollama
Voraussetzungen
Keine besonderen — direkt loslegen.
Übersetzt Nutzer-Eingabe und Antwort per (lokalem) LLM — z. B. Deutsch fragen, englisch-starkes Modell nutzen, Deutsch antworten.
So nutzt du es
Anleitung lesen, Befehle ins Terminal kopieren. Ollama gibt es für macOS, Windows und Linux — Installation von ollama.com.
Im Detail
Dieser Filter schaltet sich zwischen Nutzereingabe und Sprachmodell: Ihre deutsche Frage wird per (lokalem) LLM ins Englische übersetzt, an ein englisch-optimiertes Modell geschickt und die Antwort anschließend zurück ins Deutsche übertragen. Das lohnt sich, wenn ein Modell in Englisch deutlich stärker ist als in Deutsch – etwa bei Fachfragen, Code-Erklärungen oder komplexem Reasoning – die Unterhaltung aber trotzdem auf Deutsch ablaufen soll. Der Nachteil: Jede Anfrage braucht zwei zusätzliche LLM-Durchläufe, was Antwortzeit kostet und bei schwacher Hardware spürbar ist. Für einsprachige Nutzung mit einem ohnehin guten deutschen Modell ist der Umweg unnötig; er zahlt sich vor allem bei sehr englischlastigen Spezialmodellen aus.
Praxis-Tipp
Setzen Sie den Filter ein, wenn Sie ein starkes englisches Reasoning-Modell nutzen wollen, aber Fragen wie „Erkläre mir Kubernetes Networking“ lieber auf Deutsch stellen und auch auf Deutsch beantwortet bekommen möchten.
Siehe auch
Lizenz & Quelle
- Lizenz: MIT
- Quelle: open-webui/pipelines
Inhalt ansehen (llm_translate_filter_pipeline.py)
Lade …
Erfahrungen & Kommentare.
Funktioniert der Anleitung bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
ollama_pipeline.py
Minimalbeispiel: Anfragen an einen Ollama-Server durchreichen — der beste Startpunkt, um das Pipeline-Prinzip zu verstehen.
ollama_manifold_pipeline.py
„Manifold": macht alle auf dem Ollama-Server installierten Modelle auf einmal verfügbar statt nur eines.
llama_cpp_pipeline.py
GGUF-Modelle direkt über die llama-cpp-python-Bibliothek fahren — ohne Ollama dazwischen.
