Lokale LLMs · Foto: derekGavey, CC BY 2.0
conversation_turn_limit_filter.py
Zuletzt aktualisiert:
Typ
Anleitung
Lizenz
MIT
Quelle
Anwendungsfeld
Ollama
Voraussetzungen
- Open WebUI mit Pipelines-Framework installiert
- Grundkenntnisse Python, um den Filter zu lesen und anzupassen
Einordnung
Als simpelstes Filter-Beispiel gering im Aufwand, aber auch begrenzt im praktischen Nutzen.
Begrenzt die Zahl der Gesprächsrunden pro Chat — simples, gut lesbares Filter-Beispiel.
Im Detail
Dieses Filter-Skript aus dem Open-WebUI-Pipelines-Framework greift in den Ein- und Ausgabefluss eines Chats ein und begrenzt, wie viele Gesprächsrunden ein Nutzer in einer Konversation führen darf. Es ist bewusst simpel gehalten und eignet sich deshalb hervorragend als Einstiegsbeispiel, um die Grundstruktur eines Filters zu verstehen: wo man sich einhakt, wie man den Verlauf ausliest und wie man regulierend eingreift. Praktisch relevant ist es für Szenarien mit begrenztem Budget pro Nutzer, Demo-Umgebungen oder Support-Bots, bei denen endlose Chat-Schleifen vermieden werden sollen. Wer eigene Filter bauen will, sollte hier anfangen, bevor er sich an komplexere Beispiele wie Übersetzungs- oder Vision-Filter wagt.
Schritt für Schritt
- Filter aktivieren und das Rundenlimit auf den gewünschten Wert für das eigene Szenario setzen.
- Ein Testgespräch über das gesetzte Limit hinaus führen und prüfen, ob die Begrenzung korrekt greift.
- Den Code als Vorlage nutzen, um die Grundstruktur eines Filters — Einhaken in Ein-/Ausgabe, Verlauf auslesen, regulierender Eingriff — zu verstehen.
- Nach diesem Verständnis bei Bedarf zu komplexeren Filtern wie Übersetzungs- oder Vision-Filtern übergehen.
- Bei Bedarf mit weiteren Filtern kombinieren, etwa einem Toxizitätsfilter.
Beispiel aus der Praxis
In einer Demo-Umgebung mit begrenztem Budget pro Nutzer wird das Rundenlimit fest eingestellt; überschreitet ein Nutzer diese Zahl an Gesprächsrunden, greift der Filter ein und begrenzt die Konversation.
Praxis-Tipp
Kopieren Sie dieses Skript als Ausgangspunkt für eigene Filter und passen Sie nur die Zähler-Logik an, z. B. für eine Token- oder Zeitgrenze statt einer Turn-Grenze.
Stolperfallen
Wird das Limit zu niedrig gesetzt, brechen legitime Gespräche vorzeitig ab; zu hoch gesetzt, verfehlt es seinen Zweck als Budget- oder Missbrauchsschutz — den Wert deshalb am tatsächlichen Nutzungsszenario ausrichten.
Siehe auch
Lizenz & Quelle
- Lizenz: MIT
- Quelle: open-webui/pipelines
Häufige Fragen.
Ist der Filter für den produktiven Einsatz gedacht?
Er ist bewusst simpel gehalten und dient vor allem als Einstiegsbeispiel, eignet sich aber auch direkt für einfache Budget- oder Demo-Szenarien.
Wie unterscheidet er sich von komplexeren Filtern wie dem Übersetzungs- oder Vision-Filter?
Er greift nur regulierend in die Rundenzahl ein, während andere Filter Inhalte auswerten oder verändern — er bildet die einfachste Grundstruktur.
Braucht man Programmierkenntnisse?
Für den reinen Einsatz nicht zwingend, zum Verständnis und Anpassen der Logik aber grundlegende Python-Kenntnisse.
Inhalt ansehen (conversation_turn_limit_filter.py)
Lade …
Erfahrungen & Kommentare.
Funktioniert der Anleitung bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
ollama_pipeline.py
Minimalbeispiel: Anfragen an einen Ollama-Server durchreichen — der beste Startpunkt, um das Pipeline-Prinzip zu verstehen.
ollama_manifold_pipeline.py
„Manifold": macht alle auf dem Ollama-Server installierten Modelle auf einmal verfügbar statt nur eines.
llama_cpp_pipeline.py
GGUF-Modelle direkt über die llama-cpp-python-Bibliothek fahren — ohne Ollama dazwischen.
