Lokale LLMs · Foto: derekGavey, CC BY 2.0
ollama_pipeline.py
Zuletzt aktualisiert:
Typ
Anleitung
Lizenz
MIT
Quelle
Anwendungsfeld
Ollama
Voraussetzungen
Keine besonderen — direkt loslegen.
Minimalbeispiel: Anfragen an einen Ollama-Server durchreichen — der beste Startpunkt, um das Pipeline-Prinzip zu verstehen.
So nutzt du es
Anleitung lesen, Befehle ins Terminal kopieren. Ollama gibt es für macOS, Windows und Linux — Installation von ollama.com.
Im Detail
Das schlichteste Pipeline-Beispiel im Repertoire: Es reicht Chat-Anfragen aus Open WebUI unverändert an einen einzelnen Ollama-Server weiter und gibt die Antwort zurück. Genau diese Reduktion macht es wertvoll — wer verstehen will, wie das Pipeline-Prinzip von Open WebUI grundsätzlich funktioniert (Anfrage rein, Verarbeitung, Antwort raus), findet hier den kürzesten Weg zum Verständnis, ohne von Zusatzfunktionen wie Modell-Auswahl oder Filtern abgelenkt zu werden. Als Vorlage zum Abschauen und Erweitern eignet es sich besser als komplexere Pipelines. Für den produktiven Einsatz mit mehreren Modellen gleichzeitig ist die Manifold-Variante die praktischere Wahl.
Praxis-Tipp
Diese Datei zuerst lesen, bevor Sie eine eigene Pipeline schreiben — sie zeigt das Grundgerüst (Request entgegennehmen, an Ollama weiterreichen, Antwort zurückgeben) ohne Ballast.
Siehe auch
Lizenz & Quelle
- Lizenz: MIT
- Quelle: open-webui/pipelines
Inhalt ansehen (ollama_pipeline.py)
Lade …
Erfahrungen & Kommentare.
Funktioniert der Anleitung bei Ihnen? Tipps, Stolperfallen, Varianten — teilen Sie es mit der Community.
Lade Kommentare …
Passt dazu.
ollama_manifold_pipeline.py
„Manifold": macht alle auf dem Ollama-Server installierten Modelle auf einmal verfügbar statt nur eines.
llama_cpp_pipeline.py
GGUF-Modelle direkt über die llama-cpp-python-Bibliothek fahren — ohne Ollama dazwischen.
mlx_manifold_pipeline.py
Apple-Silicon-Spezialist: Modelle über Apples MLX-Framework serven (schnell auf M-Chips).
