Lokaler GPU-Stack
Diese Anleitung beschreibt das unterstützte Setup: Ollama läuft nativ auf dem Host mit direktem GPU-Zugriff,
Libre WebUI in Docker mit docker-compose.dev.external-ollama.yml.
Work-Verfügbarkeit
Work nutzt den eingebundenen Host-Docker-Socket und erstellt Aufgabencontainer auf demselben Daemon. Eine native
Libre-WebUI-Installation ist nicht nötig. Der Socket gewährt root-äquivalente Kontrolle; entferne ihn ohne Work und
setze unter Linux DOCKER_GID in .env.
Bei knappem Speicher kann Work ein Ollama-Cloud- oder Remote-Plugin verwenden. Das spart Modellspeicher, nicht aber Docker und Containerressourcen.
Enthalten
- Libre WebUI mit
librewebui/libre-webui:dev. - Natives Ollama für lokale Inferenz.
- Dauerhafte Datenvolumes.
- Dev-Image-Test ohne Ollama-Container.
Voraussetzungen
| Komponente | Voraussetzung |
|---|---|
| Docker | Docker Desktop/Engine mit Compose v2 |
| Ollama | Auf dem Host installiert und gestartet |
| GPU | Optional, für lokale Modelle empfohlen |
| NVIDIA | Aktueller Treiber und Toolkit bei containerisierten GPU-Workloads |
| Speicher | Genügend Platz für Ollama-Modelle |
Ollama installieren und prüfen
Linux:
curl -fsSL https://ollama.com/install.sh | sh
macOS:
brew install ollama
ollama serve
ollama pull gemma4:12b
curl http://localhost:11434/api/version
Libre WebUI starten
docker compose -f docker-compose.dev.external-ollama.yml up -d
Öffne http://localhost:8080.
Eigener Ollama-Endpunkt
OLLAMA_BASE_URL=http://192.168.1.100:11434 docker compose -f docker-compose.dev.external-ollama.yml up -d
Für Tailscale:
OLLAMA_BASE_URL=http://100.x.y.z:11434 docker compose -f docker-compose.dev.external-ollama.yml up -d
Empfohlene Modelle
ollama pull gemma4:12b
ollama pull qwen3.8:27b
ollama pull gemma4:26b
ollama pull nomic-embed-text
Entdecke größere Modelle im Modellmanager, sobald das Basissetup funktioniert.
LAN-Zugriff
Füge vor der Freigabe den LAN- oder Tailscale-Origin zu CORS_ORIGIN hinzu:
CORS_ORIGIN=http://localhost:8080,http://192.168.1.50:8080
docker compose -f docker-compose.dev.external-ollama.yml up -d
Nützliche Befehle
docker compose -f docker-compose.dev.external-ollama.yml ps
docker compose -f docker-compose.dev.external-ollama.yml logs -f libre-webui
docker compose -f docker-compose.dev.external-ollama.yml pull
docker compose -f docker-compose.dev.external-ollama.yml up -d
Fehlerbehebung
Container erreicht Ollama nicht
docker compose -f docker-compose.dev.external-ollama.yml exec libre-webui \
wget -O- http://host.docker.internal:11434/api/version
Unter Linux:
extra_hosts:
- 'host.docker.internal:host-gateway'
Modell läuft auf CPU — Prüfe natives Ollama, GPU-Treiber und ollama ps.
TTS benötigt — Nutze Qwen3-TTS, Kyutai TTS oder LongCat AudioDiT und aktiviere das Plugin.