Локальний стек GPU
Посібник описує підтримувану репозиторієм конфігурацію: Ollama працює безпосередньо на хості з прямим доступом до GPU, а Libre WebUI — у Docker через docker-compose.dev.external-ollama.yml.
Доступність Work
Ollama безпосередньо використовує GPU хоста. Work умикається через підключений сокет Docker хоста, даючи Libre WebUI змогу створювати контейнери завдань у тому самому демоні. Безпосереднє встановлення Libre WebUI не потрібне.
Сокет надає контроль над Docker-хостом, еквівалентний root. Вилучіть підключення, якщо Work не потрібен, а в Linux задайте DOCKER_GID у .env.
На комп’ютерах із малим обсягом пам’яті Work може використовувати Ollama Cloud або налаштований віддалений плагін доповнень/чату. Це зменшує витрати пам’яті моделлю, але Docker залишається потрібним для простору й команд завдання.
Що ви отримуєте
- Libre WebUI на образі
librewebui/libre-webui:dev. - Ollama безпосередньо на хості для локального виведення.
- Постійні томи Libre WebUI.
- Простий спосіб перевіряти образ dev без контейнеризації Ollama.
Попередні вимоги
| Компонент | Вимога |
|---|---|
| Docker | Docker Desktop або Docker Engine із Compose v2 |
| Ollama | Установлена й працює на хості |
| GPU | Необов’язково, але рекомендовано |
| NVIDIA | Актуальний драйвер і NVIDIA Container Toolkit для контейнерів GPU |
| Диск | Достатньо місця для моделей Ollama |
Установлення й перевірка Ollama
Linux:
curl -fsSL https://ollama.com/install.sh | sh
macOS:
brew install ollama
ollama serve
Завантажте початкову модель:
ollama pull gemma4:12b
Перевірте API:
curl http://localhost:11434/api/version
Запуск Libre WebUI
Із кореня репозиторію:
docker compose -f docker-compose.dev.external-ollama.yml up -d
Відкрийте http://localhost:8080.
Власна кінцева точка Ollama
Якщо Ollama розташована на іншому комп’ютері:
OLLAMA_BASE_URL=http://192.168.1.100:11434 docker compose -f docker-compose.dev.external-ollama.yml up -d
Для Tailscale:
OLLAMA_BASE_URL=http://100.x.y.z:11434 docker compose -f docker-compose.dev.external-ollama.yml up -d
Рекомендовані моделі
Для першої робочої станції з GPU:
ollama pull gemma4:12b
ollama pull qwen3.8:27b
ollama pull gemma4:26b
ollama pull nomic-embed-text
Після запуску базового стека шукайте більші моделі в Model Manager.
Доступ із LAN
До відкриття програми іншому пристрою додайте джерело LAN або Tailscale до CORS_ORIGIN середовища Compose:
CORS_ORIGIN=http://localhost:8080,http://192.168.1.50:8080
Потім перезапустіть:
docker compose -f docker-compose.dev.external-ollama.yml up -d
Корисні команди
docker compose -f docker-compose.dev.external-ollama.yml ps
docker compose -f docker-compose.dev.external-ollama.yml logs -f libre-webui
docker compose -f docker-compose.dev.external-ollama.yml pull
docker compose -f docker-compose.dev.external-ollama.yml up -d
Усунення неполадок
Контейнер не бачить Ollama
docker compose -f docker-compose.dev.external-ollama.yml exec libre-webui \
wget -O- http://host.docker.internal:11434/api/version
У Linux додайте:
extra_hosts:
- 'host.docker.internal:host-gateway'
Модель працює на CPU
Ollama використовує встановлення хоста. Перевірте Ollama, драйвер GPU і ollama ps.
Потрібен TTS
Скористайтеся посібником сервера Qwen3-TTS, Kyutai TTS або LongCat AudioDiT, а потім увімкніть відповідний плагін у Settings.