Hoppa till huvudinnehåll

Lokal GPU-stack

Den repository-stödda konfigurationen kör Ollama direkt på värden för GPU-åtkomst och Libre WebUI i Docker med docker-compose.dev.external-ollama.yml.

Work-tillgänglighet​

Ollama kör på värdens GPU. Work aktiveras genom den monterade Docker-socketen och skapar uppgiftsspecifika containrar på samma daemon. Ingen lokal Libre WebUI-installation krävs. Socketen ger root-likvärdig kontroll över Docker-värden; ta bort monteringen om Work inte behövs och ange DOCKER_GID i .env på Linux.

På minnesbegränsade datorer kan Work använda Ollama Cloud eller ett konfigurerat fjärrinsticksprogram. Det minskar lokal modellbelastning men Docker krävs fortfarande för arbetsyta och kommandon.

Detta ingår​

  • Libre WebUI med imagen librewebui/libre-webui:dev.
  • Ollama direkt på värden för lokal inferens.
  • Beständiga Libre WebUI-datavolymer.
  • En ren väg för att testa dev-imagen utan att containerisera Ollama.

Förutsättningar​

KomponentKrav
DockerDocker Desktop eller Docker Engine med Compose v2
OllamaInstallerad och körande på värden
GPUValfri men rekommenderad
NVIDIAAktuell drivrutin och NVIDIA Container Toolkit för GPU-containrar
DiskTillräckligt utrymme för Ollama-modeller

Installera och verifiera Ollama​

Linux:

curl -fsSL https://ollama.com/install.sh | sh

macOS:

brew install ollama
ollama serve

Hämta en startmodell:

ollama pull gemma4:12b

Verifiera API:t:

curl http://localhost:11434/api/version

Starta Libre WebUI​

Från repository-roten:

docker compose -f docker-compose.dev.external-ollama.yml up -d

Öppna http://localhost:8080.

Anpassad Ollama-endpoint​

Om Ollama finns på en annan dator:

OLLAMA_BASE_URL=http://192.168.1.100:11434 docker compose -f docker-compose.dev.external-ollama.yml up -d

För Tailscale:

OLLAMA_BASE_URL=http://100.x.y.z:11434 docker compose -f docker-compose.dev.external-ollama.yml up -d

Rekommenderade modeller​

ollama pull gemma4:12b
ollama pull qwen3.8:27b
ollama pull gemma4:26b
ollama pull nomic-embed-text

Använd Model Manager för större modeller när grunden fungerar.

LAN-åtkomst​

Lägg till LAN- eller Tailscale-ursprunget i CORS_ORIGIN före extern åtkomst:

CORS_ORIGIN=http://localhost:8080,http://192.168.1.50:8080

Starta om:

docker compose -f docker-compose.dev.external-ollama.yml up -d

Användbara kommandon​

docker compose -f docker-compose.dev.external-ollama.yml ps
docker compose -f docker-compose.dev.external-ollama.yml logs -f libre-webui
docker compose -f docker-compose.dev.external-ollama.yml pull
docker compose -f docker-compose.dev.external-ollama.yml up -d

Felsökning​

Containern når inte Ollama

docker compose -f docker-compose.dev.external-ollama.yml exec libre-webui \
wget -O- http://host.docker.internal:11434/api/version

På Linux, lägg till:

extra_hosts:
- 'host.docker.internal:host-gateway'

Modellen kör på CPU Kontrollera Ollama-installationen, GPU-drivrutinen och ollama ps.

Behöver TTS Följ serverguiden för Qwen3-TTS, Kyutai TTS eller LongCat AudioDiT och aktivera motsvarande insticksprogram.

Relaterade dokument​