Skip to content

Alleen CPU

shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Nvidia GPU

Installeer de NVIDIA Container Toolkit.

Installeren met Apt

  1. Configureer de repository

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \
        | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \
        | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \
        | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list
    sudo apt-get update
  2. Installeer de NVIDIA Container Toolkit-pakketten

    shell
    sudo apt-get install -y nvidia-container-toolkit

Installeren met Yum of Dnf

  1. Configureer de repository

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \
        | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repo
  2. Installeer de NVIDIA Container Toolkit-pakketten

    shell
    sudo yum install -y nvidia-container-toolkit

Configureer Docker om de Nvidia-stuurprogramma te gebruiken

shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart docker

Start de container

shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Opmerking

Als je op een NVIDIA JetPack-systeem werkt, kan Ollama de juiste JetPack-versie niet automatisch detecteren. Geef de omgevingsvariabele JETSON_JETPACK=5 of JETSON_JETPACK=6 door aan de container om versie 5 of 6 te selecteren.

AMD GPU

Om Ollama met Docker te gebruiken met AMD GPU's, gebruik de rocm tag en het volgende commando:

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocm

Vulkan-ondersteuning

Vulkan is standaard meegeleverd in de ollama/ollama image en is standaard ingeschakeld wanneer de container toegang heeft tot de GPU-apparaten.

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Gebruik OLLAMA_VULKAN=0 om Vulkan uit te schakelen, of GGML_VK_VISIBLE_DEVICES=<ids> om specifieke Vulkan-apparaten te selecteren.

Voer een model lokaal uit

Nu kun je een model uitvoeren:

shell
docker exec -it ollama ollama run llama3.2

Probeer verschillende modellen

Meer modellen vind je in de Ollama-bibliotheek.