Skip to content

Nur CPU

shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Nvidia-GPU

Installieren Sie das NVIDIA Container Toolkit.

Installation über Apt

  1. Repository konfigurieren

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \
        | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \
        | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \
        | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list
    sudo apt-get update
  2. Pakete des NVIDIA Container Toolkits installieren

    shell
    sudo apt-get install -y nvidia-container-toolkit

Installation über Yum oder Dnf

  1. Repository konfigurieren

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \
        | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repo
  2. Pakete des NVIDIA Container Toolkits installieren

    shell
    sudo yum install -y nvidia-container-toolkit

Docker zur Nutzung des Nvidia-Treibers konfigurieren

shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart docker

Container starten

shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Hinweis

Wenn Sie ein System mit NVIDIA JetPack verwenden, kann Ollama die korrekte JetPack-Version nicht automatisch erkennen. Übergeben Sie die Umgebungsvariable JETSON_JETPACK=5 oder JETSON_JETPACK=6 an den Container, um Version 5 bzw. 6 auszuwählen.

AMD-GPU

Um Ollama mit Docker auf AMD-GPUs auszuführen, verwenden Sie den Tag rocm und den folgenden Befehl:

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocm

Vulkan-Unterstützung

Vulkan ist im Image ollama/ollama enthalten und standardmäßig aktiviert, wenn der Container auf die GPU-Geräte zugreifen kann.

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Verwenden Sie OLLAMA_VULKAN=0, um Vulkan zu deaktivieren, oder GGML_VK_VISIBLE_DEVICES=<ids>, um bestimmte Vulkan-Geräte auszuwählen.

Modell lokal ausführen

Jetzt können Sie ein Modell ausführen:

shell
docker exec -it ollama ollama run llama3.2

Andere Modelle ausprobieren

Weitere Modelle finden Sie in der Ollama-Bibliothek.