Tylko CPU
shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaGPU Nvidii
Zainstaluj NVIDIA Container Toolkit.
Instalacja za pomocą Apt
Skonfiguruj repozytorium
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \ | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \ | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \ | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list sudo apt-get updateZainstaluj pakiety NVIDIA Container Toolkit
shellsudo apt-get install -y nvidia-container-toolkit
Instalacja za pomocą Yum lub Dnf
Skonfiguruj repozytorium
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \ | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repoZainstaluj pakiety NVIDIA Container Toolkit
shellsudo yum install -y nvidia-container-toolkit
Skonfiguruj Dockera do użycia sterownika Nvidii
shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart dockerUruchom kontener
shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaUwaga
Jeśli korzystasz z systemu NVIDIA JetPack, Ollama nie może automatycznie wykryć poprawnej wersji JetPack. Przekaż zmienną środowiskową JETSON_JETPACK=5 lub JETSON_JETPACK=6 do kontenera, aby wybrać wersję 5 lub 6.
GPU AMD
Aby uruchomić Ollama za pomocą Dockera z GPU AMD, użyj tagu rocm i poniższego polecenia:
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocmObsługa Vulkan
Vulkan jest dołączony do obrazu ollama/ollama i jest domyślnie włączony, gdy kontener ma dostęp do urządzeń GPU.
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaUżyj OLLAMA_VULKAN=0, aby wyłączyć Vulkan, lub GGML_VK_VISIBLE_DEVICES=<ids>, aby wybrać konkretne urządzenia Vulkan.
Uruchom model lokalnie
Teraz możesz uruchomić model:
shell
docker exec -it ollama ollama run llama3.2Wypróbuj inne modele
Więcej modeli można znaleźć w Bibliotece Ollama.