Solo CPU
shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaGPU Nvidia
Installa il NVIDIA Container Toolkit.
Installa con Apt
Configura il repository
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \ | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \ | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \ | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list sudo apt-get updateInstalla i pacchetti di NVIDIA Container Toolkit
shellsudo apt-get install -y nvidia-container-toolkit
Installa con Yum o Dnf
Configura il repository
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \ | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repoInstalla i pacchetti di NVIDIA Container Toolkit
shellsudo yum install -y nvidia-container-toolkit
Configura Docker per utilizzare il driver Nvidia
shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart dockerAvvia il container
shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaNota
Se stai eseguendo su un sistema NVIDIA JetPack, Ollama non riesce a individuare automaticamente la versione corretta di JetPack. Passa la variabile d'ambiente JETSON_JETPACK=5 o JETSON_JETPACK=6 al container per selezionare la versione 5 o 6.
GPU AMD
Per eseguire Ollama tramite Docker con GPU AMD, utilizza il tag rocm e il seguente comando:
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocmSupporto Vulkan
Vulkan è incluso nell'immagine ollama/ollama ed è abilitato per impostazione predefinita quando il container può accedere ai dispositivi GPU.
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaUtilizza OLLAMA_VULKAN=0 per disabilitare Vulkan, o GGML_VK_VISIBLE_DEVICES=<ids> per selezionare dispositivi Vulkan specifici.
Esegui un modello in locale
Ora puoi eseguire un modello:
shell
docker exec -it ollama ollama run llama3.2Prova modelli diversi
Puoi trovare altri modelli nella libreria di Ollama.