CPU uniquement
shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaGPU Nvidia
Installez le NVIDIA Container Toolkit.
Installation avec Apt
Configurez le dépôt
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \ | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \ | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \ | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list sudo apt-get updateInstallez les paquets du NVIDIA Container Toolkit
shellsudo apt-get install -y nvidia-container-toolkit
Installation avec Yum ou Dnf
Configurez le dépôt
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \ | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repoInstallez les paquets du NVIDIA Container Toolkit
shellsudo yum install -y nvidia-container-toolkit
Configurez Docker pour utiliser le pilote Nvidia
shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart dockerDémarrez le conteneur
shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaNote
Si vous exécutez le conteneur sur un système NVIDIA JetPack, Ollama ne peut pas détecter automatiquement la version de JetPack correspondante. Passez la variable d'environnement JETSON_JETPACK=5 ou JETSON_JETPACK=6 au conteneur pour sélectionner la version 5 ou 6.
GPU AMD
Pour exécuter Ollama avec Docker sur des GPU AMD, utilisez le tag rocm et la commande suivante :
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocmPrise en charge de Vulkan
Vulkan est intégré à l'image ollama/ollama et est activé par défaut lorsque le conteneur peut accéder aux périphériques GPU.
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaUtilisez OLLAMA_VULKAN=0 pour désactiver Vulkan, ou GGML_VK_VISIBLE_DEVICES=<ids> pour sélectionner des périphériques Vulkan spécifiques.
Exécuter un modèle localement
Vous pouvez maintenant exécuter un modèle :
shell
docker exec -it ollama ollama run llama3.2Essayer d'autres modèles
Vous trouverez plus de modèles sur la bibliothèque Ollama.