Solo CPU
shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaGPU de Nvidia
Instala el NVIDIA Container Toolkit.
Instalación con Apt
Configura el repositorio
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \ | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \ | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \ | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list sudo apt-get updateInstala los paquetes del NVIDIA Container Toolkit
shellsudo apt-get install -y nvidia-container-toolkit
Instalación con Yum o Dnf
Configura el repositorio
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \ | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repoInstala los paquetes del NVIDIA Container Toolkit
shellsudo yum install -y nvidia-container-toolkit
Configura Docker para usar el controlador de Nvidia
shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart dockerInicia el contenedor
shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaNota
Si estás ejecutando en un sistema NVIDIA JetPack, Ollama no puede detectar automáticamente la versión correcta de JetPack. Pasa la variable de entorno JETSON_JETPACK=5 o JETSON_JETPACK=6 al contenedor para seleccionar la versión 5 o 6.
GPU de AMD
Para ejecutar Ollama usando Docker con GPUs de AMD, usa la etiqueta rocm y el siguiente comando:
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocmSoporte de Vulkan
Vulkan está incluido en la imagen ollama/ollama y está habilitado de forma predeterminada cuando el contenedor puede acceder a los dispositivos de GPU.
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaUsa OLLAMA_VULKAN=0 para deshabilitar Vulkan, o GGML_VK_VISIBLE_DEVICES=<ids> para seleccionar dispositivos Vulkan específicos.
Ejecutar modelo localmente
Ahora puedes ejecutar un modelo:
shell
docker exec -it ollama ollama run llama3.2Probar modelos diferentes
Puedes encontrar más modelos en la biblioteca de Ollama.