Skip to content

Solo CPU

shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

GPU de Nvidia

Instala el NVIDIA Container Toolkit.

Instalación con Apt

  1. Configura el repositorio

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \
        | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \
        | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \
        | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list
    sudo apt-get update
  2. Instala los paquetes del NVIDIA Container Toolkit

    shell
    sudo apt-get install -y nvidia-container-toolkit

Instalación con Yum o Dnf

  1. Configura el repositorio

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \
        | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repo
  2. Instala los paquetes del NVIDIA Container Toolkit

    shell
    sudo yum install -y nvidia-container-toolkit

Configura Docker para usar el controlador de Nvidia

shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart docker

Inicia el contenedor

shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Nota

Si estás ejecutando en un sistema NVIDIA JetPack, Ollama no puede detectar automáticamente la versión correcta de JetPack. Pasa la variable de entorno JETSON_JETPACK=5 o JETSON_JETPACK=6 al contenedor para seleccionar la versión 5 o 6.

GPU de AMD

Para ejecutar Ollama usando Docker con GPUs de AMD, usa la etiqueta rocm y el siguiente comando:

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocm

Soporte de Vulkan

Vulkan está incluido en la imagen ollama/ollama y está habilitado de forma predeterminada cuando el contenedor puede acceder a los dispositivos de GPU.

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Usa OLLAMA_VULKAN=0 para deshabilitar Vulkan, o GGML_VK_VISIBLE_DEVICES=<ids> para seleccionar dispositivos Vulkan específicos.

Ejecutar modelo localmente

Ahora puedes ejecutar un modelo:

shell
docker exec -it ollama ollama run llama3.2

Probar modelos diferentes

Puedes encontrar más modelos en la biblioteca de Ollama.