Skip to content

Apenas CPU

shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

GPU Nvidia

Instale o NVIDIA Container Toolkit.

Instalação com Apt

  1. Configure o repositório

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \
        | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \
        | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \
        | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list
    sudo apt-get update
  2. Instale os pacotes do NVIDIA Container Toolkit

    shell
    sudo apt-get install -y nvidia-container-toolkit

Instalação com Yum ou Dnf

  1. Configure o repositório

    shell
    curl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \
        | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repo
  2. Instale os pacotes do NVIDIA Container Toolkit

    shell
    sudo yum install -y nvidia-container-toolkit

Configure o Docker para usar o driver Nvidia

shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart docker

Inicie o contêiner

shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Nota

Se você estiver executando em um sistema NVIDIA JetPack, o Ollama não consegue detectar automaticamente a versão correta do JetPack. Passe a variável de ambiente JETSON_JETPACK=5 ou JETSON_JETPACK=6 para o contêiner para selecionar a versão 5 ou 6.

GPU AMD

Para executar o Ollama usando Docker com GPUs AMD, use a tag rocm e o seguinte comando:

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocm

Suporte a Vulkan

O Vulkan está incluído na imagem ollama/ollama e é habilitado por padrão quando o contêiner consegue acessar os dispositivos de GPU.

shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Use OLLAMA_VULKAN=0 para desativar o Vulkan, ou GGML_VK_VISIBLE_DEVICES=<ids> para selecionar dispositivos Vulkan específicos.

Execute um modelo localmente

Agora você pode executar um modelo:

shell
docker exec -it ollama ollama run llama3.2

Teste modelos diferentes

Mais modelos podem ser encontrados na biblioteca do Ollama.