Apenas CPU
shell
docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaGPU Nvidia
Instale o NVIDIA Container Toolkit.
Instalação com Apt
Configure o repositório
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey \ | sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg curl -fsSL https://nvidia.github.io/libnvidia-container/stable/deb/nvidia-container-toolkit.list \ | sed 's#deb https://#deb [signed-by=/usr/share/keyrings/nvidia-container-toolkit-keyring.gpg] https://#g' \ | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list sudo apt-get updateInstale os pacotes do NVIDIA Container Toolkit
shellsudo apt-get install -y nvidia-container-toolkit
Instalação com Yum ou Dnf
Configure o repositório
shellcurl -fsSL https://nvidia.github.io/libnvidia-container/stable/rpm/nvidia-container-toolkit.repo \ | sudo tee /etc/yum.repos.d/nvidia-container-toolkit.repoInstale os pacotes do NVIDIA Container Toolkit
shellsudo yum install -y nvidia-container-toolkit
Configure o Docker para usar o driver Nvidia
shell
sudo nvidia-ctk runtime configure --runtime=docker
sudo systemctl restart dockerInicie o contêiner
shell
docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaNota
Se você estiver executando em um sistema NVIDIA JetPack, o Ollama não consegue detectar automaticamente a versão correta do JetPack. Passe a variável de ambiente JETSON_JETPACK=5 ou JETSON_JETPACK=6 para o contêiner para selecionar a versão 5 ou 6.
GPU AMD
Para executar o Ollama usando Docker com GPUs AMD, use a tag rocm e o seguinte comando:
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama:rocmSuporte a Vulkan
O Vulkan está incluído na imagem ollama/ollama e é habilitado por padrão quando o contêiner consegue acessar os dispositivos de GPU.
shell
docker run -d --device /dev/kfd --device /dev/dri -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollamaUse OLLAMA_VULKAN=0 para desativar o Vulkan, ou GGML_VK_VISIBLE_DEVICES=<ids> para selecionar dispositivos Vulkan específicos.
Execute um modelo localmente
Agora você pode executar um modelo:
shell
docker exec -it ollama ollama run llama3.2Teste modelos diferentes
Mais modelos podem ser encontrados na biblioteca do Ollama.