Iniciante 4 minOllama

Instalar o Ollama no Linux

Linux é o sistema operacional nativo do Ollama: aquele em que ele funciona melhor, em que as atualizações são feitas de forma mais organizada e em que você tem mais controle. Este guia abrange Ubuntu/Debian/Fedora com systemd, a configuração de GPUs NVIDIA e AMD e como disponibilizar o servidor na sua LAN sem quebrar tudo.

Por Mohamed Meguedmi·Atualização 2026-03-25·Testado no Ubuntu 24.04

#Por que usar Linux para IA local?

Três razões práticas: os drivers de GPU (CUDA, ROCm) são mais estáveis no Linux do que no Windows, as ferramentas de linha de comando se integram naturalmente e os homelabs rodam no Linux por padrão. Use também o systemd para iniciar o Ollama com o sistema de forma organizada.

i
Distribuições testadas
Este guia foi validado em Ubuntu 22.04 e 24.04, Debian 12, Fedora 40. Os passos são iguais, com apenas diferenças no gerenciador de pacotes.

#Pré-requisitos

O kit IA Local

Seu ChatGPT privado e gratuito na sua máquina em 1 hora — LM Studio, Ollama, Open WebUI, seus documentos, sem nuvem.

  • Espaço online vitalício
  • PDF + arquivos
  • Atualizações vitalícias
Núcleo 5.10+
Qualquer distribuição razoável em 2026. uname -r para verificar.
curl ou wget
Para baixar o script de instalação.
sudo / root
A instalação grava arquivos em /usr/local/bin e cria um serviço systemd.
10 GB de disco
Os modelos estão localizados em /usr/share/ollama/.ollama/models por padrão.

#1. Instalação em uma linha

Terminal
curl -fsSL https://ollama.com/install.sh | sh

O script detecta sua distribuição, instala o binário em /usr/local/bin/ollama, cria um usuário de sistema ollama, implanta uma unidade do systemd e inicia o serviço. 30 segundos.

!
Curl | sh: verifique se necessário
Enviar um script diretamente ao sh por um pipe é prático, mas pouco transparente. Em contexto profissional, baixe-o primeiro (curl -o install.sh https://ollama.com/install.sh), revise-o e depois execute-o.
Verificação
ollama --version
systemctl status ollama

#2. Serviço systemd

O serviço é criado em /etc/systemd/system/ollama.service. Para personalizá-lo (por exemplo: mudar o diretório dos modelos, disponibilizá-lo na LAN):

Terminal
sudo systemctl edit ollama

Adicione as variáveis de ambiente úteis na seção [Service]:

Configuração de override do systemd
[Service]
Environment="OLLAMA_HOST=0.0.0.0:11434"
Environment="OLLAMA_MODELS=/mnt/ssd/ollama-models"
Environment="OLLAMA_KEEP_ALIVE=30m"
Environment="OLLAMA_MAX_LOADED_MODELS=2"
Aplicar
sudo systemctl daemon-reload
sudo systemctl restart ollama
sudo journalctl -u ollama -f  # logs live

#3. GPU NVIDIA

Ollama detecta CUDA automaticamente se os drivers estiverem instalados. Verificação:

Terminal
nvidia-smi
# Si la commande n'existe pas :
sudo apt install nvidia-driver-550  # Ubuntu
sudo dnf install akmod-nvidia       # Fedora
→
Container Toolkit (opcional)
Se você passar a executar o Ollama no Docker, instale o nvidia-container-toolkit para que a GPU fique acessível dentro do contêiner. Caso contrário, o Docker não terá acesso a ela.
Testar com um modelo
ollama run mistral "Bonjour"
# Dans un autre terminal :
ollama ps  # colonne PROCESSOR doit dire 100% GPU

#4. GPU AMD (ROCm)

As placas Radeon RX 6000, 7000 e Instinct são compatíveis via ROCm. A instalação é mais delicada do que com CUDA, mas funciona.

Ubuntu 22.04/24.04
wget https://repo.radeon.com/amdgpu-install/6.0/ubuntu/jammy/amdgpu-install_6.0.60000-1_all.deb
sudo apt install ./amdgpu-install_6.0.60000-1_all.deb
sudo amdgpu-install --usecase=rocm
sudo usermod -aG render,video $USER
# reboot
!
Placas sem suporte oficial
Se a sua GPU não estiver na lista oficial da AMD (ex.: RX 6600, 6700), use HSA_OVERRIDE_GFX_VERSION=10.3.0 como variável de ambiente. Isso força o ROCm a tratar a placa como uma gfx1030.

#5. Expor na rede local

Por padrão, o Ollama escuta apenas em localhost:11434. Para que outro computador ou um Raspberry Pi possa enviar consultas a ele:

No override do systemd
Environment="OLLAMA_HOST=0.0.0.0:11434"
Environment="OLLAMA_ORIGINS=http://192.168.1.*"
Firewall
sudo ufw allow from 192.168.1.0/24 to any port 11434
!
Nunca exponha à Internet
O Ollama não tem autenticação nativa. Se você quiser expô-lo além da rede local, coloque um proxy reverso (Caddy, nginx) com autenticação básica ou JWT na frente dele.

#Solução de problemas

systemctl status ollama → failed
Verificar journalctl -u ollama -n 50. Causas frequentes: porta 11434 já ocupada ou permissões no diretório models.
GPU não detectada
nvidia-smi e rocminfo devem responder. Caso contrário: drivers. Um reinício após a instalação é muitas vezes necessário.
Modelo lento, 100% CPU
ollama ps ne montre pas GPU. Drivers ok, mais variable CUDA_VISIBLE_DEVICES mal réglée ? Vérifiez environnement du service.
Espaço insuficiente
Mova OLLAMA_MODELS para um SSD maior. Não esquecer de executar chown -R ollama:ollama no novo diretório.
Este guia ajudou você?

Um comentário, um erro ou uma observação? Avise-nos; isso ajuda a melhorar o guia para todos.