Stable Diffusion localmente: instalação e modelos
Stable Diffusion é uma família de modelos de imagem com pesos abertos, não um aplicativo: você a executa em uma interface local. Para começar, use o SDXL (arquivo de 6,94 GB, 8 GB de VRAM para rodar com folga) no Fooocus, no ComfyUI Desktop ou, no Mac, no Draw Things. O SD 1.5 é adequado para placas de menor capacidade; o SD 3.5, anunciado em 22 de outubro de 2024, para placas de 12 GB ou mais. As famílias mais recentes, como Flux ou Z-Image, são usadas principalmente por meio do ComfyUI.
A Stability AI anunciou o lançamento público do Stable Diffusion em 22 de agosto de 2022: um modelo que transforma texto em imagem no seu próprio computador, sem conta nem limite de volume. Em 28 de setembro de 2026, o nome abrange três gerações de modelos, quatro ou cinco interfaces possíveis e licenças diferentes entre si. Este guia ajuda você a escolher uma versão e uma interface, a instalar tudo no Windows, no Mac ou no Linux e a saber o que você tem o direito de fazer com as imagens.
#O que é Stable Diffusion?
Stable Diffusion é um modelo de difusão latente. Ele parte de uma imagem de ruído puro e remove esse ruído passo a passo, guiado pelo seu texto, até surgir uma imagem coerente. O cálculo é feito em um espaço comprimido, chamado latente, o que explica por que uma placa de vídeo de uso comum é suficiente onde os primeiros modelos de difusão exigiam um centro de computação.
O que o tornou famoso não foi sua qualidade bruta, mas sua abertura. No lançamento de 2022, a Stability AI escolheu a licença CreativeML OpenRAIL-M, que descreve como "permissiva" e que permite usos comerciais e não comerciais: os pesos podem ser baixados, modificados e treinados novamente. Existem milhares de variantes especializadas. O Stable Diffusion não é um aplicativo: é um arquivo de modelo que você executa na interface de sua escolha.
O nome pode causar confusão terminológica. O repositório de referência do SD 1.5 no Hugging Face se apresenta hoje como um espelho do antigo repositório da RunwayML, descontinuado e sem vínculo com essa empresa. E, desde 2024, os modelos de imagem abertos mais discutidos vêm de outros laboratórios: Flux, Qwen Image ou Z-Image. Eles rodam nas mesmas interfaces, mas não levam o nome Stable Diffusion.
#Versões disponíveis e qual escolher
Imagens e vídeos de IA localmente, sem limites: ComfyUI, Flux, Z-Image, Wan 2.2 na sua GPU ou no seu Mac — workflows prontos para carregar, marco legal incluído.
- Espaço online vitalício
- PDF + arquivos
- Atualizações vitalícias
| Versão | Data de lançamento | Arquivo principal | Resolução nativa | VRAM com folga | Para lembrar |
|---|---|---|---|---|---|
| SD 1.5 | 2022 | 4,27 GB (v1-5-pruned-emaonly) | 512 × 512 | 4 a 6 GB | Leve, com uma enorme biblioteca de variantes e de LoRA. Os detalhes e as mãos ainda precisam melhorar. |
| SDXL 1.0 | julho de 2023 | 6,94 GB (sd_xl_base_1.0) | 1024 × 1024 | 8 GB: a Stability AI anuncia funcionamento correto em placas de 8 GB | Um bom ponto de partida: qualidade nitidamente superior, ecossistema maduro. |
| SD 3.5 | 22 de outubro de 2024 | Medium: 2,5 bilhões de parâmetros; Large: 8,1 bilhões; Large Turbo: versão em 4 passos | Medium: 0,25 a 2 megapixels; Large: 1 megapixel | Medium: 9,9 GB sem contar os codificadores de texto (Stability AI). Large: mais de 16 GB em 16 bits (nosso cálculo) | Maior aderência ao prompt. Licença diferente, veja abaixo. |
Dois detalhes evitam erros de compra ou de download. Primeiro, o SD 1.5 está disponível em dois arquivos: v1-5-pruned-emaonly.safetensors (4,27 GB), que a ficha do modelo descreve como usando menos VRAM e sendo adequado para inferência, e v1-5-pruned.safetensors (7,7 GB), destinado ao retreinamento. Para gerar imagens, escolha o primeiro. Depois, o SD 3.5 Large, com seus 8,1 bilhões de parâmetros, não deve ser avaliado com base na ficha do Medium: não conte com ele em uma placa de 8 GB.
Se você é iniciante e tem uma placa de 8 GB, comece com SDXL: é o melhor equilíbrio entre qualidade, velocidade e documentação disponível. Com 12 a 16 GB, veja também os modelos recentes do ComfyUI: seu README anuncia suporte nativo para Flux.1, Flux.2, Qwen Image e Z-Image.
#O equipamento necessário
| Seu hardware | O que funciona bem |
|---|---|
| Placa NVIDIA de 4 a 6 GB (GTX 1660, RTX 2060, RTX 3050) | SD 1.5. O Fooocus, que usa SDXL, informa um mínimo de 4 GB de VRAM e 8 GB de RAM, recorrendo à memória virtual do Windows: lento, mas possível. |
| Placa NVIDIA 8 GB (RTX 3060 Ti, RTX 4060, RTX 5060) | SDXL com conforto, limiar anunciado pela Stability AI |
| Placa NVIDIA de 12 a 16 GB (RTX 3060 12 GB, RTX 4070, RTX 5070 Ti) | SDXL com LoRA e ampliação, SD 3.5 Medium, Z-Image Turbo (16 GB segundo sua ficha), Flux em FP8 |
| Placa AMD recente (RX 7000, RX 9000) | Funciona bem no Linux com ROCm; no Windows, suporte oficial ao ROCm no ComfyUI Desktop desde janeiro de 2026 |
| Mac Apple Silicon | Qualquer chip M: a memória unificada funciona como VRAM. Mais lento que uma placa NVIDIA de categoria comparável. |
| Sem placa de vídeo | Tecnicamente possível, mas muito mais lento: reservar para testes |
Preveja também o espaço em disco. Um único arquivo SDXL pesa 6,94 GB, e as coleções de LoRA e variantes crescem rapidamente. O Fooocus recomenda ter pelo menos 40 GB livres em cada disco caso você encontre o erro « RuntimeError: CPUAllocator ».
#Qual interface instalar
| Interface | Para quem | Pontos fortes | Limites |
|---|---|---|---|
| Fooocus | Iniciantes | Um campo de texto, um botão, configurações padrão cuidadosamente definidas; menos de três cliques entre o download e a primeira imagem, segundo seu README | Apenas SDXL: o projeto tem suporte limitado de longo prazo, somente com correções de bugs |
| Forge (repositório de lllyasviel) | Usuários da interface com guias | Interface do AUTOMATIC1111, mais econômica em memória, com suporte ao Flux | Não há mais commits na branch principal desde junho de 2025; a continuidade se dá por meio de forks como Forge Neo |
| AUTOMATIC1111 | Quem segue tutoriais antigos | A interface tradicional, a mais documentada | Última versão publicada em fevereiro de 2025, Flux não suportado |
| ComfyUI | Usuários avançados e curiosos | Suporte nativo a modelos recentes, fluxos reprodutíveis, projeto muito ativo | Curva de aprendizado |
| Draw Things | Mac, iPhone, iPad | Aplicativo nativo, edição gratuita que calcula localmente e offline, treinamento de LoRA no dispositivo | Apenas no ecossistema Apple; há serviços pagos na nuvem como opção, que você deve evitar se quiser permanecer 100% local |
- Fooocus: instale e gere sua primeira imagem
- ComfyUI: instalação e primeiros passos
- AUTOMATIC1111: instalar o Stable Diffusion WebUI
- Panorama: gerar imagens localmente
#O caminho mais curto para cada sistema
- 01Windows com uma placa NVIDIAO mais rápido: Fooocus. Baixe o arquivo compactado da página oficial do projeto no GitHub, descompacte-o e execute run.bat. Na primeira execução, os modelos são baixados em Fooocus\models\checkpoints. Para uma ferramenta que acompanha os novos modelos, instale preferencialmente o ComfyUI Desktop, recomendado para novos usuários pelo README do ComfyUI.
- 02Placa RTX 50: verifique o PyTorchOs arquivos compactados tudo-em-um do Forge indicam CUDA 12.1 e PyTorch 2.3.1 como versões recomendadas. No entanto, as placas RTX 50 exigem uma versão recente do PyTorch: um colaborador do AUTOMATIC1111 menciona o PyTorch 2.7.0 como a primeira versão oficial a oferecer suporte a elas. Em uma RTX 50, prefira o ComfyUI, cuja documentação exige CUDA 13.0 para placas NVIDIA recentes.
- 03Mac Apple SiliconInstale Draw Things no App Store: a versão gratuita calcula localmente e offline, sem linha de comando. Não ative as opções de nuvem se quiser que nada saia do Mac. O ComfyUI Desktop também está disponível para macOS em Apple Silicon.
- 04Linux ou placa AMDInstalação manual do ComfyUI: clonagem do repositório, ambiente Python, PyTorch na versão CUDA ou ROCm conforme a placa. O procedimento detalhado está em nosso guia ComfyUI. O Fooocus também oferece instalação no Linux via Anaconda.
- 05Verificar se a GPU está sendo utilizadaDurante a geração, o comando nvidia-smi deve mostrar a VRAM ocupada e a utilização da GPU próxima de 100 %. Se a imagem levar vários minutos, a interface está rodando no processador: isso quase sempre se deve a uma versão inadequada do PyTorch.
#Onde encontrar os modelos e quais evitar
Duas fontes dominam. O Hugging Face hospeda os modelos oficiais dos laboratórios. O Civitai reúne as variantes comunitárias: modelos com ajuste fino, LoRA, estilos. Um LoRA é um pequeno arquivo que adiciona um estilo ou um assunto a um modelo base sem substituí-lo. Ele deve corresponder à família correta: um LoRA SDXL não funciona em SD 1.5.
#Escrever um prompt que funcione
- Descreva, não ordene
- Esses modelos não seguem instruções. “Retrato de uma mulher idosa, luz da janela, lente de 85 mm, pouca profundidade de campo” funciona; “faça uma foto bonita para mim” não.
- Escreva em inglês
- A ficha do SD 1.5 indica “Language(s): English” e um codificador de texto CLIP ViT-L/14 congelado. O francês é compreendido, mas com menos nuances.
- Assunto, depois cenário, depois estilo
- A ordem importa: o que vem primeiro tem mais peso.
- Prompt negativo
- Ele lista o que você não deseja ver. Útil principalmente em SD 1.5 e SDXL; verifique na ficha de um modelo recente se ele considera isso.
- Mantenha a semente
- Mesma semente, mesmos ajustes, mesma imagem. Para comparar dois prompts, fixe a semente e mude apenas uma coisa de cada vez.
#Licenças e uso comercial
| Modelo | Licença | Uso comercial de imagens |
|---|---|---|
| SD 1.5 | CreativeML OpenRAIL-M | Autorizado: a Stability AI descreve a licença como permissiva para usos comerciais e não comerciais, com restrições éticas de uso listadas na licença |
| SDXL 1.0 | CreativeML OpenRAIL++-M | Autorizado, mesmos princípios |
| SD 3.5 | Stability AI Community License | Gratuito para uso não comercial e para uso comercial até 1 milhão de dólares de faturamento anual; acima disso, entre em contato com a Stability AI para obter uma licença empresarial. Você mantém a propriedade das imagens geradas. |
A licença do modelo não resolve tudo. Os direitos autorais sobre uma imagem gerada e o uso da imagem de uma pessoa real são regidos pela legislação do seu país, não pela licença do software. Este guia descreve as licenças publicadas por seus autores e não constitui orientação jurídica.
- O kit Imagens IA: configurações por placa de vídeo e workflows prontos para usar
- Fonte: anúncio do Stable Diffusion 3.5 e sua licença
- Fonte: o anúncio do lançamento público de 2022
#FAQ
Stable Diffusion é gratuito?+
É possível usar Stable Diffusion sem placa de vídeo?+
Qual versão escolher entre SD 1.5, SDXL e SD 3.5?+
Minhas imagens permanecem privadas?+
Stable Diffusion ou Flux?+
É possível usar o Stable Diffusion no Mac?+
É possível vender as imagens geradas?+
Um comentário, um erro ou uma observação? Avise-nos; isso ajuda a melhorar o guia para todos.