OpenRouter: o que é, quanto custa e quanto à execução local ?
OpenRouter é um gateway de API que oferece acesso a centenas de modelos de IA (proprietários e com pesos abertos) por meio de uma única conta e de um formato compatível com OpenAI. Você paga conforme o uso com créditos pré-pagos, sem margem adicional sobre o preço dos tokens; a taxa é cobrada apenas na compra de créditos (5,5% no cartão, com mínimo de US$ 0,80, ou 5% em criptomoedas). Existem modelos “:free”, limitados a 50 requisições por dia sem créditos comprados e a 1.000 por dia quando a compra de créditos ultrapassa US$ 10.
O OpenRouter é um serviço online que oferece acesso a centenas de modelos de IA diferentes, proprietários e abertos, por meio de uma única API e uma única conta. Em vez de abrir uma conta em cada fornecedor, você compra créditos uma vez e escolhe o modelo em cada requisição. Em 20 de setembro de 2026, é o gateway mais amplamente utilizado por desenvolvedores e por ferramentas de código como Cline ou OpenCode. Esta página explica o que o serviço faz, quanto custa, por onde passam seus dados e em quais casos um modelo na sua própria máquina continua sendo a melhor escolha.
#O que é o OpenRouter?
OpenRouter é um gateway de API. A empresa, fundada em 2023, não treina modelos e, em geral, não os hospeda por conta própria: atua entre sua aplicação e os fornecedores, sejam laboratórios como OpenAI, Anthropic, Google ou Mistral, sejam provedores de hospedagem que disponibilizam modelos de pesos abertos como Qwen, Llama ou DeepSeek. A vantagem está no papel que desempenha: uma única conta, uma única chave, uma única fatura, independentemente do número de fornecedores efetivamente utilizados por trás.
Sua API segue o formato da OpenAI. Uma aplicação já escrita para a OpenAI funciona alterando duas linhas: o endereço base e a chave. O modelo é escolhido por um simples nome, no formato fornecedor/modelo, o que permite trocar de um para o outro sem alterar o restante do código.
O serviço é remunerado apenas com a compra de créditos, nunca com o preço exibido pelo fornecedor para cada modelo: sua documentação oficial indica que não cobra nenhuma margem sobre o preço da inferência em si. Essa é uma distinção importante em relação a outros gateways que adicionam uma margem invisível diretamente ao preço do token, tornando mais difícil a comparação com o fornecedor original.
#Como funciona
Seu ChatGPT privado e gratuito na sua máquina em 1 hora — LM Studio, Ollama, Open WebUI, seus documentos, sem nuvem.
- Espaço online vitalício
- PDF + arquivos
- Atualizações vitalícias
- Um catálogo único
- Cada modelo tem sua ficha: preço por milhão de tokens de entrada e saída, tamanho do contexto, fornecedores que o oferecem, taxa de geração e latência observadas. As variantes de roteamento (“:free”, “:batch”, entre outras) aparecem como entradas separadas, com seu próprio preço e seus próprios limites.
- Roteamento entre fornecedores
- Um mesmo modelo aberto costuma ser oferecido por vários provedores de hospedagem com preços e velocidades diferentes. O OpenRouter escolhe de acordo com suas preferências (preço, velocidade de geração, latência) e alterna para outro fornecedor se o primeiro estiver fora do ar, sem que seu código precise gerenciar essa lógica por conta própria.
- A alternância para modelos de fallback
- Você pode indicar uma lista de modelos de backup: se o primeiro estiver indisponível ou recusar a solicitação, o próximo assume automaticamente, sem intervenção manual nem interrupção visível na aplicação.
- Sua própria chave (BYOK)
- Se você já tem uma conta com um fornecedor, pode conectar sua chave e manter o OpenRouter como único ponto de entrada. Existe uma franquia mensal gratuita (25.000 dólares de custo de inferência a preço de tabela no modelo Pay-as-you-go, 200.000 dólares no Enterprise); além desse limite, aplica-se uma comissão de 5% do custo normal, descontada dos seus créditos OpenRouter.
#Quanto custa
O modelo de negócio é o pré-pagamento. Você compra créditos e cada requisição é debitada pela tarifa do fornecedor, sem margem sobre o preço do token, segundo a documentação oficial. O OpenRouter recebe uma comissão cobrada na compra dos créditos. Não há assinatura nem compromisso mensal a cancelar.
| Item | O que você precisa saber |
|---|---|
| Preço dos tokens | O do fornecedor, exibido exatamente na ficha do modelo, sem margem adicional conforme a documentação oficial. A saída geralmente custa várias vezes mais do que a entrada. |
| Comissão | 5,5% no pagamento com cartão (mínimo de US$ 0,80) ou 5% em criptomoeda, cobrados uma única vez na compra dos créditos. Nenhuma margem é adicionada ao preço exibido pelo fornecedor, segundo a documentação oficial. |
| Modelos gratuitos | Alguns modelos abertos existem em versão gratuita, identificável pelo sufixo «:free», que possui seu próprio preço (nulo), sua própria extensão de contexto e seus próprios pontos de acesso. Limite de 50 requisições/dia sem créditos comprados, 1.000/dia acima de 10 $ de créditos. |
| Reembolso | Os créditos não utilizados são reembolsáveis dentro de 24 horas após a compra, de acordo com a FAQ oficial. Após esse prazo, permanecem disponíveis, mas não são mais reembolsáveis. |
| Modelos de raciocínio | Os tokens de reflexão, invisíveis na tela, são cobrados como tokens de saída, pela mesma tarifa. A fatura pode ser várias vezes maior do que sugere apenas o tamanho da resposta exibida. |
- Estimar sua fatura de API de acordo com seu uso
- API LLM gratuitas: o verdadeiro comparativo, e a opção local
#Usá-lo em cinco minutos
- 01Criar uma conta e uma chaveNo openrouter.ai, crie uma chave de API e, se a interface o permitir, limite-a a um valor específico. Uma chave distinta por ferramenta facilita muito o acompanhamento do consumo.
- 02Adicionar créditosAlguns euros são suficientes para testar com tranquilidade. As variantes gratuitas funcionam sem créditos, com limite de 50 requisições por dia; acima de US$ 10 em créditos comprados na conta, esse limite passa para 1.000 requisições por dia.
- 03Apontar sua ferramenta para a APIEndereço base https://openrouter.ai/api/v1, sua chave e o nome exato do modelo. A maioria das ferramentas tem uma configuração «OpenAI compatible» ou uma opção integrada para selecionar diretamente o OpenRouter.
O nome exato de cada modelo está listado em sua ficha, no catálogo online. Para modelos abertos, geralmente é o mesmo identificador do Hugging Face, apenas em minúsculas.
#Para onde vão seus dados
É a pergunta a se fazer antes de conectar uma ferramenta profissional a esse serviço. Uma requisição passa por dois atores: OpenRouter, depois o fornecedor que executa o modelo. Cada um tem sua política, e as duas políticas devem ser verificadas separadamente antes de considerar que dados sensíveis possam passar por esse caminho.
A aba Activity do painel de controle permite consultar o histórico completo do uso por modelo e por requisição, o que ajuda a identificar uso anormal ou uma ferramenta mal configurada antes que a fatura surpreenda. É também o primeiro lugar a verificar em caso de desacordo sobre o valor cobrado, antes de entrar em contato com o suporte para reembolso ou esclarecimento.
- No OpenRouter
- O serviço informa que não conserva o conteúdo dos prompts por padrão; existe uma opção de registro de logs, a ser ativada voluntariamente para depuração. Os metadados (modelo, número de tokens, data e hora) são conservados para faturamento e podem ser consultados na aba Activity.
- Do lado do fornecedor
- As políticas variam: alguns provedores armazenam as requisições por um tempo, outros usam essas requisições para treinar seus próprios modelos. Cada ficha do fornecedor especifica isso, e uma configuração de conta permite excluir globalmente os que treinam com seus dados, em vez de verificar fornecedor a fornecedor.
- Aspectos jurídicos
- A maioria dos servidores fica fora da Europa. Para dados pessoais, dossiês de clientes ou código confidencial, verifique o que seu contrato e o RGPD permitem antes de enviar qualquer coisa, inclusive para um simples teste técnico pontual.
#OpenRouter ou um modelo local?
| Critério | OpenRouter | Modelo local |
|---|---|---|
| Configuração inicial | Cinco minutos, sem hardware | Uma instalação e uma placa gráfica ou um Mac adequado |
| Tamanho dos modelos | Tudo, incluindo modelos com centenas de bilhões de parâmetros | O que cabe na sua memória: até 30 bilhões em 24 GB, 120 bilhões em um Mac com 128 GB |
| Custo | Por uso, variável, sem limite natural | O hardware uma vez, depois a eletricidade |
| Privacidade | Seus dados passam por dois terceiros | Nada sai da máquina |
| Disponibilidade | Depende da rede e dos provedores | Funciona offline |
| Limites de taxa de transferência | Sim, principalmente nas versões gratuitas | Nenhum |
| Modelos proprietários | Sim | Não |
Muitos dos modelos abertos oferecidos no OpenRouter são exatamente os que você pode rodar em sua própria máquina. No catálogo QuelLLM, Qwen 3 14B pesa 9 GB em Q4, gpt-oss 20B 13 GB, Mistral Small 3.2 24B 14 GB: uma placa de 16 GB permite rodá-los sem cobrança nem limite. O OpenRouter torna-se relevante para aquilo que não cabe na sua máquina ou para um uso ocasional demais para justificar o investimento em hardware.
O cálculo econômico depende principalmente do volume. Para um uso ocasional de algumas requisições por semana, a comissão de 5,5% sobre uma pequena recarga de créditos continua sendo insignificante em valor absoluto. Para um uso intensivo — um agente de programação que roda o dia inteiro, um produto com milhares de usuários — o custo acumulado dos tokens cobrados por uso rapidamente supera o de uma placa de vídeo amortizada ao longo de vários anos, especialmente para modelos de tamanho modesto que o hardware pessoal executa sem dificuldade.
#Usar os dois juntos
A configuração mais racional combina os dois. Um modelo local cuida das tarefas do dia a dia e de tudo o que é confidencial; um gateway na nuvem assume o processamento, sob demanda, nas tarefas que exigem um modelo muito grande. Um proxy como o LiteLLM disponibiliza todo o conjunto por meio de um único endereço, com regras de roteamento e um orçamento.
Nessa configuração, a prática de usar BYOK descrita acima faz todo o sentido: em vez de pagar a comissão do OpenRouter por cada requisição enviada a um fornecedor que você já usa diretamente, você conecta sua própria chave e só paga a comissão BYOK ao ultrapassar a franquia mensal gratuita. O OpenRouter continua sendo o ponto de entrada único para o código, enquanto a maior parte do volume mantém a cobrança habitual diretamente pelo fornecedor.
- LiteLLM: um proxy unificado para uso local e na nuvem
- OpenCode + Ollama: um agente de código sem custo com API
- Documentação oficial do OpenRouter
- Fonte: Perguntas frequentes oficiais sobre custos e confidencialidade
- Fonte: detalhes dos custos BYOK e modelos gratuitos
#FAQ
O OpenRouter é gratuito?+
O OpenRouter é confiável e seguro?+
Qual a diferença entre OpenRouter e Ollama?+
O OpenRouter é mais caro do que ir diretamente ao fornecedor?+
É possível usar OpenRouter com Cline, OpenCode ou Open WebUI?+
O que é o BYOK (trazer sua própria chave) no OpenRouter?+
Um comentário, um erro ou uma observação? Avise-nos; isso ajuda a melhorar o guia para todos.