Limites de taxa do OpenRouter: seu nível gratuito depende do que você já pagou

Built for Speed: ~10ms Latency, Even Under Load
Blazingly fast way to build, track and deploy your models!
- Handles 350+ RPS on just 1 vCPU — no tuning needed
- Production-ready with full enterprise support
A solicitação 51 falha.
Você verifica a página do modelo e ela ainda diz que é gratuito. Você verifica seu saldo e há dinheiro nele. Você verifica a documentação e encontra um limite de 20 solicitações por minuto, valor que você nem chegou perto, já que estava fazendo talvez três.
O que você atingiu foi o limite diário. E o quão alto ele é depende de algo que nenhum outro gateway pensaria em usar como critério: quanto dinheiro você já deu ao OpenRouter. Com menos de 10 créditos comprados ao longo da vida útil da sua conta, os modelos gratuitos oferecem 50 solicitações por dia. Com 10 ou mais, você recebe 1.000. O upgrade é permanente, então você pode gastar tudo, voltar a um saldo zero e manter o teto mais alto.
Essa é a informação mais útil sobre os limites de taxa do OpenRouter, e não é a única surpresa. Passamos duas semanas testando a plataforma para uma avaliação de gateway. Aqui está o que descobrimos, incluindo algumas coisas que a documentação não menciona.
O que são os limites de taxa do OpenRouter?
Quatro mecanismos distintos podem rejeitar sua solicitação, e é fácil confundi-los.
O primeiro é o limite de modelos gratuitos: 20 por minuto, 50 ou 1.000 por dia, aplicado a qualquer ID de modelo que termine em :free. Esse é publicado e previsível. O segundo é a capacidade de qualquer provedor que esteja realmente atendendo à sua solicitação paga, o que o OpenRouter não publica e não pode controlar de fato. O terceiro é a proteção DDoS da Cloudflare, descrita em sua documentação apenas como o bloqueio de solicitações que excedem drasticamente o uso razoável, sem nenhum número associado. O quarto é qualquer limite de orçamento ou crédito que você mesmo configurou, o que não é um limite de taxa, mas rejeita o tráfego da mesma forma.
Apenas o primeiro deles é um limite de taxa no sentido que você quer dizer quando fala em limite de taxa. Os outros são a capacidade de terceiros, uma rede de segurança genérica e seu próprio controle financeiro.
Apenas o primeiro deles é um limite de taxa no sentido que você quer dizer quando fala em limite de taxa. Os outros são a capacidade de terceiros, uma rede de segurança genérica e seu próprio controle financeiro.

Figura 1: os cinco portões pelos quais uma solicitação passa e o código que cada um retorna.
O nível gratuito é baseado no seu histórico de pagamentos
O limite de 20 por minuto é fixo. Ele não muda com o status da sua conta, seu saldo ou seus gastos. Se você precisa de mais de 20 solicitações por minuto, os modelos gratuitos não são a solução e nenhuma quantia em dinheiro muda isso.
O limite diário é o que está vinculado ao histórico de pagamentos, e o limite é baseado nas compras vitalícias, e não no saldo atual. A compra mínima de crédito no OpenRouter é de US$ 5, então US$ 10 é um segundo passo deliberado, não o preço de entrada. Comprar em duas parcelas de US$ 5 leva ao mesmo resultado que uma compra de US$ 10, pelo que pudemos verificar.
blog-openrouter-rate-limits-2026-10-05.md 05/10/2026

Figura 2: o teto diário de modelos gratuitos em função das compras vitalícias de crédito.
O que torna isso estranho é a direção da causalidade. Seu teto de throughput não é uma função do seu plano ou do seu padrão de tráfego. É uma função de uma decisão de compra, o que significa que uma questão financeira agora responde a uma questão de disponibilidade. Em um projeto paralelo, tudo bem. Quando você tem usuários, você está a um atraso contábil de uma mudança na capacidade.
Há uma segunda armadilha por baixo disso: solicitações com falha ainda podem contar contra a franquia diária. Um loop de repetição martelando um modelo gratuito ocupado pode consumir suas 50 solicitações sem retornar uma única conclusão utilizável. Se você for tentar novamente, limite as tentativas.
Seus limites reais estão a uma chamada de API de distância
O painel não mostrará um contador de limites. O GET /api/v1/key mostrará, e ele retorna exatamente o que o OpenRouter está aplicando a essa chave neste momento.
TrueFoundry AI Gateway delivers ~3–4 ms latency, handles 350+ RPS on 1 vCPU, scales horizontally with ease, and is production-ready, while LiteLLM suffers from high latency, struggles beyond moderate RPS, lacks built-in scaling, and is best for light or prototype workloads.













.png)
.png)
.png)



.png)
.png)
.png)

.png)
.png)
.png)
.png)
.png)
.png)





