Meu node openAI continua retornando 429 Too many requests

Meu fluxo de trabalho com IA funciona perfeitamente por um tempo e depois de repente começa a retornar

Descreva o problema/erro/pergunta

Qual é a mensagem de erro (se houver)?

Por favor, compartilhe seu

)

Gatilho de chat

Agente de IA

Abrindo modelo de chat


Compartilhe a saída retornada pelo último nó

Informações sobre sua configuração n8n

  • versão n8n:
  • Banco de dados (padrão: SQLite):
  • Configuração n8n EXECUTIONS_PROCESS (padrão: own, main):
  • Executando n8n via (Docker, npm, n8n cloud, aplicativo de desktop):
  • Sistema operacional:

Oi @Oluwabunmi_Miracle_A

Você provavelmente esbarrou em um limite de taxa ou ficou sem créditos.

Oi,

Esta mensagem: muitas requisições aparece quando você está sem plano, sua chave de API tem limitações e quando você usa mais do que o esperado isso aparece. Verifique a validação da sua chave de API.

“Funciona por um tempo, depois de repente 429” geralmente se resume a uma de duas coisas diferentes, e a solução é diferente para cada uma — vale 30 segundos para verificar qual é a sua:

1. Abra a execução falhada e leia o corpo do erro real.

  • Se disser algo como “Você excedeu sua cota atual” (insufficient_quota) → você ficou sem créditos / atingiu o limite do seu orçamento mensal. Nenhuma tentativa novamente vai ajudar; adicione créditos ou aumente o limite de orçamento em platform.openai.com.
  • Se disser “Rate limit reached for … requests per min” ou “tokens per min” → você está ultrapassando o RPM/TPM do seu tier. Este é o padrão clássico “funciona bem por um tempo, depois 429”, porque loops enviam muitas requisições em uma rajada rápida.

2. Se for o tipo de rate-limit, duas correções do lado do n8n geralmente resolvem:

  • No nó OpenAI, abra Settings → Retry On Fail, defina Max Tries 3–5 e Wait Between Tries ≥ 5000 ms. 429s são transitórios, então um backoff curto frequentemente atravessa a janela por minuto.
  • Se você está processando muitos itens em uma execução, coloque um nó Loop Over Items (Split in Batches) com um tamanho de lote pequeno e um nó Wait (10–20 s) dentro do loop, para que as requisições se espalhem em vez de serem disparadas de uma vez. TPM conta tokens, não apenas chamadas — prompts longos atingem o limite mais rápido, então reduzir o prompt ou max_tokens também ganha espaço.

Os limites reais de RPM/TPM da sua conta estão em platform.openai.com → Settings → Limits (novas contas começam em tiers baixos, e os limites aumentam com o histórico de uso).

Se você puder compartilhar o texto exato do erro do log de execução, ficará óbvio qual caso você tem.

Oi @Oluwabunmi_Miracle_A
Verifique qual credencial seu Chat Model do OpenAI está configurado. Se for o gratuito “100 créditos OpenAI” que o n8n oferece (aparece na sua lista de credenciais sem uma chave de API que você possa editar), é uma pequena cota compartilhada: o fluxo de trabalho funciona bem até ser consumida ou limitada, depois todas as chamadas retornam 429. Esse crédito fica fora de sua própria conta OpenAI, então não pode ser aumentado a partir do seu próprio faturamento do OpenAI.
Crie sua própria chave de API do OpenAI com faturamento ativo e selecione essa credencial no nó: