Erro no Carregador de Dados Padrão - apenas pdf-parse v1

Descreva o problema/erro/pergunta

Falha ao carregar pdf-parse. Este carregador atualmente suporta apenas pdf-parse v1. Instale a v1, por exemplo, npm install pdf-parse@^1 (v2 ainda não é suportada).
Falha ao carregar pdf-parse. Este carregador atualmente suporta apenas pdf-parse v1. Instale a v1, por exemplo, npm install pdf-parse@^1 (v2 ainda não é suportada).

Estou recebendo o erro acima ao usar o nó “Default Data Loader” para ler um documento PDF em um banco de dados vetorial simples. Sou um assinante do n8n usando sua solução baseada em navegador na nuvem. Portanto, não tenho controle sobre o ambiente de execução.

Qual é a mensagem de erro (se houver)?

Falha ao carregar pdf-parse. Este carregador atualmente suporta apenas pdf-parse v1. Instale a v1, por exemplo, npm install pdf-parse@^1 (v2 ainda não é suportada). Falha ao carregar pdf-parse. Este carregador atualmente suporta apenas pdf-parse v1. Instale a v1, por exemplo, npm install pdf-parse@^1 (v2 ainda não é suportada).

Compartilhe seu fluxo de trabalho

(Selecione os nós na sua tela e use os atalhos de teclado CMD+C/CTRL+C e CMD+V/CTRL+V para copiar e colar o fluxo de trabalho.)

Compartilhe a saída retornada pelo último nó

Informações sobre sua configuração do n8n

  • Versão do n8n:
  • Banco de dados (padrão: SQLite):
  • Configuração n8n EXECUTIONS_PROCESS (padrão: own, main):
  • Executando n8n via (Docker, npm, n8n cloud, desktop app):
  • Sistema operacional:

Este é um bug conhecido que foi introduzido recentemente em uma atualização da plataforma principal do n8n. Múltiplos usuários nos fóruns da comunidade do n8n e no GitHub relataram o mesmo conflito de dependência pdf-parse nas últimas semanas.

Alternativa ou solução alternativa:

  • Exclua ou desconecte a entrada binária de PDF do seu nó Default Data Loader atual.
  • Adicione um novo nó Extract From File imediatamente após sua fonte de PDF.
  • Defina a operação como “Read Text from File”.
  • No seu nó Default Data Loader, altere o Type of Data de Binary para JSON ou Text.
  • Mapeie a string de texto extraído do nó Extract From File para o loader.

Espero que ajude

Como você está usando o n8n cloud, não precisa se preocupar em instalar pacotes manualmente — a solução alternativa que @SE-automations descreveu (Extract From File → passar texto como JSON/Text para Default Data Loader) é seu melhor caminho por enquanto.

Mais uma coisa: recomendo abrir um ticket de suporte em https://support.n8n.io e mencionar essa incompatibilidade do pdf-parse v2. O n8n cloud é um ambiente gerenciado, então o time de engenharia pode rastrear e priorizar o corrigir na próxima versão cloud. Se reportar ajuda eles a saber quantos usuários são afetados.

@atawfic , Se você gostaria, o PDF API Hub fornece análise de PDF com suporte para PDF de texto ou digitalizado usando tesseract.

Aqui está o fluxo de trabalho:

Nó oficial aprovado pelo n8n:

Isso realmente resolveu meu problema. Obrigado pela resposta rápida.

A solução sugerida funcionou. Também reportei o problema para a equipe de suporte.

Obrigado!

A atualização deve resolver isso se você ainda estiver vendo um problema.

Bom dia. Como você está na n8n Cloud, é verdade que você não consegue instalar pacotes manualmente, então essa mensagem de erro é um pouco enganosa no seu caso. A boa notícia é que existe uma solução que não requer tocar no runtime.

Tente alternar o carregador de PDF dentro do nó:

No seu nó Default Data Loader, em vez de usar o carregador de PDF diretamente, tente esta abordagem:

  1. Antes do Default Data Loader, adicione um nó Read/Write Files from Disk (ou se você estiver recebendo o PDF via HTTP/webhook, certifique-se de que ele seja passado como dados binários)

  2. No Default Data Loader, verifique se você consegue alternar o “Data Type” para usar um carregador diferente — alguns usuários tiveram sucesso usando a opção “Binary” em vez do carregador de PDF dedicado, o que evita completamente a dependência do pdf-parse

Se isso não funcionar, outra possibilidade:

Rotearize seu PDF através de um nó HTTP Request ou do nó Extract from File primeiro para extrair o texto bruto, e então alimente esse texto simples no seu vector store usando o tipo de dados “Text” no carregador. É um passo extra, mas evita completamente o problema do pdf-parse.

Este é um ambiente n8n cloud, o runtime da nuvem deles parece ter adotado o pdf-parse v2, o que quebrou o nó. Vale a pena abrir um ticket de suporte diretamente com a n8n para que eles possam corrigir isso do lado deles, já que outros usuários da nuvem provavelmente estão enfrentando o mesmo problema.