@Rahul_Parmar regressão conhecida desde n8n 1.98 quando pdfjs-dist foi atualizado para uma versão que precisa de APIs do navegador como DOMMatrix — múltiplas issues abertas no github sobre isso (#16593, #16438, #16422). workaround que funciona na 2.23.0 sem fazer downgrade: contorna Document Loader para PDFs e usa um nó Code com o pacote npm pdf-parse. define NODE_FUNCTION_ALLOW_EXTERNAL=pdf-parse nas suas variáveis de ambiente, extrai o texto no nó Code, passa o texto extraído diretamente para Vector Store Insert. o resto do seu workflow está fortemente atrelado ao Document Loader especificamente, ou está apenas usando-o para extração de texto de PDF?
Eu estava usando anteriormente a versão 2.21.7, mas atualizei por causa do problema com pdf-parse v1.1 relatado em “Erro no Carregador de Dados Padrão do Node”, que parece ter sido corrigido na versão 2.23.0.
Contudo, após a atualização, agora estou recebendo o erro DOMMatrix is not defined especificamente durante a ingestão de PDF no nó Document Loader.
@Rahul_Parmar
não encontrei falha no seu código, talvez seja compatibilidade de ambiente.
mude o typeversion para 1.0, Isso força o loader a usar pdf-parse em vez de pdfjs-dist , eliminando a dependência de DOM ou adicione um nó Code como polyfill antes do loader.
Tenho o mesmo problema relatado acima (DOMMatrix não está definida). Conforme sugerido, reverti o Data Loader para typeversion 1.0, adicionei um Recursive Character Text Splitter ao nó, mas ainda estou recebendo o erro (DOMMatrix não está definida).
(Tenho n8n auto-hospedado e estou usando a versão 2.23.1, pois como a pessoa que postou o problema original, eu também estava recebendo o erro pdf-parse v1.1 relatado em “Error in Node Default Data Loader”.
oi @atdev150 , bem vindo à comunidade n8n.
cada caso é um caso, necessário avaliar seu json. por favor abra uma pergunta para que a comundiade possa te apoiar diretamente ou verifique se a minha resposta anterior também te ajuda.
Eu só queria saber em qual versão do n8n você testou isso. Além disso, você usou o mesmo workflow de Document Ingestion? Você conseguiu fazer upload e processar um PDF com sucesso usando-o?
Enquanto aguarda a correção oficial, uma solução alternativa funcional em self-hosted é substituir o nó Document Loader por um nó Code que usa pdf-parse em vez disso. Se você adicionar NODE_FUNCTION_ALLOW_EXTERNAL=pdf-parse às variáveis de ambiente do n8n e instalar o pacote no contêiner, poderá analisar o PDF binário diretamente sem a dependência DOMMatrix:
Olá, na minha opinião, o problema com a versão 2.23.4 foi definitivamente resolvido. Muito obrigado a todos que acompanharam o assunto com empenho! Cumprimentos, Thomas
De fato, o problema ainda não foi resolvido. O erro «DOM Matrix is not defined» reaparece na versão 2.25.7. Na versão 2.23.4, o fluxo de trabalho funciona perfeitamente. Também na versão «não oficial» 2.26.0, o fluxo de trabalho funciona perfeitamente.