@Rahul_Parmar regresión conocida desde n8n 1.98 cuando pdfjs-dist se actualizó a una versión que requiere APIs del navegador como DOMMatrix — hay múltiples issues abiertos en github al respecto (#16593, #16438, #16422). workaround que funciona en 2.23.0 sin hacer downgrade: omite Document Loader para PDFs y usa un nodo Code con el paquete npm pdf-parse en su lugar. establece NODE_FUNCTION_ALLOW_EXTERNAL=pdf-parse en tus variables de entorno, extrae el texto en el nodo Code, pasa el texto extraído directamente a Vector Store Insert. ¿el resto de tu workflow está muy vinculado específicamente a Document Loader, o solo lo usas para la extracción de texto de PDFs?
Anteriormente estaba usando 2.21.7, pero actualicé debido al problema de pdf-parse v1.1 reportado en “Error in Node Default Data Loader”, que parece haber sido solucionado en 2.23.0.
Sin embargo, después de actualizar, ahora estoy obteniendo el error DOMMatrix is not defined específicamente durante la ingesta de PDF en el nodo Document Loader.
@Rahul_Parmar
no encontré ningún fallo en tu código, probablemente sea un problema de compatibilidad del entorno.
cambia el typeversion a 1.0, esto obliga al loader a usar pdf-parse en lugar de pdfjs-dist, eliminando la dependencia de DOM, o agrega un nodo Code como polyfill antes del loader.
Tengo el mismo problema que se reportó arriba (DOMMatrix no está definido). Como sugeriste, he revertido el Data Loader a la versión de tipo 1.0, agregué un Recursive Character Text Splitter al nodo, pero sigo obteniendo el error (DOMMatrix no está definido).
(Tengo n8n autohospedado y estoy usando la versión 2.23.1, ya que como la persona que publicó el problema original, también estaba obteniendo el problema de pdf-parse v1.1 reportado en “Error in Node Default Data Loader”.
hola @atdev150, bienvenido a la comunidad de n8n.
cada caso es un caso, es necesario evaluar tu JSON. por favor abre una pregunta para que la comunidad pueda apoyarte directamente o verifica si mi respuesta anterior también te ayuda.
solo quería saber en qué versión de n8n probaste esto. Además, ¿usaste el mismo flujo de trabajo Document Ingestion? ¿Pudiste cargar y procesar exitosamente un PDF usando este?
Mientras esperas la corrección oficial, una solución alternativa que funciona en instalaciones autohospedadas es reemplazar el nodo Document Loader por un nodo Code que use pdf-parse en su lugar. Si añades NODE_FUNCTION_ALLOW_EXTERNAL=pdf-parse a tus variables de entorno de n8n e instalas el paquete en el contenedor, puedes analizar el binario PDF directamente sin la dependencia DOMMatrix:
Buenos días, según mi impresión, el problema con la versión 2.23.4 está definitivamente resuelto. ¡Muchas gracias a todos los que han seguido el asunto con insistencia! Saludos, Thomas
De hecho, el problema aún no se ha resuelto. El error «DOM Matrix is not defined» vuelve a aparecer en la versión 2.25.7. En la versión 2.23.4, el flujo de trabajo funciona sin problemas. También en la versión «no oficial» 2.26.0, el flujo de trabajo funciona sin problemas.