Necesito ayuda, ya he creado varios flujos y no puedo llegar al final. Aquí está el prompt/flujo que estoy armando.
Tengo un archivo de Word adjunto que contiene información sobre varios casos legales. Necesito extraer estos datos para completar una hoja de cálculo de Excel. El objetivo final es crear una lista de propiedades elegibles para subasta. Reglas de Extracción: 1. Filtro Restrictivo: Analizar cada caso en el documento secuencialmente. SOLO extraer datos y agregar a la lista los casos que mencionen explícitamente la existencia de PROPIEDADES; si no puedes encontrar el número de caso, no lo agregues a la hoja de cálculo, lo que significa que cada fila es única y debe referirse a un único caso. Descartar completamente cualquier caso que no tenga una propiedad. 2. Orden Cronológico: La primera fila de la tabla de Excel debe corresponder al primer caso elegible encontrado en el archivo de Word, siguiendo estrictamente el orden del documento. 3. Consistencia: No inventes datos. Si alguna información requerida no está clara en el texto del caso, completa el campo como “No informado”. Formato de Salida: Hoja de cálculo de Excel. Utiliza las siguientes columnas estándar (ajusta si necesitas más campos): - Número de Caso - Tipo de Propiedad (Casa, Apartamento, Terreno, etc.) - Dirección / Ubicación de la Propiedad - Valor de Tasación (si la hay) - Descripción Breve del Activo Instrucción de Ejecución, Demandante, Demandado, Abogado del Demandante, Teléfono, Correo Electrónico, Sitio Web, Referencia, Notas.
Hola @Ronaldo_Alves, ¡bienvenido!
Lo que te está bloqueando es el archivo de Word. El nodo Extract from File de n8n no lee .docx, solo formatos como PDF, texto, CSV y XLSX. Así que guarda el documento como PDF primero, luego usa Extract from PDF para extraer el texto.
Luego alimenta ese texto a un nodo Information Extractor, establece Schema Type en Generate From JSON Example, y pega una estructura como esta para que cada caso sea su propio objeto:
{
"cases": [
{
"case_number": "",
"property_type": "",
"address": "",
"appraisal_value": "",
"description": "",
"execution_instruction": "",
"claimant": "",
"respondent": "",
"lawyer": "",
"phone": "",
"email": "",
"website": "",
"referral": "",
"notes": ""
}
]
}
Mantén tus reglas (omitir casos sin propiedad o sin número de caso, nunca inventar datos, usar “Not informed”) en el prompt del nodo. Luego añade un nodo Split Out en el array de casos para que cada caso se convierta en una fila, y termina con Convert to File configurado en XLSX.
Hola @Ronaldo_Alves
¿Cuál es el nodo que está fallando o qué mensaje de error estás viendo?
Por favor, comparte tu flujo de trabajo
El enfoque de conversión de PDF de achamm funciona bien. Si estás auto-hospedando n8n y quieres saltarte el paso de conversión, también puedes leer los archivos .docx directamente usando un nodo Code con el paquete mammoth - añade NODE_FUNCTION_ALLOW_EXTERNAL=mammoth a tus variables de entorno, luego usa mammoth.extractRawText({buffer: Buffer.from($binary.data, 'base64')}) para obtener el texto. Desde ahí, canalízalo a un nodo Information Extractor con tu esquema y manejará la salida estructurada de forma limpia.