Ready flow - Word-Dokument lesen und Excel-Tabelle ausfüllen

Ich brauche Hilfe, ich habe bereits mehrere Flows erstellt und kann das Ende nicht erreichen. Hier ist der Prompt/Flow, den ich zusammenstelle.

Ich habe eine angefügte Word-Datei mit Informationen zu mehreren Rechtsfällen. Ich muss diese Daten extrahieren, um eine Excel-Tabelle auszufüllen. Das ultimative Ziel ist es, eine Liste von zum Verkauf stehenden Immobilien zu erstellen. Extraktionsregeln: 1. Restriktiver Filter: Analysiere jeden Fall im Dokument nacheinander. EXTRAHIERE nur Daten und füge der Liste nur die Fälle hinzu, die ausdrücklich die Existenz von IMMOBILIEN erwähnen; wenn du die Fallnummer nicht finden kannst, füge sie nicht in die Tabelle ein, das heißt, jede Zeile ist eindeutig und muss sich auf einen einzelnen Fall beziehen. Verwerfe vollständig alle Fälle, die keine Immobilie haben. 2. Chronologische Reihenfolge: Die erste Zeile der Excel-Tabelle muss dem ersten berechtigten Fall in der Word-Datei entsprechen und der Reihenfolge des Dokuments streng folgen. 3. Konsistenz: Erfinde keine Daten. Falls erforderliche Informationen im Falltext nicht klar sind, fülle das Feld mit „Nicht angegeben

Hi @Ronaldo_Alves, willkommen!

Das Problem ist die Word-Datei. n8ns Extract from File Node liest .docx-Dateien nicht, sondern nur Formate wie PDF, Text, CSV und XLSX. Speichern Sie das Dokument zuerst als PDF, dann verwenden Sie Extract from PDF, um den Text zu extrahieren.

Füttern Sie diesen Text dann in einen Information Extractor Node ein, stellen Sie Schema Type auf „Generate From JSON Example

Hallo @Ronaldo_Alves

Welcher Knoten schlägt fehl oder welche Fehlermeldung siehst du?
Bitte teile deinen Workflow mit

hi @Ronaldo_Alves , willkommen in der n8n-community!

diese Templates sollten dir helfen, du musst sie nur für deine anforderungen anpassen.
Analyze Legal Documents with GPT & o4-mini plus Gmail & Google Sheets | n8n workflow template
:sparkles::kitchen_knife: Advanced AI powered document parsing & text extraction with Llama Parse | n8n workflow template

Der PDF-Konvertierungsansatz von achamm funktioniert gut. Wenn du n8n selbst hostest und den Konvertierungsschritt überspringen möchtest, kannst du die .docx auch direkt mit einem Code-Node und dem mammoth-Paket auslesen – füge NODE_FUNCTION_ALLOW_EXTERNAL=mammoth zu deinen Umgebungsvariablen hinzu und nutze dann mammoth.extractRawText({buffer: Buffer.from($binary.data, 'base64')}), um den Text zu extrahieren. Von dort aus kannst du den Text in einen Information Extractor-Node mit deinem Schema pipen und dieser erzeugt die strukturierte Ausgabe sauber.