Ready flow - اقرأ مستند Word واملأ جدول بيانات Excel

أحتاج إلى مساعدة، لقد قمت بالفعل بإنشاء عدة تدفقات ولا يمكنني الوصول إلى النهاية. إليك الفكرة/التدفق الذي أقوم بتجميعه.

لدي ملف Word مرفق يحتوي على معلومات حول عدة قضايا قانونية. أحتاج إلى استخراج هذه البيانات لملء جدول بيانات Excel. الهدف النهائي هو إنشاء قائمة بالممتلكات المؤهلة للمزاد العلني. قواعد الاستخراج: 1. مرشح تقييدي: قم بتحليل كل قضية في المستند بشكل متسلسل. استخرج البيانات فقط وأضف إلى القائمة القضايا التي تذكر بشكل صريح وجود ممتلكات؛ إذا لم تتمكن من العثور على رقم القضية، فلا تضيفها إلى جدول البيانات، بمعنى أن كل صف فريد ويجب أن يشير إلى قضية واحدة فقط. تجاهل تماماً أي قضية لا تحتوي على ممتلكات. 2. الترتيب الزمني: يجب أن يتوافق الصف الأول من جدول Excel مع أول قضية مؤهلة تم العثور عليها في ملف Word، مع الالتزام الصارم بترتيب المستند. 3. الاتساق: لا تختلق بيانات. إذا لم تكن أي معلومات مطلوبة واضحة في نص القضية، فاملأ الحقل باسم “غير محدد”. صيغة الإخراج: جدول بيانات Excel. استخدم الأعمدة المعيارية التالية (اضبط إذا كنت تحتاج إلى حقول إضافية): - رقم القضية - نوع الممتلكات (منزل، شقة، أرض، إلخ) - عنوان الممتلكات / الموقع - قيمة التقييم (إن وجدت) - وصف موجز للأصل تعليمات التنفيذ، المدعي، المدعى عليه، محامي المدعي، الهاتف، البريد الإلكتروني، الموقع الإلكتروني، الإحالة، الملاحظات.

مرحباً @Ronaldo_Alves، أهلاً وسهلاً!

المشكلة التي تحول دون تقدمك هي ملف Word. عقدة Extract from File في n8n لا تقرأ ملفات .docx، بل تقرأ صيغاً مثل PDF والنصوص و CSV و XLSX فقط. لذا احفظ المستند بصيغة PDF أولاً، ثم استخدم Extract from PDF لاستخراج النص.

ثم أدخل هذا النص في عقدة Information Extractor، عيّن Schema Type إلى Generate From JSON Example، والصق هيكلاً كهذا بحيث تكون كل قضية كائناً منفصلاً:

{
  "cases": [
    {
      "case_number": "",
      "property_type": "",
      "address": "",
      "appraisal_value": "",
      "description": "",
      "execution_instruction": "",
      "claimant": "",
      "respondent": "",
      "lawyer": "",
      "phone": "",
      "email": "",
      "website": "",
      "referral": "",
      "notes": ""
    }
  ]
}

احتفظ بقواعدك (تخطّ القضايا التي لا تحتوي على عقار أو رقم قضية، لا تختلق بيانات أبداً، استخدم «Not informed») في موجه العقدة. ثم أضف عقدة Split Out على مصفوفة cases بحيث تصبح كل قضية صفاً، وأنهِ العملية باستخدام Convert to File مضبوطة على XLSX.

مرحباً @Ronaldo_Alves

أي عقدة تفشل أو ما رسالة الخطأ التي تراها؟
يرجى مشاركة سير العمل الخاص بك

مرحبا @Ronaldo_Alves ، أهلا وسهلا بك في مجتمع n8n!

هذه القوالب ستساعدك، ما عليك سوى تكييفها مع احتياجاتك.
Analyze Legal Documents with GPT & o4-mini plus Gmail & Google Sheets | n8n workflow template
:sparkles::kitchen_knife: Advanced AI powered document parsing & text extraction with Llama Parse | n8n workflow template

نهج تحويل PDF من achamm يعمل بشكل جيد. إذا كنت تستضيف n8n بنفسك وتريد تخطي خطوة التحويل، يمكنك أيضاً قراءة ملف .docx مباشرة باستخدام عقدة Code مع حزمة mammoth - أضف NODE_FUNCTION_ALLOW_EXTERNAL=mammoth إلى متغيرات البيئة الخاصة بك، ثم استخدم mammoth.extractRawText({buffer: Buffer.from($binary.data, 'base64')}) للحصول على النص. من هناك، مرره إلى عقدة Information Extractor مع مخطط البيانات الخاص بك وستتعامل مع المخرجات المنظمة بكفاءة.