Suche jemanden, der mir beim Erstellen des richtigen Scraping-Workflows mit Firecrawl hilft

Ich verwende den vorgefertigten ‘Standard’-n8n-Workflow für Firecrawl, aber er liefert nicht das gewünschte Ergebnis. Ich würde gerne jemanden haben, der sich das mit mir gemeinsam anschaut. Ich habe kein riesiges Budget und würde wahrscheinlich nur eine Stunde Hilfe benötigen.

Michael, das ist eine saubere, bezahlte Debugging-Stunde, falls du bereits den Workflow und ein paar Beispiel-Zielseiten hast.

Ich würde das in dieser Reihenfolge eingrenzen: Firecrawl-Crawl-Modus/-Limits, Extractor-Schema, n8n-Item-Mapping und dann die genaue gewünschte Ausgabeform. Der nützliche Übergabepunkt ist nicht der Account-Zugang, sondern der Workflow-Export, 1–2 Ziel-URLs, die aktuelle Ausgabe und die gewünschte Ausgabe.

Ich kann das auf den richtigen Firecrawl- + n8n-Pfad zuschneiden und dir die minimalen Node-Änderungen statt eines vollständigen Neubaus überlassen. Wenn du die Stunde buchen möchtest, antworte hier mit den Beispielen und der Ziel-Ausgabe oder nutze bei Vorzug per E-Mail die oimrqs-ops-Kontaktseite: oimrqs ops - Web, Automation, Data, APIs and AI Workflow Delivery

Willkommen in der n8n-Community, @michaelba!

Teile es gerne hier in der Community, und wir helfen dir, es gemeinsam aufzubauen.

Ich bin auf ein ähnliches Setup gestoßen und was meine Sanität gerettet hat, war das Hinzufügen einer kleinen Verzögerung plus ein schneller Kontrollschritt nach jedem Firecrawl-Aufruf, damit n8n nicht vorausrennt, bevor das Scraping tatsächlich bereit ist. Wenn du straffere Kontrolle für den Human-in-the-Loop-Teil brauchst, hat mir das Routing von allem über einen einzelnen Google-Sheet-Tab als Review-Queue die Sache deutlich weniger chaotisch gemacht.

Ich bin auf ein ähnliches Setup gestoßen und was meine Sanität bewahrt hat, war das Hinzufügen einer winzigen Verzögerung plus einer schnellen Überprüfung nach jedem Firecrawl-Aufruf, damit n8n nicht vorauseilt, bevor das Scraping tatsächlich fertig ist. Wenn du eine strengere Kontrolle für den Human-in-the-Loop-Teil brauchst, hat mir das Routing von allem über eine einzige Google-Sheet-Registerkarte als Review Queue die Dinge auf meiner Seite viel weniger chaotisch gehalten.

Ich bin auf ein ähnliches Setup gestoßen und was meine Sanität gerettet hat, war das Hinzufügen einer winzigen Verzögerung plus ein schneller Check-Schritt nach jedem Firecrawl-Aufruf, damit n8n nicht zu früh losrennt, bevor das Scraping tatsächlich bereit ist. Wenn du bessere Kontrolle für den Human-in-the-Loop-Part brauchst, hat das Routing von allem durch einen einzigen Google-Sheet-Tab als Review-Queue die Dinge bei mir deutlich weniger chaotisch gehalten.

Hallo,

Ich habe deinen Beitrag über den Standard-Firecrawl-n8n-Workflow gesehen, der die benötigte Ausgabe nicht produziert.

Das klingt nach einer kurzen Diagnosesitzung geeignet. Bevor ich den Workflow ändere, würde ich zuerst das erwartete Output-Schema mit der tatsächlichen Firecrawl-Antwort vergleichen, dann die Extraction-Prompt, den Crawl-/Scrape-Modus und alle nachgelagerten Mapping-Nodes überprüfen.

Wenn sich das Problem mit einer nicht-sensiblen URL und einem bereinigten Workflow-Export reproduzieren lässt, kann ich es überprüfen, ohne Zugriff auf deine Produktionsanmeldedaten zu benötigen.

Wenn du noch Hilfe brauchst, teile bitte das erwartete Ausgabebeispiel und das aktuelle Ausgabebeispiel. Dann kann ich bestätigen, ob eine einstündige Sitzung realistisch ist.