Das Problem/den Fehler/die Frage beschreiben
Wir betreiben eine selbst gehostete n8n-Instanz auf Railway und haben mit zunehmenden Leistungsproblemen zu kämpfen, da unsere Nutzung gewachsen ist.
Wir verarbeiten derzeit mehr als 40.000 Workflow-Ausführungen pro Monat.
Das Hauptproblem ist, dass Workflows, die normalerweise etwa 1 Sekunde dauern sollten, jetzt häufig 3–4 Sekunden brauchen, um zu Ende zu kommen, obwohl sich die Workflow-Logik selbst nicht geändert hat.
Wir sehen auch zufällig entstehende Ausführungswarteschlangen. Das sollte nicht passieren, basierend auf unserer aktuellen Konfiguration, da wir absichtlich keine Concurrency-Limits konfiguriert haben.
Kürzlich haben wir auch begonnen, diesen Fehler zu sehen:
Diese Ausführung konnte zu viele Male nicht verarbeitet werden und wird nicht mehr wiederholt. Um diese Ausführung abzuschließen, unterteilen Sie bitte Ihren Workflow oder skalieren Sie Ihre Worker hoch oder passen Sie Ihre Worker-Einstellungen an.
Wir wissen ehrlich gesagt nicht, was wir noch versuchen sollen. Die Railway-Metriken für unsere Worker, primäre Instanz und PostgreSQL sehen alle gesund aus, ohne offensichtliche Ressourcenengpässe. Hat jemand etwas Ähnliches erlebt oder hat Ideen, was wir als Nächstes untersuchen sollten?
Wie lautet die Fehlermeldung (falls vorhanden)?
Bitte teilen Sie Ihren Workflow
(Wählen Sie die Knoten auf Ihrer Canvas aus und verwenden Sie die Tastaturkürzel CMD+C/STRG+C und CMD+V/STRG+V zum Kopieren und Einfügen des Workflows.)
Geben Sie die vom letzten Knoten zurückgegebene Ausgabe an
Informationen zu Ihrem n8n-Setup
- n8n-Version: 2.28.4
- Datenbank: PostgreSQL
- n8n EXECUTIONS_PROCESS-Einstellung (Standard: own, main):
- n8n wird ausgeführt über (Docker, npm, n8n cloud, Desktop-App): railway
- Betriebssystem: windows 11