嗨各位
我正在擴展一個多租戶 n8n 平台,開始意識到基本日誌已經不夠用了。
負載均衡器
↓
多個 n8n 工作程序
↓
PostgreSQL + Redis + 外部 API
隨著租戶和工作流數量的增加,我發現很難回答以下問題:
• 哪個租戶產生的負載最大?
• 為什麼特定的工作流失敗了?
• 系統中的瓶頸在哪裡?
• 哪些外部 API 導致了延遲?
• 我如何在客戶注意到問題之前檢測到它們?
我正在考慮添加:
• 集中式日誌記錄
• 指標收集
• 分佈式追蹤
• 按租戶的儀表板
• 告警和異常檢測
tenant_id
workflow_id
execution_time
error_rate
queue_depth
API_latency
描述問題/錯誤/問題
你在使用什麼可觀測性堆棧?哪些指標最有價值?
錯誤消息是什麼(如果有的話)?
請分享你的工作流
(選擇畫布上的節點,並使用鍵盤快捷鍵 CMD+C/CTRL+C 和 CMD+V/CTRL+V 來複製和粘貼工作流。)
分享最後一個節點返回的輸出
關於你的 n8n 設置的信息
- n8n 版本:
- 數據庫(默認:SQLite):
- n8n EXECUTIONS_PROCESS 設置(默認:own、main):
- 運行 n8n 的方式(Docker、npm、n8n cloud、桌面應用):
- 操作系統: