有些人曾在其他兩個討論串中與我爭論此事。這是目前可運作的版本,附帶檔案,因此您可以自行執行,而不必只聽我口說無憑。此設定是一個 AI 代理,負責撰寫並寄送客戶電子郵件。通常它會直接寄送。
Guardian 政策閘門位於代理與寄送節點之間:工作流程會在執行前詢問,並獲得「允許 (ALLOW)」、「拒絕 (DENY)」或「需要核准 (REQUIRE_APPROVAL)」的回覆。核准會暫停在關鍵路徑上,直到任何內容被寄出為止。每個決策都會記錄在雜湊鏈結日誌中。
這段未經剪輯的九分鐘影片展示了:問題所在、如何建立政策(範本、自然語言或 JSON)、如何為自己的政策產生測試負載,以及規則優先順序(拒絕 > 需要核准 > 允許)。它也解釋了代理工具與強制執行節點的差異,以及為何代理無法繞過後者。
影片中還示範了「允許」決策下的郵件寄送、原始負載與可執行負載的編輯與核准,以及稽核日誌如何顯示已執行的負載是編輯後的版本。最後,它展示了工作流程未回覆時的情況、拒絕決策,以及為何使用 Switch 節點而非直接從 Guardian 的輸出分支。
檔案包括 guardian-demo-workflow_2.json (15.7 KB) 和 guardian-demo-policy.json (509 Bytes),兩者都已附上。請將政策 JSON 貼到政策建構器的 JSON 部分。節點是社群節點中的 n8n-nodes-guardian。將您自己的地址放入政策允許清單中,它就能運作。
這是我會從其他地方借用的部分:該政策不試圖偵測不良內容。它允許 AI 代理在無人監督下寄送的郵件主旨,而代理自行撰寫的任何內容都會轉交給人工審核。例如:{"type": "allowlist", "fieldPath": "subject", "allowedValues": ["Order confirmation", "Delivery update"], "otherwiseDecision": "REQUIRE_APPROVAL"}。
只需兩行程式碼,代理就只能在您已核准的範本內獨立運作。您會發現的第一個漏洞是內容主體沒有任何限制。主旨和收件人皆已核准,但代理可以在下方撰寫任何內容。這是為了演示而刻意為之。請告訴我您會添加什麼規則,因為這是我一直在反覆思考的部分。
目前尚未實現的功能,以免有人浪費一個下午去發現:執行記錄中沒有提供者收據。在那些討論串中,有幾個人獨立提到了這一點,他們是對的。閘門證明了該動作是允許的,但尚未證明提供者對其做了什麼。
對於已核准但從未確認的項目,目前沒有超時監控器。您可以在日誌的 6:55 處看到它,但沒有任何追蹤機制。如果 Guardian 無法連線,目前也沒有可配置的備用方案。這將是下一個版本的功能。
現在可以在 guardian-safety-gate.com 免費使用。免費方案可以運行整個演示。匯入它,將其指向您自己的政策,並嘗試讓某些東西通過它。我寧願在這裡聽到您的意見,也不願從客戶那裡得知。祝您好運!



