AI News HubLIVE
站內改寫1 分鐘閱讀

Show HN:Klent – 在AI代理與生產環境之間一鍵設定安全防護

Klent 是一個AI代理防護系統,位於代理和工具呼叫之間,允許、拒絕、修改或暫停每次呼叫,只需兩行程式碼整合,並提供完整審計追蹤。它能防止誤操作導致的生產資料災難,例如一次性修改數萬行資料,支援人工審批、策略引擎、動作重寫等功能。

來源Hacker News AI作者: zequera

在AI代理日益普及的今天,如何防止代理誤操作導致的生產事故成為關鍵問題。Klent 應運而生,它像一個智慧閥,安裝在代理與工具之間,對每一次工具呼叫進行策略評估。無論是資料庫寫入、Stripe 退款還是 kubectl 刪除,Klent 都能根據預設策略進行允許、拒絕、修改或暫停操作。

一個典型的場景是:某團隊使用 Claude Desktop 透過 MCP 連線生產資料庫。在一次深夜操作中,代理執行了一條“修復郵件格式”的指令,結果一條 UPDATE 語句重寫了 47,000 行資料,沒有差異對比,沒有第二雙眼睛,也無法撤銷。Klent 的出現為這種破壞性操作提供了“手剎”。只需一個策略,就能讓所有生產寫操作暫停併傳送審批郵件。

Klent 的核心功能包括:

  • 內聯防護:在 50 毫秒內執行策略評估,不鎖定代理框架。
  • 人工審批:暫停不可逆操作,透過郵件或儀表盤進行一鍵審批,支援單人或多人審批,多人審批時需所有批准者投票,任一拒絕即終止。
  • 動作重寫:自動遮蔽敏感資訊、強制 --dry-run 引數或限制轉賬金額,確保更安全的引數被執行。
  • 工具轉向:將危險呼叫重定向到安全替代方案,如將生產寫入強制導向沙箱叢集,或將寫入切換為讀取。
  • 影子測試:在僅觀察模式下用過去30天的真實流量測試策略效果,檢視策略本應捕獲哪些操作,然後再強制執行。
  • 審計時間線:記錄每次決策的結構化事件,包括請求、評估、執行和人類批准,可查詢、可匯出,滿足審計要求。

對於“為什麼不自己實現”的質疑,Klent 的答案是:就像你不會自己寫身份驗證系統一樣,專業的事情交給專業工具。Klent 之於 AI 工具呼叫,正如 WorkOS 之於身份驗證——提供統一的安全控制點。團隊可以避免為每個工具編寫包裝器,只需一個策略表面即可管理所有工具。

目前 Klent 處於邀請制內測階段,每週招募新團隊。如果你也希望為你的 AI 代理裝上安全護欄,不妨申請體驗。Klent 不僅僅是一個防護工具,它代表了一種新的安全正規化:在 AI 代理快速行動的同時,確保破壞性操作始終有人類監督。