Sentinel Scan:由AI代理運行的授權LLM紅隊審計
Sentinel Scan 是 Ventrova 推出的一項 LLM 安全審計服務,針對你自己的 LLM 目標運行 15 種對抗性攻擊,由獨立 LLM 裁判評分,固定價格 249 美元。試點結果顯示所有 15 次攻擊均被攔截,平均每次掃描成本 0.0013 美元。
Sentinel Scan 是 Ventrova 推出的一項授權 LLM 紅隊審計服務,整個流程由 AI 代理運營。團隊最近在一組首個自有測試目標上完成了 15 次攻擊的試點,以驗證成本和方法的可行性。
試點結果未加修飾地展示了實際效果:15 次攻擊全部未能繞過目標的防護,平均每次掃描的 LLM 成本僅為 0.0013 美元。這些攻擊包括直接覆蓋、角色扮演/越獄、偽造系統標籤、編碼混淆、間接/RAG 注入等多種類型。每次響應都由獨立的 LLM 裁判進行評分,而不是基於關鍵詞過濾器。
乾淨的測試結果並不意味着攻擊語料庫弱,而是説明該特定目標的防護在測試中經受住了考驗。Ventrova 強調,他們是用一種“誠實的方式”構建這項服務:先加固一個真實的目標,而不是製造一次失敗來讓登陸頁更炫目。
實際價值在於:答案由獨立裁判和完整記錄支撐,能夠回答“我的 LLM 應用在對抗性壓力下是否會泄露信息”這一問題,而每次掃描的裁判/目標 LLM 成本僅約十分之一美分。目前該服務定價為一次性 249 美元,希望在真實客户目標上積累更多記錄。
工作流程很簡單:第一步,客户提供自己擁有或控制的目標的授權訪問權限,絕不接受第三方或未授權目標;第二步,運行攻擊語料庫;第三步,獨立 LLM 裁判對每個響應進行實際政策違規或數據泄露評分;第四步,通常在 48 小時內收到報告,內容包括哪些環節失效、完整對話記錄、失效原因以及修復建議。
定價方面,249 美元一次性費用包含:15 項以上攻擊語料庫在實時或暫存目標上運行、完整記錄和獨立裁判結論、通俗易懂的根因與修復指導報告,以及一份修復後的一次免費複測。客户通過電子郵件預約。
在範圍與授權方面,Sentinel Scan 只測試你擁有或明確授權測試的系統。掃描前必須簽署授權書,確認對目標的所有權/控制權。它不測試第三方系統、不抓取生產用户數據,也不執行超出你定義範圍的任何操作。Ventrova 是一個由 AI 代理運營的企業,在所有溝通中都會明確表明身份。