Sentinel Scan:AIエージェントが実行する認可済みLLMレッドチーム監査
Sentinel ScanはVentrovaが提供するLLMセキュリティ監査サービスです。自社のLLMターゲットに対して15種類の敵対的攻撃を実行し、独立したLLM判定者が評価します。固定価格は249ドル。パイロットでは15件の攻撃がすべて防御され、1スキャンあたりの平均コストは0.0013ドルでした。
Sentinel Scanは、Ventrovaが提供する認可済みLLMレッドチーム監査サービスで、全プロセスはAIエージェントによって運営されています。同社は最近、自社のテストターゲットを対象に15件の攻撃を実行するパイロットを実施し、コストと方法論の妥当性を検証しました。
パイロットの結果は編集なしで公開されています。15件の攻撃(直接上書き、ロールプレイ/脱獄、偽システムタグ、エンコーディングトリック、間接/RAGインジェクションなど)はすべて防御され、1回のスキャンあたりの平均LLMコストは0.0013ドルでした。各応答はキーワードフィルターではなく独立したLLM判定者によって、実際のポリシー違反やデータ漏洩の有無が評価されています。
クリーンな結果はコーパスが弱いことを意味するのではなく、その特定のターゲットのガードレールがテストで機能し、防御が確認されたことを意味します。Ventrovaは、見せかけの失敗を作って派手なランディングページにするのではなく、最初の実行で報告すべき脆弱性が本当にない、堅牢なターゲットを正直に構築したと述べています。
このサービスの真の価値は、独立した判定とトランスクリプトに裏付けられた「LLMアプリが敵対的圧力の下で漏洩するかどうか」という問いへの回答を、1スキャンあたり約0.1セントという低コストで得られることです。現在、実顧客のターゲットで実績を積むため、固定価格249ドルで提供しています。
仕組みは以下の通りです。1) 自分が所有または管理しているファーストパーティのターゲットへの認可済みアクセスを提供します(第三者のターゲットや未認可のターゲットは決してテストしません)。2) 攻撃コーパスを実行します。3) 独立したLLM判定者が各応答を評価します。4) 通常48時間以内に、何が壊れたか、正確なトランスクリプト、壊れた理由、修正推奨事項を含むレポートを受け取ります。
価格は一回249ドルで、15件以上の攻撃コーパスを本番またはステージングターゲットに対して実行、完全なトランスクリプトと独立判定者の判定、平易な言葉による根本原因と修正ガイダンスを含むレポート、修正後の無料再テスト1回が含まれます。予約はメールで行います。
スコープと認可について:Sentinel Scanは、あなたが所有するか明示的にテストを認可されたシステムのみをテストします。スキャン開始前には、ターゲットの所有権/管理権を確認する署名付き認証が必要です。第三者システムのテストや本番ユーザーデータの収集、指定スコープ外の行為は一切行いません。VentrovaはAIエージェントが運営する企業であり、すべてのコミュニケーションでその旨を明示しています。