AI News HubLIVE
サイト内リライト3 分で読了

Unity AI Gateway GuardrailsでAIワークロードを保護する方法

DatabricksはUnity AI GatewayにおけるLLMガードレール(ベータ版)を発表。プリビルトおよびカスタムガードレールによりAIワークロードをセキュリティとコンプライアンスのリスクから保護し、Lakehouseと統合して可観測性を実現します。

DatabricksはUnity AI GatewayにおけるLLMガードレール(ベータ版)を発表しました。これはAIワークロードを保護するための一連のセキュリティおよびコンプライアンスツールです。ガードレールは機密情報がAIアプリケーションに渡されるのを防ぎ、AI生成出力の安全性とコンプライアンスを確保する柔軟で実用的な方法です。Unity AI Gatewayは、一般的なニーズをカバーする一連のプリビルトガードレールと、組織の微妙な要件に対応するカスタムガードレールのオプションを提供します。これらのガードレールはDatabricks Lakehouseアーキテクチャと統合されており、可観測性、監視、評価を簡素化します。

今回のリリースでは、企業の機密データがユーザーからモデルへ、またはその逆に漏洩するのを防ぐガードレールの重要性が強調されています。ガードレールはAIの有害または攻撃的な使用を防止し、生成コンテンツが製品ブランディング戦略に沿うようにし、チャット会話をトピックに集中させることができます。

シナリオ:Acme Co.が生成AIのガードレールを定義 Acme社のマーケティングチームはキャンペーン作成を支援するAIアシスタントを立ち上げています。CIOはLLM使用に関する全社的なポリシーを確立しました。顧客のPIIがモデルプロンプトに漏れないこと、すべてのモデルプロンプトはジェイルブレイクやプロンプトインジェクションの試みがないかスクリーニングされること、AIを使用して有害または安全でないコンテンツを生成できないこと。さらにマーケティングチームはブランドイメージを保護し、競合他社を中傷することを避けることに非常に注意しています。彼らはUnity AI Gatewayでプロジェクトのエンドポイントを設定し、さまざまなガードレールを構成しました。

ガバナンスされたAIエンドポイントの構築 チームは汎用モデルGPT-5.4を選択し、エンドポイントを構成しました。また、ガードレールを監視するための推論テーブルも設定しました。ビジネス要件に基づいてガードレールタイプをマッピングしました:入力時のPII検出と編集、入力時のジェイルブレイクとプロンプトインジェクションのブロック、出力時の安全でないコンテンツのブロック、および競合他社への言及を避けるカスタムガードレール(出力時ブロック)。

プリビルトガードレールの設定は簡単です。ゲートウェイページからガードレールタブに移動し、「ガードレールを追加」をクリックし、タイプを選択して構成します。PIIについては入力編集を構成しました。各プリビルトガードレールにはデフォルトの評価エンドポイント(例:databricks-gpt-5-nano)があり、変更可能です。アドバンストモードではログモードも選択できます。カスタムガードレールでは、名前を付け、違反出力をブロックすることを選択し、プロンプトテンプレートを記入しました。

ガードレールのテスト チームは代表的なプロンプトを送信しました。期待されるガードレールアクションには、なし、PII編集、出力ブロックなどが含まれます。実際の観察では、カスタムガードレールは最初期待どおりに動作しませんでしたが、プロンプトを改善(ビジネスを指定、競合他社をリストアップ、少数ショット例を提供)し、適切な評価モデル(gpt-5-4-mini)を選択することでパフォーマンスが向上しました。彼らは推論テーブルを介してより多くのライブトラフィックをキャプチャし、さらに調整する予定です。

ガードレールアクティビティの監査 推論エンドポイントはリクエストごとに1行を記録し、ブロックされたリクエストも含みます。評価エンドポイントはガードレール呼び出しごとに1行を記録し、リクエスト本文、生のJSON応答、レイテンシなどを含みます。これらはrequest_idで結合でき、ガードレールの決定をクライアント呼び出しにトレースできます。チームはこれらの推論テーブルに関するレポートやダッシュボードを作成し、ユーザーセッションを分析してガードレールの感度を検証できます。

今すぐUnity AI GatewayのLLMガードレールをお試しください!ベータ版は現在利用可能です。ドキュメントでは有効化方法を説明しています。機密プロンプト、外部ツール、または顧客向け出力を処理するエンドポイントからガードレールを有効にし、推論テーブルを使用してガードレールの動作を監視および調整することをお勧めします。