AI News HubLIVE
サイト内リライト2 分で読了

Cage-lite: 重要なAIエージェント行動に対する事前保証

CAGE-liteは、AIエージェントの行動がビジネス上の結果となる前に、その行動が承認され、証拠によって裏付けられていることを検証するオープンソースのリファレンス実装です。

ソースHacker News AI著者: roopamsure10

CAGE-liteは、CAGE(Control, Assurance, and Governance Evaluation)フレームワークのオープンソースリファレンス実装であり、AIエージェントの行動が実際のビジネス結果に変換される前に「事前保証(Prebind Assurance)」を提供することに焦点を当てています。このツールは、エージェントが支払いの実行、アクセス権の付与、取引の承認、システムの更新、または保護情報の開示を提案する前に、その行動が許可され、必要な証拠によってサポートされていることを組織が確認できるようにします。

CAGE-liteの核心は、行動がビジネス境界を越える前に最終的な保証ステップを追加することです。エージェントの提案する行動は、まずCAGE-liteによって評価されます。CAGE-liteは、アイデンティティ、権限、ポリシー、承認信号などを考慮し、行動を「保留(HELD)」するか「許可(ADMITTED)」するかを決定します。決定後、効果証明が記録され、行動がビジネス結果にバインドされたかどうかが示されます。

プロジェクトには、7万5000ドルのベンダー支払いを例にしたデモが含まれています。この支払いはエージェントの直接権限限度額5万ドルを超えており、必要な人間の承認がない場合、CAGE-liteは行動を保留し、「NO_BIND」効果を記録します。その後、承認証拠が追加されると、行動は再評価され、許可されてバインドされます。元の保留Warrantは保持され、リプレイWarrantにリンクされます。

CAGE-liteは、エージェントランタイム、IAM、ポリシーエンジン、ガードレール、承認システム、可観測性プラットフォームなどを代替するものではありません。それらのシステムが生成する重要な信号を消費し、提案された行動がビジネス結果境界を越えて許可されるべきかどうかを評価します。評価された各行動は、決定証明、効果証明、証拠参照、リプレイリンケージ、整合性情報を含む「CAGE Warrant」を生成します。

現在、CAGE-liteはv1製品プレビューであり、Pythonパッケージバージョン0.1.2、CAGE Warrantスキーマバージョン0.4です。PyPIからインストール可能であり、ソースからもビルドできます。プロジェクトは、ポリシー評価、バインドなしのデモ、承認後のバインド、スコープ縮小など、さまざまな動作を示すサンプルスクリプトを提供しています。Streamlitダッシュボードを使用すると、最新の境界決定、元の保留アクション、およびリプレイ後の結果を視覚的に確認できます。CAGE-liteはApache License 2.0の下でライセンスされており、コミュニティの貢献を歓迎します。