AI News HubLIVE
サイト内リライト3 分で読了

Anthropic、AIネイティブなソフトウェア開発ライフサイクルのセキュリティを確保

Anthropicの副CISOであるJason Clinton氏は、AI(Claude)がマージされるコードの80%を作成するソフトウェア開発ライフサイクルをセキュリティチームがどのように保護しているかについて、セキュリティの左シフト、ハードなアイデンティティ境界、自動化とエージェントレビューの組み合わせ、人間の監視などの戦略を用いて詳述しています。この記事では、脅威、原則、各段階(計画、コーディング、テスト/CI)のプロセスをカバーしています。

ソースHacker News AI著者: _tk_

Anthropicの副最高情報セキュリティ責任者であるJason Clinton氏は、同社がどのようにAIネイティブなソフトウェア開発ライフサイクルを保護しているかを詳述した記事を公開しました。Anthropicでは、AIモデルClaudeが現在、マージされるコードの約80%を作成しており、エンジニアは四半期あたりのコード出荷量が2021年から2025年までの期間の8倍に達しています。この指数関数的な成長は、セキュリティチームに新たな課題を突き付けています。開発速度を大幅に落とさずに、拡大する攻撃表面に対処し、非決定論的で絶えず進化するエージェントを中心とするライフサイクルを強化する必要があります。

Clinton氏は、主に3つの脅威に対抗する設計を行っていると述べています。侵害されたりプロンプトインジェクションを受けたエージェントによる悪意のある変更、サプライチェーンや依存関係のポイズニング、そして高頻度で発生する従来型のアプリケーション脆弱性です。これに対応するため、Anthropicは複数の全体的な戦略を展開しています。セキュリティを左シフトしてコード開発段階に完全に統合する、厳格なアクセスとID境界で爆発半径を制限する、本番前と本番後の両方で自動化された決定論的レビューとエージェントレビューを組み合わせる、そして最もレバレッジの効くポイントに人間を介入させる、というものです。

計画段階では、AnthropicはClaude Opusを活用したプロジェクトセキュリティレビュー(PSR)アプリを最初のセキュリティ自動化として導入しました。これは設計文書をMITRE ATT&CKフレームワークに照らして分析し、潜在的な脆弱性と緩和策を提案します。その後、社内知識インデックスに接続することで組織全体のコンテキストを深く理解できるようにし、Claudeがリスクが低いと判断したプロジェクトは自動承認されるようになりました。Clinton氏は、計画サイクルが短縮されるにつれ、セキュリティエージェントをコンテキストが存在する場所(チャットスレッド、過去のレビュー、コードベースなど)に接続することが、もはや不要な段階で詳細な文書化を強制するよりもはるかに効果的だと強調しています。

コード作成段階では、セキュリティガイドラインがCLAUDE.mdファイルと組織全体のスキルに刻み込まれており、コードが生成された瞬間からベストプラクティスに従うようになっています。チームはまた、フィードバックループを実装し、エージェントが新しい脆弱性クラスを発見すると、関連ファイルを更新して再発を防止します。さらに、Anthropicは/security-reviewコマンド(製品化済み)をコード生成中に実行し、出発点として潜在的な攻撃者制御入力をスキャンします。開発者は仮想マシン上でリモートコーディングを行い、エージェントのトラフィックは許可リストによって制限され、プロンプトインジェクションの影響を抑えます。

テスト/CI段階は、AIネイティブな変革において最も深刻なボトルネックになりがちです。Anthropicは、自動化されたエージェントレビューと決定論的レビューを組み合わせ、規制対象や真に重要なコードには人間のレビューを残すことで、レビュープロセスを加速しました。複数の狭い焦点のレビューエージェントがそれぞれ独立して動作し、RAGを使用してコンテキストを取得することで、単一の巨大エージェントよりも効果的です。これにより、実質的なレビューコメントを得るPRの割合が16%から54%に増加しました。Anthropicはまた、コードベースをリスクで階層化し、重要なコードには厳格な人間承認プロセスを維持し、すべての承認はログに記録され、リスク加重サンプリングで人間が再確認します。

Clinton氏は、いくつかの永続的な原則をまとめています。セキュリティエージェントを組織のコンテキストに接続すること、左シフトは脆弱性の発見とコード生成指示の更新のループを閉じることを意味すること、ハード境界で爆発半径とエージェントの権限を制限すること、CI段階で複数のレビュー方法を組み合わせつつも人間の説明責任を常に中心に置くことです。これらの原則は、モデルの能力が進化するにつれて、セキュリティチームがプロセスを再検討し再発明するための指針となります。