AIエージェントの活用は、個人が試す段階から、組織全体で使いこなし、その成果を求められる段階へと移りつつあります。しかし実際には、一部の詳しい社員が、限られた環境と機能の範囲で使うにとどまっている企業が少なくありません。全社へ広げようとしたとき、これらの課題が表面化します。
AIエージェントのセキュリティ/ガバナンスリスクに、既存の対策だけでは対応しきれない。
AIエージェント/プラットフォームの進化が速く、セキュリティ対策や統制が追随できない。
プラットフォームごとに設定が異なるため一貫した管理ができず、危険な状態が放置されていても気づけない。
インシデント発生時に、原因や影響範囲を特定できないうえ、適正な状態に戻せない。
不確実性をなくすためにAIエージェントの判断や行動を一律に制限すれば、生み出せる価値も狭まります。一方で、その判断や行動が情報漏洩や誤操作につながるリスクは、放置できません。目指すべきは、必要な自律性を保ったまま、アクセス権限や実行時の行動を適切に制御し、リスクを抑えながら活用範囲を広げられる状態をつくることです。高い自律性と、業務に必要な幅広いデータ・ツールへのアクセスこそが、大きな価値を生みます。
構成・権限・設定の状態を把握し、問題を検知する。実行される前に、危険な組み合わせをなくす。
一連の行動監視し、実行の途中で介入する。ポリシーに反するアクションを制御し、被害を防ぐ。
Citadel Radar for Agents は、生成AIアプリケーション向けの Citadel Radar を、AIエージェントへ広げた製品です。ポスチャー管理とセッションマネジメントから成り立っています。
ポスチャー管理は各エージェントが「何ができる状態か?」を可視化し、設定不備を是正できます。
セッションマネジメントは、エージェントの一連の行動を監視し、「いま実行する行動」を制御することに加え、「実行した行動」をすべて記録します。つまり、ポスチャー管理で隙をなくし、セッションマネジメントで万が一のリスクに備えられます。
改善ループ — 実際に起きたリスクを、設定・権限・ツール接続の改善につなげる
何ができる状態かを可視化し、
設定不備を是正する
一連の行動を監視して制御し、
実行した行動をすべて記録する
改善ループ — 実際に起きたリスクを、設定・権限・ツール接続の改善につなげる
モデル・エージェント・ツールを棚卸し
危険な設定と過剰な権限を発見
セッションを監視し、不正な行動を制御
原因と影響範囲を特定
台帳を自動で作成
モデル、エージェント、ツール(MCPサーバなど)の資産棚卸し
稼働しているエージェントだけでなく、作成された後に放置されたエージェントも可視化する。
エージェントごとの設定・権限・アクセス範囲の診断
過剰な権限付与、MCPサーバへの過剰な接続、機密データへの接続などの設定不備を発見する
ポリシー準拠チェック
設定した共通ポリシーへの適合を継続的に確認する
是正箇所の提案
修正すべきポイントをリスクスコアリングとともに提案する

セッション文脈を踏まえた制御
会話やツール実行の履歴をセッション単位で捉え、文脈に基づくガードレールを適用します。単発では安全に見える操作の連鎖を監視し、ポリシー違反を検出する
情報漏洩の阻止
ツールの入出力に含まれる機密情報やAPIキーを検知し、流出前にブロックする
危険なツール利用・不正なエージェント行動の防止
エージェントの意図と行動を評価し、安全でないツール操作やポリシー違反をリアルタイムで止める
マルチプラットフォーム共通ポリシー設定
プラットフォームごとの設定差分を意識することなく、一貫したポリシーを適用する
標準・カスタムガードレール間接プロンプトインジェクション、ツールポイズニング、機密データ漏洩、権限・目的の逸脱を検出する。業務に応じたカスタムガードレールを、自然言語で定義できる
直感でインシデントを分析できるUX
インシデント時に直感的に理解・操作できるUXを提供する。リスクの解説と必要な対応の選択を支援するガイド機能を備える

エージェント台帳
利用中のエージェントの情報だけでなく、「何を、どの基準で統制しているか」を監査・経営・リスク部門に説明できるエージェント台帳を自動で作成する
改善ループ
実際に起きたリスクを、エージェントの設定・権限・ツール接続の改善につなげる
継続的な対応と追随
さまざまなエージェントプラットフォームに対応し、各プラットフォームのアップデートにも追随する
※ 記載の機能には開発中のものが含まれます。提供時期および内容は予告なく変更される場合があり、将来の提供を保証するものではありません。
端末にセンサーを配る必要も、ネットワークプロキシを導入する必要も、既存のセキュリティ製品を入れ替える必要もありません。現在稼働中のシステム環境を変更せずに、対象のエージェントやプラットフォームをひとつずつ増やしていけます。
管理画面から対象のプラットフォームを認可する。センサーの配布も、エージェントへのID発行も不要。
ポスチャーを可視化し、リスクの高い構成を洗い出す。何が、どんな権限で動いているかを一覧にする。
介入ポイントにポリシーを適用し、セッションを記録・評価する。対象を一つずつ広げていく。
エージェントの利用に伴うリスクをコントロールし、セキュリティを高める製品です。各エージェントが「何ができる状態か」を可視化するポスチャ管理と、「実行中の行動」を監視・制御するセッション管理で構成されています。特定のプラットフォームに閉じず、いま動いているITインフラを入れ替えずに導入できる点が特徴です。
対応プラットフォームは順次拡大しています。最新の対応状況についてはお問い合わせください。
可能です。管理画面からの接続とAPI連携だけで動く方式のため、全社的な基盤の整備を待たずに、部門で使用しているエージェントのプラットフォームから始められます。端末へのセンサー配布やエージェントへのID発行が不要なので、情報システム部門の大きな作業を伴いません。
Citadel Radar は、生成AIアプリケーションのプロンプトとレスポンスを1件ずつ評価し、リスクに応じてブロックまたはフラグ付けする製品です。
Citadel Radar for Agents は、この仕組みをAIエージェントへ拡張します。評価の単位が、1回のやり取りから、エージェントが1つのタスクを終えるまでの一連の行動、つまりセッションに変わります。単体では問題のないアクションでも、一連のアクションの流れとして見るとガードレールに検出される場合があります。さらに、エージェントの実行アクションを見るだけでなく、各アクションを引き起こした設定や権限、ツール接続がそもそも適切かどうかも、ポスチャーマネジメントとして継続的に点検します。