虎嗅

AIエージェントの安全性に関して新しい言葉が登場しています:「Authority」(オーソラティ)

原文:AI Agent 安全正在出现一个新的词:Authority

核心内容の要約

この記事は、AIエージェント(自動的にタスクを実行できるAIアシスタント)のセキュリティ問題に焦点を当てています。従来の認証方法(「あなたが誰であるか」の確認)や権限管理(「あなたが何をすることができるか」の確認)では、AIエージェントがオペレーティングシステムを直接操作するシナリオ(支払い、データの変更、サーバーの調整など)には対応できません。なぜなら、たとえ認証と権限が正しくても、AIエージェントの具体的な行動がユーザーの意図と異なる可能性があるからです。そのため、業界では新しいセキュリティ概念である「Authority(具体的な行動の認可)」に注目が集まっています。これは既存のセキュリティシステムを補完し、「この具体的な行動を行うべきかどうか」に焦点を当てたものであり、AIエージェントが「補助ツール」から「本格的なアプリケーション」へと進化するための重要なセキュリティ保証です。

1. 伝統的なセキュリティモデルの盲点:「資格」のみを認識し、「行動の正誤」は認識しない

伝統的なセキュリティシステムは、会社が従業員に出入りカードを発行するようなものです。つまり、あなたが会社の従業員であることを確認し、該当するエリアへのアクセス権限を与えますが、その日にそのドアを開ける目的が仕事であるかどうかは問いません。

AIエージェントの登場により、この盲点が拡大しました。例えば、支払い権限を持つAIエージェントがプログラムの誤りにより「供給業者Aに3万円を支払う」ことを「供給業者Bに5万円を支払う」と誤って実行する可能性があります。認証と権限は正しいものの、行動が間違っています。従来のセキュリティシステムは「支払い権限があるかどうか」のみをチェックし、「その支払いが正しいかどうか」はチェックしません。そのため、このような誤りが直接発生するのです。

2. Authorization vs Authority:「何ができるか」と「今回それを行うことができるか」の違い

多くの人がこれら2つの言葉を混同しがちですが、実際にはその核心は異なります:

  • Authorization(権限):「何かを行う能力のリスト」です。例えば、財務部門には支払いインターフェースを呼び出す権限があり、エンジニアにはサーバーを操作する権限があります。
  • Authority(具体的な行動の認可):「今回その行動を行うことが許可されているかどうか」です。例えば、財務AIエージェントはユーザーが明確に「供給業者Aに3万円を支払う」と指示した場合にのみ支払いを実行できます。自ら勝手に支払いを開始した場合、たとえ権限があっても拒否されます。簡単に言えば、前者は「資格証明書」であり、後者は「単一の行動のためのパス」です。

3. AIエージェントが問題を引き起こす理由:「人的なバッファー」がなくなったから

以前は、権限と実際の実行の間に「人」によるバッファーがありました。例えば、財務部門が支払い権限を得た後、請求書や金額、受取人を確認し、問題がなければ確認ボタンをクリックします。このバッファーが多くの誤りを防いでいました。

AIエージェントの価値は「自動化」にあります。つまり、人の確認を飛ばして「タスクの受け取り」から「行動の実行」までを一気に行います。権限と実行の間のバッファーがなくなり、以前は人によって防がれていた誤りが直接実際の損失につながるのです(例えば、誤ってお金を送金したり、サービスを停止したりする)。

4. Authorityの本質:「人を信じる」から「システムのルールを信じる」へ

以前は、「この行動を行うべきかどうか」は人が常識を使って判断していました。しかし、人が実行プロセスから外れた今、その判断はシステムが理解できるルールに変わらなければなりません:

  • タスクの束縛:AIエージェントはユーザーが明確に認可したタスクのみを実行できます(例えば「供給業者Aの請求書を処理する」)。範囲を超える行動は直接拒否されます。
  • リアルタイムのコンテキストチェック:支払い時には、受取人が指定された供給業者であるか、金額が請求書と一致しているか、期限が過ぎていないかを確認する必要があります。
  • 取り消し可能なメカニズム:ユーザーがタスクに誤りがあると気づいた場合、いつでもAIエージェントの実行を中止できるようにする必要があります。

これは、セキュリティ管理が「ある人が誤った行動をしないと信じる」から、「このルールが誤った行動を防げると信じる」へと変わることを意味します。

5. AuthorityはAIエージェントが本格的な環境に進出するための「鍵となる障壁」

現在、多くのAIエージェントはまだ「補助段階」(レポートの作成やデータの検索など)に留まっており、誤りが発生しても書き直せば済みます。しかし、「本格的な操作」(自動支払い、クラウドサーバーの管理、物理デバイスの制御など)を行う場合、誤りのコストは非常に高くなります(例えば、100万円を誤って送金したり、システム全体を停止させたりする)。

このような場合、成熟したAuthorityメカニズムの有無が「使用できるかどうか」の鍵となります。企業はAIエージェントの各行動が「今回それを行うべきかどうか」のチェックを経ていることを確認する必要があります。したがって、AuthorityはAIエージェントが「実験室」から「実際のビジネス」へと進むための分岐点です。

最後に

Authorityが業界標準の用語になるとは限りませんが、その背後にある論理は非常に重要です。セキュリティの最終目標は「あなたにどのような権限があるか」ではなく、「この行動が実際に行われるべきかどうか」です。AIエージェントの普及により、セキュリティの焦点を「主体の資格」から「具体的な行動の合理性」へと移す必要があります。これは将来のAIセキュリティの核心的な方向性の一つです。