AIニュース

Anthropic、Claude Enterprise向けに「Inference Hooks」を発表 送信前にプロンプトを検査するDLP機能

公開日: ・出典: Anthropic公式ブログ(Claude Blog)

Anthropicは、Claude Enterprise向けの新機能「Inference Hooks」をベータ公開しました。企業の全従業員のプロンプトを、モデルに届く前に組織自身のセキュリティサーバーへ経由させ、許可・拒否の判定を受けさせる仕組みで、メールやWeb通信に対して行われてきたようなインライン型の情報漏えい対策(DLP)を、Claudeとの対話にもそのまま持ち込めるようにするものです。

仕組みとしては、各推論リクエストが署名付きのWebSocket接続を通じて組織のセキュリティサーバーに送られ、Standard Webhooks仕様に沿って署名されるため、リクエストが確かにAnthropicから来たものかをサーバー側で検証できます。判定はデフォルトで5秒以内に返す必要があり、内容は「許可」か「拒否」の二択のみで、サーバー側がプロンプトを書き換えたり伏せ字にしたりすることはできません。対象範囲はチャットだけでなく、Claude CodeやClaude Coworkなど企業向けの全サーフェスに及びます。

既存のセキュリティ製品(Netskope、Palo Alto Networks、Proofpoint、Zscalerなど)や自社構築のAIセキュリティサーバーにそのまま接続できるほか、常時許可の「シャドウモード」やロール単位の除外設定、段階的な適用率の引き上げなど、組織のリスク許容度に合わせて安全に導入できる工夫も用意されています。生成AIの業務利用が広がる中、企業側が自らのポリシーで制御できる仕組みを求める声に応えた形です。

出典: Anthropic公式ブログ(Claude Blog)

Xでシェア