PurviewでChatGPT Enterpriseのプロンプトと応答をスキャンする方法|必要条件と24時間遅延

Microsoft Purviewでは、ChatGPT Enterprise connectorとOpenAIのCompliance APIを利用し、組織内のChatGPT Enterpriseで送受信されたテキストプロンプトと応答をスキャンできます。取り込んだデータは、機密情報の検出、監査、eDiscovery、保持管理、インサイダーリスク調査などに活用できます。

ただし、この機能はプレビューであり、リアルタイム監視ではありません。ChatGPT Enterpriseで発生した会話は、OpenAI側のAPI制限により発生から24時間後に取り込まれます。そのため、「機密情報を入力した瞬間に検知してブロックする仕組み」としては使えません。導入時は、ChatGPT Enterpriseの契約だけでなく、Enterprise版Microsoft Purview、従量課金、収集ポリシー、Compliance APIのreadスコープ、Azure Key Vaultなどを事前に準備する必要があります。(Microsoft Learn)

目次

PurviewでChatGPT Enterpriseをスキャンすると何ができるのか

ChatGPT Enterprise connectorは、ChatGPT EnterpriseワークスペースをMicrosoft Purview Data Mapのデータソースとして登録し、Compliance API経由で会話データを取り込む機能です。

基本的なデータの流れは次のようになります。

段階処理内容
ChatGPT Enterpriseユーザーがプロンプトを送信し、ChatGPTが応答する
OpenAI Compliance APIワークスペースのログやメタデータを外部サービスへ提供する
ChatGPT Enterprise connectorPurviewがCompliance APIへ接続する
Microsoft Purview Data Mapデータソースとして登録し、スキャンを実行する
DSPM for AI・Activity Explorerプロンプト、応答、検出された機密情報を確認する
Purview各ソリューションeDiscovery、保持管理、Communication Complianceなどで利用する

OpenAIのCompliance Platformは、ChatGPTワークスペースのログやメタデータを、eDiscovery、DLP、SIEMなどの外部システムへ連携するための基盤です。Microsoft Purviewは、その連携先の一つとして案内されています。(OpenAI Help Center)

スキャン対象はテキストのプロンプトと応答

Microsoft PurviewがChatGPT Enterpriseソースから抽出できる主な情報は、次の2つです。

  • ユーザーが入力したテキストプロンプト
  • ChatGPT Enterpriseが生成したテキスト応答

一方、生成AIへ共有したファイルについては、収集ポリシーによるAIコンテンツキャプチャの対象にファイル本文が含まれません。したがって、添付ファイルの内容まで同じ仕組みで完全に取り込めるとは考えず、プロンプトと応答のテキスト監査を中心とした機能として設計する必要があります。(Microsoft Learn)

対応しているスキャン機能

ChatGPT Enterpriseソースで対応する機能は次のとおりです。

機能対応状況
メタデータ抽出対応
フルスキャン対応
増分スキャン対応
分類対応
スコープ付きスキャン非対応
ラベル付け非対応
アクセスポリシー非対応
データ系列・Lineage非対応
データ共有非対応
ライブビュー非対応

プロンプトと応答から機密情報を分類することはできますが、ChatGPTの会話へ秘密度ラベルを直接付けたり、Data MapのアクセスポリシーでChatGPT側の利用権限を制御したりする機能ではありません。(Microsoft Learn)

ChatGPT EnterpriseをPurviewへ接続する条件と24時間の取り込み遅延

ChatGPT Enterpriseのデータソースを登録する前に、アカウント、権限、課金、API認証、収集ポリシーを準備します。

必要なアカウントと設定

必要項目内容確認ポイント
Azureアカウント有効なAzureサブスクリプションが必要Key Vaultと従量課金に利用できるか
Microsoft PurviewEnterprise版のPurviewアカウントが必要対象Purviewアカウントを開けるか
Purview権限Data Source AdministratorとData Readerが必要登録先コレクションで付与されているか
ChatGPT契約ChatGPT Enterpriseプランが必要個人版やBusiness版と混同していないか
従量課金PurviewのPay-as-you-goを有効化Microsoft 365テナントとAzureサブスクリプションの関連付けを確認
収集ポリシーEnterprise AIアプリのプロンプトと応答を収集できるポリシーコンテンツキャプチャが有効か
Compliance APIキー少なくともreadスコープが必要OpenAI側でスコープが付与されているか
Azure Key VaultAPIキーをシークレットとして保存Purviewからシークレットを参照できるか
Workspace IDChatGPT EnterpriseワークスペースのID別ワークスペースのIDを指定していないか
登録済みデータソースData MapへChatGPT Enterpriseソースを登録ドメインとコレクションが正しいか

Data Source Administratorはデータソースやスキャンを管理するロールです。ただし、新しいスキャンルールの作成にはData ReaderまたはData Curatorも必要になるため、Microsoftの手順ではData Source AdministratorとData Readerの両方が前提とされています。(Microsoft Learn)

Purviewの従量課金を有効にする

ChatGPT Enterpriseのスキャンは、Microsoft Purviewの従量課金モデルの対象です。従量課金では、Microsoft 365テナントを有効なAzureサブスクリプションへ関連付け、利用した機能や処理量に応じてAzure側で料金が発生します。

スキャン後に利用するソリューションによっても課金単位が異なります。例えば、監査では処理した監査レコード数、Communication Complianceではスキャンしたテキストレコード数、Data Lifecycle Managementでは保持対象となるプロンプトと応答の数などが料金計算に関係します。具体的な単価や適用条件は変更される可能性があるため、本番導入前に最新のPurview料金情報を確認してください。(Microsoft Learn)

会話は発生から24時間後に取り込まれる

ChatGPT Enterprise connectorで最も注意すべき制約が、24時間の取り込み遅延です。

例えば、月曜日の10時にユーザーが顧客情報を含むプロンプトを送信した場合、その会話がCompliance API経由で取り込み可能になるのは火曜日の10時以降です。さらに、Purviewのスキャン実行時刻や内部処理によって、Activity Explorerなどへ表示される時刻が後ろにずれる可能性もあります。

これはスキャン設定の不具合ではなく、MicrosoftがOpenAI APIの現在の制限として案内している仕様です。(Microsoft Learn)

したがって、用途ごとの適性は次のように整理できます。

利用目的適性
過去のChatGPT利用状況を監査する適している
機密情報を含む会話を調査する適している
訴訟や内部調査に備えて保持する適している
利用傾向やリスクをレポート化する適している
入力と同時に管理者へ通知する単体では不向き
機密情報の送信前にブロックする単体では対応できない
インシデントをリアルタイム検知する単体では不向き

送信時点での警告やブロックが必要な場合は、ChatGPT Enterprise connectorだけに依存せず、Endpoint DLPや管理対象ブラウザーでのDLP制御などを併用する必要があります。Microsoft Purviewには、生成AIサイトへの機密情報の貼り付けやアップロードを監査、警告、ブロックする別の仕組みがあります。(Microsoft Learn)

Data Mapのコレクションと収集ポリシーを混同しない

設定時に特に混同しやすいのが、Data Mapの「コレクション」と「収集ポリシー」です。名前は似ていますが、役割は異なります。

項目役割
Data Mapのコレクションデータソースや資産を階層化し、アクセス権限を管理する
収集ポリシーどのイベントやプロンプト、応答をPurviewへ取り込むかを決める

ChatGPT Enterpriseのデータソース登録時には、所属させるドメインとコレクションを指定します。一方、プロンプトと応答の収集には、Enterprise AIアプリを対象とした収集ポリシーが必要です。

Data Mapへソースを登録しただけでは、収集ポリシーの設定が不足している可能性があります。スキャンが成功してもプロンプトや応答が期待どおり表示されない場合は、両方を別々に確認してください。(Microsoft Learn)

Purview Data MapへChatGPT Enterpriseを接続する手順

Compliance APIキーにreadスコープを付与する

PurviewがChatGPT Enterpriseワークスペースから会話を取得するには、Compliance APIへアクセスできるAPIキーが必要です。Purviewによるスキャンには、少なくともreadスコープを付与します。

Microsoft Learnに記載されている手順では、APIキー作成時にCompliance APIのスコープを直接指定できないため、OpenAIサポートへ次の情報を送信し、スコープ付与を依頼します。

  • APIキー末尾4桁
  • Key Name
  • Created By Name
  • 希望するスコープ
  • read、delete、またはその両方

Purviewで取得処理だけを行う場合は、必要最小限となるreadスコープを選びます。不要なdeleteスコープを付けないことが、最小権限の原則に沿った設定です。(Microsoft Learn)

Compliance APIやキー発行の手順は変更される可能性があります。プレビュー環境で構築する際は、Purview側のMicrosoft Learnと、ログイン後に表示できるOpenAIのCompliance APIドキュメントを併せて確認してください。OpenAI側では2026年に会話ログ基盤の更新も行われています。(OpenAI Help Center)

APIキーをAzure Key Vaultへ保存する

APIキーの値は、Purviewの画面へ直接固定保存するのではなく、Azure Key Vaultのシークレットとして管理します。

Azureポータルで次の設定を行います。

  1. ChatGPT Enterprise連携用のKey Vaultを作成する
  2. Key Vault Administratorなど、管理に必要なロールを割り当てる
  3. Purviewからシークレットを読み取る主体へKey Vault Secrets Userなどの権限を付与する
  4. APIキーをシークレットとして登録する
  5. 必要に応じてKey Vaultのアクセスポリシーを設定する
  6. シークレット名とバージョンを控える

本番環境では、他システムと同じAPIキーを使い回さず、Purview連携専用のキーとシークレットを用意するのが安全です。キーを更新した後は、Purview側で参照するシークレットバージョンも確認します。Microsoftの登録手順でも、Key Vaultの作成、ロール割り当て、シークレット作成、アクセスポリシー設定が必要とされています。(Microsoft Learn)

ChatGPT Enterpriseをデータソースとして登録する

Microsoft Purview governance portalで、ChatGPT EnterpriseワークスペースをData Mapへ登録します。

  1. Azureポータルで対象のMicrosoft Purviewアカウントを開く
  2. 「Open Microsoft Purview governance portal」を選択する
  3. 左側メニューから「Data Map」を開く
  4. 「Data source」を選択する
  5. 「Register data source」を選択する
  6. データソース一覧から「ChatGPT Enterprise」を選択する
  7. 「Continue」を選択する
  8. データソース名を入力する
  9. ChatGPT EnterpriseのWorkspace IDを入力する
  10. 所属させるドメインとコレクションを選択する
  11. 「Register」を選択する

データソース名には、環境と対象が判別できる名前を付けます。

例として、次のような命名にすると運用しやすくなります。

chatgpt-enterprise-production
chatgpt-enterprise-pilot
chatgpt-enterprise-japan

複数のChatGPT Enterpriseワークスペースを運用している場合は、Workspace IDの取り違えに注意してください。特に検証環境と本番環境を分けている組織では、登録前にChatGPT Enterprise管理者とIDを相互確認します。(Microsoft Learn)

Key Vaultを参照する資格情報を作成する

データソースを登録したら、Purview Data MapからAzure Key VaultのAPIキーを参照する資格情報を作成します。

  1. Data Mapの「Source management」を開く
  2. 「Credentials」を選択する
  3. 「New」を選択する
  4. 資格情報の名前と説明を入力する
  5. 対象ドメインを選択する
  6. Authentication methodで「API key」を選択する
  7. ChatGPT Enterprise用のAzure Key Vaultを選択する
  8. シークレット名を入力する
  9. 必要に応じてシークレットバージョンを指定する
  10. 資格情報を保存する

シークレット名の入力ミスだけでなく、Key Vaultの選択ミスやシークレットバージョンの不一致でも接続テストに失敗します。

Key Vaultのシークレットを更新する運用では、Purviewが特定バージョンを参照しているのか、常に最新バージョンを参照する構成なのかを確認してください。(Microsoft Learn)

Enterprise AIアプリ用の収集ポリシーを設定する

ChatGPT Enterpriseのプロンプトと応答を取り込むには、収集を許可するポリシーを準備します。

Microsoftは、次のいずれかの方法を案内しています。

  • DSPM for AIのワンクリックポリシーを使用する
  • Microsoft Purview Data Loss PreventionでEnterprise AIアプリ向けの収集ポリシーを作成する

ワンクリックポリシーでは、「Capture interactions for enterprise AI apps」に相当するポリシーを利用できます。このポリシーは、ChatGPT EnterpriseなどのEnterprise AIアプリからプロンプトと応答を収集し、eDiscoveryやData Lifecycle Managementなどで管理できるようにするものです。(Microsoft Learn)

手動で収集ポリシーを作成する場合は、次の点を確認します。

  • データソースとしてEnterprise AIを選択している
  • AIインタラクションのコンテンツキャプチャが有効になっている
  • プロンプトと応答の全文を収集する場合、「Content contains classifiers」が「All」になっている
  • 対象範囲が検証対象のユーザーや組織要件に合っている
  • 不要なイベントまで大量に収集する設定になっていない

コンテンツキャプチャを有効にしない場合、取得できる情報が検出された機密情報に限定され、プロンプトや応答の本文が表示されないことがあります。(Microsoft Learn)

ChatGPT Enterpriseワークスペースのスキャンを作成する

資格情報と収集ポリシーを準備したら、登録済みのChatGPT Enterpriseデータソースに対してスキャンを作成します。

  1. Data Mapの「Sources」を開く
  2. 登録済みのChatGPT Enterpriseワークスペースを選択する
  3. 「New scan」を選択する
  4. スキャン名を入力する
  5. 「Capture data since」で取得開始日を指定する
  6. Key Vaultへマッピングした資格情報を選択する
  7. ドメインを選択する
  8. コレクションを選択する
  9. 「Test connection」を実行する
  10. 接続成功を確認して「Continue」を選択する
  11. 設定内容を確認する
  12. 「Save and Run」を選択する

「Capture data since」では、新しいスキャンを作成した日から取得するか、過去の特定日から取得するかを選択できます。過去データを取り込む場合は、必要以上に古い日付を設定せず、調査、法令、社内保持ルールに必要な期間を基準に決めます。(Microsoft Learn)

2回目以降は増分スキャンを使う

初回の取り込み後は、増分スキャンを利用します。

Microsoftは、将来のスキャンでは新しいスキャンを毎回作るのではなく、既存スキャンの増分実行を推奨しています。新しいスキャンを繰り返し作成すると、データが重複して取り込まれる可能性があります。(Microsoft Learn)

運用上は、次のように役割を分けると分かりやすくなります。

スキャン用途
初回スキャン指定した開始日以降のデータを取り込む
増分スキャン前回以降に追加された会話を取り込む
新しいスキャンワークスペース、資格情報、取得範囲を明確に分ける場合に限定する

スキャン結果を確認する方法

既存のスキャン結果は、Data Mapのデータソース画面から確認できます。

  1. Microsoft Purviewポータルで「Data Map」を開く
  2. ChatGPT Enterpriseのデータソースを選択する
  3. 「Recent scans」または「Scans」タブを開く
  4. 確認するスキャンを選択する
  5. ステータス、実行履歴、取り込み件数などを確認する
  6. Scan IDを選択して詳細を表示する

取り込まれたAIインタラクションは、DSPM for AIやActivity Explorerから確認できます。

主な確認項目は次のとおりです。

  • AIインタラクションの発生状況
  • ユーザーが入力したプロンプト
  • ChatGPT Enterpriseの応答
  • プロンプトや応答から検出された機密情報の種類
  • インサイダーリスクに関係するアクティビティ
  • スキャンステータスと処理件数

さらに、構成やライセンスに応じて、Communication Compliance、Data Lifecycle Management、eDiscovery、Insider Risk Management、Records Managementなどでも取り込んだデータを利用できます。(Microsoft Learn)

分類済み資産数が1件少なくても異常とは限らない

スキャン詳細では、取り込まれた資産数と分類済み資産数が一致しない場合があります。

ChatGPT Enterpriseのスキャンでは、組織自体も一つの資産として扱われますが、その組織資産は分類されません。そのため、Microsoftは分類済み資産数が取り込み済み資産数より常に1件少なくなると説明しています。

件数が1件だけ違う場合は、直ちに取り込み失敗と判断せず、この仕様を確認してください。(Microsoft Learn)

プロンプトと応答が表示されないときの確認ポイント

症状主な原因対処
会話直後に結果が表示されない24時間の取り込み遅延発生から24時間後と次回スキャン後に再確認する
接続テストに失敗するAPIキーやKey Vault設定の誤りシークレット名、バージョン、権限を確認する
401・403系の認証エラーになるCompliance APIのreadスコープ不足APIキーのスコープ付与状況を確認する
別の組織のデータが対象になるWorkspace IDの指定ミスChatGPT管理者とIDを再確認する
スキャンは成功するが本文がない収集ポリシーのコンテンツキャプチャが無効収集ポリシーとclassifier条件を確認する
同じ会話が重複する新しいスキャンを繰り返し作成した既存スキャンの増分実行へ切り替える
分類件数が取り込み件数より1件少ない組織資産が分類されない仕様1件差であれば仕様として確認する
添付ファイルの本文が見つからないAIコンテンツキャプチャは共有ファイル本文を含まない別のファイル監査・DLP手段を検討する
ChatGPTの項目が選択できないEnterprise版以外を利用している契約プランと対応コネクタを確認する
スキャンを開始できないPurview従量課金が無効Azureサブスクリプションとの関連付けを確認する

プレビュー機能では、ポータルの画面名やAPI認証手順が更新される可能性があります。接続エラーが発生した場合は、古い手順をそのまま繰り返すのではなく、Microsoft LearnとOpenAIのCompliance APIドキュメントを確認することが重要です。

本番導入で失敗しない運用設計

最初は対象期間を絞って検証する

初回から長期間の全会話を取り込むのではなく、数日から数週間程度のデータで検証します。

検証では、意図的に次のようなテストプロンプトを送信すると確認しやすくなります。

機密情報検出の動作確認用です。
テスト顧客番号: TEST-123456

実在する個人情報や顧客情報は使用せず、架空のテストデータを使います。

確認する項目は次のとおりです。

  • 24時間後に会話が取り込まれるか
  • プロンプトと応答の両方が表示されるか
  • 期待する機密情報タイプが検出されるか
  • 対象外ユーザーのデータが含まれていないか
  • 増分スキャンで重複が発生しないか
  • 想定する管理者だけがデータを閲覧できるか

APIキーと閲覧権限を最小化する

ChatGPTのプロンプトには、業務上の相談、顧客名、契約情報、ソースコード、従業員情報などが含まれる可能性があります。取り込んだ後のデータ自体が高い機密性を持つため、閲覧権限を広く付与しないことが重要です。

特に次の点を徹底します。

  • APIキーには必要最小限のreadスコープだけを付与する
  • APIキーをKey Vault以外の設定資料やメールへ記載しない
  • 本番用と検証用のキーを分ける
  • Data Readerを必要な担当者に限定する
  • コレクション単位でアクセス範囲を分離する
  • キー更新後に接続テストを実施する
  • 退職者や異動者のPurview権限を定期的に棚卸しする

リアルタイム対策と事後監査を分ける

ChatGPT Enterprise connectorは、事後監査とコンプライアンス管理に向いています。一方、情報送信前の制御には向いていません。

実務では、次のように役割を分けると効果的です。

制御のタイミング主な対策
入力前利用ガイドライン、ユーザー教育、秘密度ラベル
送信時Endpoint DLP、ブラウザー制御、警告・ブロック
24時間後以降ChatGPT Enterprise connectorによるスキャン
事後調査Activity Explorer、eDiscovery、Insider Risk Management
長期管理Data Lifecycle Management、Records Management

「Purviewへ取り込んでいるから情報漏えいを防げる」と考えるのではなく、送信前の予防策と送信後の監査を組み合わせることが重要です。

PurviewとChatGPT Enterpriseの接続を始めるための確認事項

PurviewでChatGPT Enterpriseのプロンプトと応答をスキャンするには、次の順番で準備するとスムーズです。

  1. ChatGPT Enterpriseの契約とWorkspace IDを確認する
  2. Enterprise版Microsoft PurviewとAzureサブスクリプションを準備する
  3. Purviewの従量課金を有効にする
  4. Data Source AdministratorとData Readerを割り当てる
  5. Compliance APIキーへreadスコープを付与する
  6. APIキーをAzure Key Vaultへ保存する
  7. ChatGPT EnterpriseをData Mapへ登録する
  8. Key Vaultを参照する資格情報を作成する
  9. Enterprise AIアプリ用の収集ポリシーを設定する
  10. 接続テスト後に初回スキャンを実行する
  11. 24時間後以降にActivity Explorerで結果を確認する
  12. 以後は増分スキャンで運用する

最大の注意点は、会話がリアルタイムではなく、発生から24時間後に取り込まれることです。まずは短い対象期間と少人数の検証環境で接続し、取り込み遅延、収集ポリシー、閲覧権限、従量課金を確認してから、本番ワークスペースへ展開してください。

この記事を書いた人

実務の現場で詰まりがちなポイントを地図にするITブログ「IT trip」を運営。Windows/Office(Teams・Excel)からSQL、サーバ運用、ガジェットまで、再現性のある手順と“なぜそうなるか”を丁寧に解説します。読んだらすぐ試せること、そして迷った人の次の一歩が見えることを大切にしています。

コメント

コメントする

目次