ナレッジ ソースとしての非構造化データ

注:

この記事の機能は標準ハーネスを利用しており、標準ハーネスを利用するエージェントのライセンスで説明されている請求オプションを使用します。 Access標準エージェントおよびエージェントフローで標準機能にアクセスする方法を学びましょう。

Copilot Studio を使用すると、Power Platform コネクタを使用して構築したのと同じ信頼できる使い慣れたデータ ソースを利用して、ドメイン固有の知識を持つエージェントを強化できます。

デバイス、OneDrive、またはSharePointから外部コンテンツをアップロードすると、ビジネスに合わせたコンテキストに応じた知識でエージェントを強化できます。 Microsoft Dataverseこれらのファイルを安全に格納し、セマンティック インデックスとベクター埋め込みにそれらを自動的に処理します。 この構成により、エージェントは、指定した情報に基づいて、より正確で根拠のある応答を生成できます。

Copilot Studio でアップロードされたファイルは、Microsoft Dataverse を使用して生ファイルを取り込み、インデックスとベクター埋め込みを作成します。 これらのインデックスや埋め込みは、エージェントに質の高い回答を提供するのに役立ちます。 これらのファイルは、コンピューターからアップロードするか、OneDriveまたはSharePointに接続してアップロードできます。

データを知識ソースとしてアップロードすることで、エージェントに追加データを提供し、言語モデルの知識を補強し、提供した特定の情報にエージェントを根付かせることができます。 さまざまなファイルをアップロードできます。システムはセマンティックにベクター埋め込みとしてインデックスを作成し、エージェントのナレッジとして使用します。 この知識は、エージェントの認証済みユーザーおよび非認証済みユーザーと共有できます。

エージェントの作成者とエージェントのユーザー間の相互作用、およびナレッジ ソースがユーザーに提供する情報を取得する方法を示す図。

エージェントの応答を改善するために、システムはアップロードしたファイルを分割して処理速度を速くし、ベクターインデックス化してユーザーのクエリと意味的一致を提供します。 システムはファイルをDataverseに安全に保存します。 ユーザーがエージェントを使用してクエリを実行すると、Copilot Studio はユーザー クエリの意図に一致する最も関連性の高いチャンクを検索し、その結果をユーザーに返します。 

同様に、Dataverse では、ファイルアップロードのオプションを使用して OneDrive ファイルと SharePoint ファイルが取り込まれます。 また、Salesforce、ServiceNow、Confluence、Zendesk のナレッジ ベース記事などの非構造化コンテンツも取り込んで、エージェントのセマンティック結果を向上します。

注:

詳細については、「 コード インタープリターを使用して構造化データを分析する」を参照してください。

非構造化データ用の Power Platform コネクタ

次の Power Platform コネクタは、 非構造化データ ソースと連携します。

OneDrive

ファイル セレクター インターフェイスで [OneDrive > ファイルのアップロード ] オプションを使用して、含めるファイルとフォルダーを選択します。 選択されると、システムはアイテムをDataverseに取得し、使用のためにインデックス化します。 追加するフォルダには、サポートされているすべてのファイルとそのフォルダ内のサブフォルダが、 合計ファイルの上限まで含まれます。

Sharepoint

[SharePoint >ファイルのアップロード] オプションを使用して、ファイル セレクター インターフェイスを使用してファイルとフォルダーを選択します。 これらの項目を選択すると、コネクタはそれらを Dataverse に取得し、使用するためにインデックスを作成します。 フォルダーを追加するときは、サポートされているすべてのファイルとサブフォルダーを、ファイルの 合計制限までそのフォルダー内に含めます。 現時点では、コネクタは Pages をサポートしていません。

注:

SharePoint をナレッジ ソースとして使用する場合、Copilot Studio では、AllItems.aspxなどのリスト ビューを直接読み取るのではなく、 SharePoint 検索インデックスを使用してコンテンツを取得します。 新しく追加または更新された SharePoint アイテムは、検索インデックス作成が完了するまでエージェントで使用できない場合があります。 エージェントに必要なアクセス許可 ( Sites.Read.AllFiles.Read.Allなど) があり、コンテンツがサポートされているファイル形式で格納されていることを確認します。

Salesforce

非構造化データ用の Salesforce コネクタでは、ナレッジ記事を含むナレッジ ベースの取得がサポートされています。 ナレッジ ベースを選択すると、コネクタによってそのナレッジ ベース内のすべての記事のインデックスが作成されます。 個別の記事やトピックを選ぶことはできません。 データをクエリする際には、特定の記事やナレッジベースを指定することはできません。 ナレッジ リストには、ソースの作成時に選択したすべてのナレッジ オブジェクトに対して 1 つのオブジェクトが表示されます。

ServiceNow

非構造化データ用の ServiceNow コネクタでは、ナレッジ 記事を含むナレッジ ベースの取得がサポートされています。 ナレッジベースには記事が含まれています。 ナレッジ ベースを選択すると、コネクタによってそのナレッジ ベース内のすべての記事のインデックスが作成されます。 個別の記事を選ぶことはできません。 データをクエリする際には、ナレッジベース、フォルダ、個別の記事を指定することはできません。 ナレッジ リストには、ソースの作成時に選択したすべてのナレッジ オブジェクトに対して 1 つのオブジェクトが表示されます。

Confluence

非構造化データ用の Confluence コネクタは、ページを含むスペースの取得をサポートしています。 コネクターはサブフォルダもサポートしています。 個別のページを選ぶことはできません。 データをクエリする際にページを指定することはできません。 ナレッジ リストには、スペース内のすべてのページに対して 1 つのオブジェクトが表示されます。

Zendesk

非構造化データ用の Zendesk コネクタは、ナレッジ記事を含むナレッジ ベースの取得をサポートしています。 個別の記事、カテゴリー、セクションを選択することはできません。 データをクエリする際には、記事、カテゴリ、セクションを指定することはできません。 ナレッジ リストには、ナレッジ ベース内のすべてのアーティクルの 1 つのオブジェクトが表示されます。

セキュリティ

ユーザーが Power Platform Connector ソースを使用するエージェントに対してクエリを実行すると、システムは承認チェックを実行します。

コネクタのアクセス

コネクタ ベースのソースを初めて使用すると、既存の Power Platform コネクタを選択するか、追加するかを求めるメッセージが表示されます。 このプロセスにより、データ ソースにアクセスするための適切なアクセス許可を持つ作成者とのみデータを共有できるようになります。

コンテンツのアクセス

ユーザーがクエリを行うと、システムはその接続情報を使ってデータソースを確認し、コンテンツを見る権限があることを確認します。 システムはDataverseにチャンクやインデックスをローカルで保存していますが、クエリに対してリアルタイムでチェックを行い、現在のユーザーがデータにアクセスできるかどうかを確認してから要約や回答を提供します。

注:

  • 特定のファイル セットまたはナレッジ ベースの記事に対するアクセス許可がない場合、システムは結果をユーザーに返しません。 代わりに「結果は見つかりませんでした」という標準的なメッセージが届きます。ユーザーがその情報源に対して結果があると感じるなら、管理者と連携してアクセスしたいデータに対する権限を持つことを確認する必要があります。 ユーザーには、Basic User などのDataverseの適切なセキュリティロールが割り当てられる必要があります。
  • システムはコンテンツの許可情報をローカルに保存していません。 すべての許可チェックはソースからリアルタイムで実行されており、常に最新の状態にあることを確認します。

同期とファイル更新の頻度

スケジュールされた同期ジョブは、接続されたファイルをOneDriveおよびSharePointから保持し、非構造化ナレッジ記事を最新の状態に保ちます。 このジョブはバックグラウンドで自動的に実行され、ファイルの内容を更新し、変更のインデックスを再作成して、クエリの正確な結果を提供します。 更新によって、コンテンツの変更が管理されるだけでなく、ソースから削除されたコンテンツがクエリ応答の一部として表示されなくなります。 現時点では、更新を手動でトリガーすることはできません。

更新頻度のタイミングの詳細については、「Copilot Studio の非構造化データ ナレッジ ソースの制限を参照してください。

ライセンス

知識に関連するすべての要求は、Microsoft Copilot 生成応答メッセージング レートで課金されます。 詳細については、「 請求料金と管理」をご覧ください。

知識ソースがデータ取り込みを必要とする場合、データの保存およびそれを取得するためのインデックスは、顧客が持つストレージ権限に従事します。 Dataverse自然言語検索の詳細については、「 Dataverse検索によるAI搭載体験の強化」をご覧ください。

制限と制限事項

非構造化データサポートを最初に有効にすると、Dataverseは構成とインデックス作成を行い、追加ファイルを処理するまでに5分から30分かかることがあります。 時間の長さは、現在の Dataverse 環境のサイズによって異なります。

各エージェントには、最大 500 個のナレッジ オブジェクトを持つことができます。 これらのオブジェクトはファイル、フォルダ、知識記事、ウェブサイト、またはその他のソースであったことがあります。

現時点で、エージェントは同時に5つの異なる情報源しか利用できません。 たとえば、SharePoint、Dataverse、OneDrive、その他のソースなどです。

サポートされている非構造化データ ソースの特定の制限と制限の詳細については、「Copilot Studio の非構造化データ ナレッジ ソースの制限を参照してください。

注:

Copilot Studio のエージェントは、このナレッジ ソースを使用するために Dataverse 検索が必要です。 Dataverse 対応ファイルをエージェントに追加できない場合は、環境内で Dataverse 検索を有効にするように管理者に依頼してください。 Dataverse 検索とその管理方法の詳細については、「 Dataverse 検索とは」 および「環境 に対する Dataverse 検索の構成」を参照してください

Dataverse に格納されているOneDriveおよびSharePointコンテンツにアクセスするには、少なくとも Power Apps または Dynamics 365 の Basic ユーザー ライセンスが必要です。 さらに、Basic User 権限には以下のテーブルおよびエンティティの読み取り権限も含めなければなりません:

これらのアクセス許可は、Power Platform 管理センターまたは Dynamics 365 管理センターで構成できます。

FAQ

[Add knowledge]\(ナレッジの追加\) の 2 つの SharePoint オプションの違いは何ですか?

ナレッジの追加 ダイアログには、2 つのSharePointオプションが表示されます。

[ナレッジの追加] ダイアログのスクリーンショット。2 つの SharePoint オプションが強調表示されています。

ファイルアップロードセクション(1)のSharePointオプションは、個々のSharePointファイルまたはフォルダーをエージェントにアップロードすることです。 このオプションは、ファイルのコピーを SharePoint から Dataverse にアップロードし、同期関係を維持してファイルを最新の状態に保ちます。 クエリ中に、SharePointにアクセスして、コンテンツのユーザーアクセス許可を検証します。 Dataverse に格納されたファイルは、データ ストレージを使用しますが、PDF ファイルなどの特定のドキュメントの種類の画像内のテキストに対するフル ドキュメント セマンティック検索機能とサポートを提供します。

さらに、このオプションにより、権限を持つ誰でもSharePointファイルにアクセスできます。 このオプションは、ユーザーの認証情報を確認し、ファイルへのアクセス権限があるかどうかを確認してから応答を提供します。

Dataverse にアップロードされた静的ファイルではなく、高速同期が必要な場合は、オプション 1 を使用します。 ソース ファイルが変更されると、自動的に更新されます。

もう 1 つの SharePoint オプション (2) は、SharePoint コネクタを使用した Copilot Studio での完全なSharePoint統合を提供します。 完全なSharePoint コネクタ機能、カスタム認証構成、または高度なクエリ オプションが必要な場合は、このオプションを使用します。 このオプションを使うことで、エージェントはユーザーがアクセス権限を持つコンテンツのみを表示します。 ユーザーがコンテンツへのアクセス権限を持っていない場合、エージェントは「応答なし」と応答します。最低限、ユーザーはコンテンツにアクセスするためにSharePointサイトまたはリストの読み取り権限を持っている必要があります。

このSharePointオプションは、センシティブラベルもサポートしています。 ただし、エージェントはパスワード保護されたコンテンツからコンテンツを表示することはできません。

ランタイムの違い

シナリオ オプション 1: ファイルのアップロード オプション 2: SharePoint コネクタ
コンテンツ保存 SharePoint から Dataverse にコピー SharePoint 内に存在する
検索機能 SharePoint からコピーされた取り込まれたコンテンツの埋め込みベクターから構築された Dataverse セマンティック インデックスを検索します。 SharePoint 検索インフラストラクチャに直接クエリを実行する
コンテンツの鮮度 コンテンツは、インジェストの完了に基づいて 4 ~ 6 時間ごとに同期されます リアルタイムで、利用可能な最新のコンテンツを反映
SharePoint リスト サポートされている サポートされている
Dataverse ストレージの使用量 はい(コピーしたファイルと検索インデックスの場合) いいえ
高度なクエリ フィルター 該当なし タイトル、作成者、変更日、変更日でフィルター処理する
機密ラベル サポートしていません サポートされている

オプションの使用方法

次の状況では、オプション 1 を使用します。

  • SharePoint リストのサポートが必要です
  • エージェントは、特定のファイルまたはフォルダーのセットのみを使用します
  • ベクター埋め込みを利用した高品質のセマンティック検索が必要です
  • コンテンツの更新間隔は 4 ~ 6 時間で十分です

次の状況では、オプション 2 を使用します。

  • 頻繁に更新される Wiki やアナウンス サイトなど、コンテンツの同期を遅らせない
  • 特に大規模なドキュメント ライブラリの場合は、Dataverse の使用を回避する必要がある
  • 作成者、変更日、タイトルに基づくフィルター処理など、 高度なクエリ フィルターの使用

注:

どちらのオプションでも、ユーザー認証が必要です。 エージェントが SharePoint コンテンツから結果を取得する前に、ユーザーがサインインする場合があります。 Copilot Studio の非構造化データ ナレッジ ソースの制限の同期タイミングとファイル制限の詳細について説明します。

[ナレッジの追加] ダイアログの [ファイルのアップロード] セクションに SharePoint アイコンが表示されないのはなぜですか?

既存のすべての組織にソリューションが表示されるまで、ソリューションのインストール後に若干の遅延が発生します。 手動更新を開始するには、以下の手順に従ってください:

  1. 管理者認証情報を使って Power Platform管理センター にサインインしてください。

  2. サイド バーで、[管理] を選択 します

  3. 製品の一覧から Dynamics 365 Apps を選択します。

  4. poweraiextensions を検索します

  5. 3 つのドット (...Microsoft Dynamics 365 - PowerAIExtensions の) を選択し、Install を選択します。

  6. ドロップダウン メニューから環境を選択し、[ インストール] を選択します。

  7. インストールが完了したら、新しいウィンドウで Power Apps を開きます。

  8. 左側のペインでソリューションを選択します。

  9. [詳細] を選択します。

  10. PowerAIExtensions Solution Anchor のバージョンが 1.01.688 以降に設定されていることを確認します。

エージェントに 500 を超えるナレッジ オブジェクトを追加するとどうなりますか?

前のオブジェクトを削除しない限り、追加のオブジェクトは追加できません。

各エージェントには、ナレッジ ソースの独自のインデックスがありますか?

Dataverseは、あなたが作成する環境で使える知識ソースを保存します。 複数のエージェントが同じSharePoint フォルダーを使用する場合、すべてのエージェントはそのフォルダーの 1 つのインスタンスを使用します。

ファイル、フォルダー、サブフォルダーの最大数を超える SharePoint または OneDrive フォルダーを追加するとどうなりますか?

Copilot Studio は、ファイル、フォルダー、およびサブフォルダーの最大数まで取得およびインデックスを作成します。 残りの項目は処理されず、どの項目が処理されているか、処理されていないことも示されません。

追加したファイルの 1 つがナレッジ ソースの一部として表示されますが、そこから回答を得ることはできません。 Why?

この問題は、次のいずれかの理由に関連している可能性があります。

  • [ナレッジ] ページでは、ファイルまたはフォルダーは準備完了として報告されません。
  • ファイル名には、サポートされていない文字 (特に SharePoint ファイル用) が含まれています。
  • ファイルの秘密度設定が [社外秘] または [ 極秘] であるか、パスワード保護が設定されています。
  • ファイルの種類はサポートされていません。
  • ファイルまたはフォルダーは、別のユーザーの OneDrive または SharePoint サイトから取得され、ユーザーが共有しませんでした。
  • ファイルはナレッジ ベース ファイルであり、ソース システムのコンテンツを表示するために必要なアクセス許可がアカウントにありません。