Nestrukturovaná data jako zdroj znalostí

Použitím Copilot Studio můžete vylepšit vaše agenty pomocí znalostí specifických pro doménu, které využívají stejné důvěryhodné a známé zdroje dat, které vytváříte prostřednictvím konektorů Power Platform.

Nahráním externího obsahu ze zařízení, OneDrive nebo SharePoint můžete své agenty rozšířit o kontextové znalosti přizpůsobené vaší firmě. Tyto soubory jsou bezpečně uložené v Microsoft Dataverse a automaticky se zpracovávají do sémantických indexů a vektorových vkládání. Tato konfigurace umožňuje vašim agentům generovat přesnější a fundované odpovědi na základě vámi zadaných informací.

Soubory nahrané v aplikaci Copilot Studio používají Microsoft Dataverse k ingestování nezpracovaných souborů, vytváření indexů a vkládání vektorů. Tyto indexy a vkládání pomáhají poskytovat kvalitní odpovědi vašim agentům. Tyto soubory můžete nahrát z vašeho počítače nebo připojením k OneDrive nebo SharePoint.

Nahráním souborů jako zdrojů znalostí pomáháte rozšířit své agenty o další data, rozšířit znalosti jazykového modelu a zakládat agenta na konkrétních informacích, které poskytujete. Můžete nahrávat různé soubory, které systém sémanticky indexuje jako vektorová zapouzdření a poté použije jako znalosti pro agenty. Tyto znalosti používané v agentech můžete sdílet s ověřenými a neověřenými uživateli agenta.

Obrázek znázorňující interakce mezi tvůrci agentů a uživateli agentů a tím, jak zdroje znalostí načítají informace, které mají být uživateli poskytnuty.

Aby se zlepšily odpovědi agenta, nahrávané soubory jsou systémem ukládány do částí pro rychlejší zpracování a indexovány vektorem, aby poskytovaly sémantické shody s dotazem uživatele. Soubory jsou bezpečně uložené systémem v Dataverse. Když se uživatel dotazuje prostřednictvím agenta, Copilot Studio najde nejrelevantnější bloky dat, které odpovídají záměru dotazu uživatele a vrátí výsledky uživateli. 

Podobně Dataverse zpracovává soubory z OneDrive a SharePointu pomocí možností v sekci nahrávání souborů. Ingestuje také nestrukturovaný obsah, například články znalostní báze ze Salesforce, ServiceNow, Confluence a Zendesk, aby poskytoval lepší sémantické výsledky pro agenta.

Poznámka

Další informace najdete v Použijte překladač kódu pro analýzu strukturovaných dat.

Konektory Power Platform pro nestrukturovaná data

Následující konektory Power Platform fungují s nestrukturovanými zdroji dat:

OneDrive

Použijte možnost Nahrát soubory > OneDrive s rozhraním pro výběr souborů k výběru souborů a složek, které chcete zahrnout. Po výběru systém načte položky do služby Dataverse a indexuje je pro použití. Přidané složky zahrnují všechny podporované soubory a podsložky v této složce až do celkového limitu souborů.

SharePoint

Použijte možnost Nahrát soubory > SharePoint k výběru souborů a složek prostřednictvím rozhraní pro výběr souborů. Po výběru těchto položek je konektor načte do Dataverse a indexuje je pro použití. Přidáním složek zahrnujete všechny podporované soubory a podsložky v této složce až do celkového limitu souborů. V současnosti konektor nepodporuje Pages.

Poznámka

Když používáte SharePoint jako zdroj vědomostí, Copilot Studio získává obsah prostřednictvím indexování vyhledávání SharePoint, nikoli přímým čtením zobrazení seznamů jako AllItems.aspx. Nově přidané nebo aktualizované položky SharePointu nemusí být agentovi dostupné, dokud nebude indexování vyhledávání dokončeno. Ujistěte se, že agent má požadovaná oprávnění, například Sites.Read.All a Files.Read.All, a že je obsah uložen v podporovaných formátech souborů.

Salesforce

Konektor Salesforce pro nestrukturovaná data podporuje načtení znalostní báze obsahující články znalostní báze. Vyberte Znalostní bázi a konektor indexuje všechny články v této Znalostní bázi. Jednotlivé články nebo témata nelze vybrat. Při dotazování na data není možné zadat konkrétní článek nebo znalostní bázi. Seznam znalostí zobrazuje jeden objekt pro všechny objekty znalostní báze, které vyberete při vytváření zdroje.

ServiceNow

Konektor ServiceNow pro nestrukturovaná data podporuje načtení znalostní báze obsahující články znalostní báze. Znalostní báze obsahují články. Vyberte Znalostní bázi a konektor indexuje všechny články v této Znalostní bázi. Jednotlivé články nelze vybrat. Při dotazování na data není možné zadat znalostní bázi, složku, nebo konkrétní článek. Seznam znalostí zobrazuje jeden objekt pro všechny objekty znalostní báze, které vyberete při vytváření zdroje.

Confluence

Konektor Confluence pro nestrukturovaná data podporuje získávání prostorů obsahujících stránky. Konektor také podporuje podsložky. Jednotlivé stránky nelze vybrat. Při dotazování dat nelze specifikovat stránku. Seznam znalostí zobrazuje jeden objekt pro všechny stránky v prostoru.

Zendesk

Konektor Zendesk pro nestrukturovaná data podporuje načtení znalostní bázi obsahující články znalostní báze. Jednotlivé články, kategorie nebo oddíly nelze vybrat. Při dotazování na data není možné zadat článek, kategorii nebo oddíl. Seznam znalostí zobrazuje jeden objekt pro všechny články v rámci znalostní báze.

Zabezpečení

Když uživatel zadá dotaz na agenta, který používá zdroj konektoru Power Platform, systém provede kontroly autorizace.

Přístup ke konektoru

Když poprvé použijete zdroj založený na konektoru, systém vás vyzve k výběru existujícího konektoru Power Platform nebo k jeho přidání. Tento proces zajišťuje, abyste data sdílel/a jenom s tvůrci, kteří mají příslušná oprávnění k přístupu k samotnému zdroji dat.

Přístup k obsahu

Když uživatel vytvoří dotaz, systém využije jeho informace o připojení ke kontrole zdroje dat a ověření, že má oprávnění k zobrazení obsahu. I když jsou bloky dat a indexy uložené místně ve službě Dataverse, provede systém živou kontrolu na dotazech, aby před poskytnutím souhrnu nebo odpovědi zajistil, že má aktuální uživatel k datům přístup.

Poznámka

  • Systém nevrací výsledky uživatelům, pokud nemají oprávnění k určitým sadám souborů nebo článkům v znalostní bázi. Namísto toho obdrží standardní zprávu, že "nebyly nalezeny žádné výsledky." Pokud se uživatelé domnívají, že by pro daný zdroj měly být výsledky, musí se obrátit na své správce, aby si ověřili, že mají potřebná oprávnění k příslušným datům, ke kterým se snaží získat přístup. Uživatel musí mít přiřazenu příslušnou bezpečnostní roli v Dataverse, například roli Základní uživatel.
  • Systém neukládá informace o oprávněních k obsahu lokálně. Všechny kontroly oprávnění se provádějí živě se zdrojem, aby se zajistilo, že jsou nejaktuálnější.

Frekvence synchronizace a aktualizace souborů

Naplánovaná úloha synchronizace udržuje připojené soubory z OneDrive a SharePoint a nestrukturované články znalostní báze stále aktuální. Tato úloha se spustí automaticky na pozadí, aktualizuje obsah souborů a přeindexuje změny, aby poskytovala přesné výsledky pro dotazy. Aktualizace spravují nejen změny obsahu, ale také zajistí, že se veškerý obsah odstraněný ze zdroje už nebude zobrazovat jako součást odpovědí na dotazy. Momentálně nelze ručně spustit obnovu.

Další informace o načasování četnosti aktualizací najdete v tématu Omezení zdroje znalostí o nestrukturovaných datech v nástroji Copilot Studio.

Licence

Všechny požadavky, které zahrnují znalosti, se účtují podle sazeb Microsoft Copilot týkajících se zasílání generativních zpráv. Pro více informací viz Fakturační sazby a správa.

Pokud zdroje znalostí vyžadují ingestování dat, pak úložiště dat a odpovídající indexy k načtení těchto dat budou podléhat nárokům na úložiště, které má zákazník. Další informace o vyhledávání v přirozeném jazyce Dataverse viz Vylepšení prostředí využívajících AI pomocí vyhledávání Dataverse.

Limity a omezení

Při prvním povolení nestrukturované podpory dat může konfigurace a indexování Dataverse trvat 5 až 30 minut, než zpracuje přidané soubory. Doba závisí na velikosti aktuálního prostředí Dataverse.

Každý agent může mít maximálně 500 znalostních objektů. Tyto objekty můžou být soubory, složky, články znalostní báze, weby nebo jiné zdroje.

V tuto chvíli může agent použít pouze pět různých zdrojů. Například SharePoint, Dataverse, OneDrive nebo jiné zdroje.

Další informace o konkrétních limitech a omezeních týkajících se podporovaných nestrukturovaných zdrojů dat viz Omezení zdroje znalostí o nestrukturovaných datech v nástroji Copilot Studio.

Poznámka

K použití tohoto zdroje znalostí vyžadují agenti Copilot Studio vyhledávání Dataverse. Pokud nemůžete do agenta přidat soubor s podporou služby Dataverse, požádejte správce, aby ve vašem prostředí zapnul vyhledávání Dataverse. Další informace o vyhledávání Dataverse a o tom, jak jej spravovat, najdete v tématu Co je vyhledávání Dataverse a Konfigurace vyhledávání Dataverse pro vaše prostředí.

Pro přístup k obsahu OneDrive a SharePoint uloženému v Dataverse musí mít uživatelé alespoň licenci Základní uživatel pro Power Apps nebo Dynamics 365. Kromě toho musí oprávnění Základní uživatel zahrnovat také oprávnění ke čtení pro následující tabulky a entity:

Tato oprávnění můžete nakonfigurovat v centru pro správu Power Platform nebo v Centru pro správu Dynamics 365.

Nejčastější dotazy

Jaký je rozdíl mezi dvěma možnostmi SharePoint v dialogovém okně Přidat znalosti?

V dialogovém okně Přidat znalosti vidíte dvě možnosti SharePoint.

Snímek obrazovky s dialogovým oknem Přidat znalosti se zvýrazněnými dvěma možnostmi SharePointu.

Možnost SharePoint v části nahrávání souborů (1) slouží k nahrání jednotlivých souborů nebo složek SharePointu do vašeho agenta. Tato možnost nahraje kopii souboru ze SharePointu do Dataverse a udržuje synchronní vztah, aby byl soubor aktuální. Během dotazování je k SharePointu přistupováno za účelem ověření uživatelských oprávnění pro obsah. Uložené soubory v Dataverse spotřebovávají datové úložiště, ale poskytují možnost sémantického vyhledávání v celém dokumentu a podporu textu v obrázcích u určitých typů dokumentů, například PDF souborů.

Zvolte možnost 1, pokud potřebujete rychlou synchronizaci a nechcete statické soubory uložené v Dataverse. Automaticky se aktualizuje, když se změní zdrojové soubory.

Druhá varianta SharePoint (2) zajišťuje kompletní integraci SharePoint v Copilot Studio pomocí SharePoint connector. Použijte tuto možnost, pokud potřebujete plné možnosti konektoru SharePoint, vlastní autentizační konfigurace nebo pokročilé možnosti dotazů.

Rozdíly modulu runtime

Scénář Možnost 1: nahrání souboru Možnost 2: Konektor SharePoint
Úložiště obsahu Zkopírováno do Dataverse ze SharePointu Uloženo v SharePointu
Vyhledávací funkce Vyhledává v sémantickém indexu Dataverse vytvořeném z vestavěných vektorů ingestovaného obsahu zkopírovaného ze SharePointu. Přímo dotazuje infrastrukturu vyhledávání SharePointu
Aktuálnost obsahu Obsah je synchronizován během každých čtyř až šesti hodin, na základě dokončení zpracování V reálném čase a odráží nejnovější dostupný obsah
Seznamy SharePointu Podporováno Nepodporováno
Spotřeba úložiště v Dataverse Ano, pro zkopírované soubory a vyhledávací indexy Ne
Pokročilé filtry dotazů Není k dispozici Filtrovat podle názvu, autora, kdo upravil, a data poslední změny

Využití možnosti

Možnost 1 použijte v následujících situacích:

  • Potřebujete podporu pro seznamy SharePoint
  • Agent používá pouze určitou sadu souborů nebo složek
  • Chcete vysoce kvalitní sémantické vyhledávání poháněné vektorovými vkládáními
  • Stačí interval obnovy obsahu v délce čtyř až šesti hodin

Možnost 2 použijte v následujících situacích:

  • Bez zpoždění při synchronizaci obsahu, například často aktualizovaná wiki nebo oznamovací web
  • Je třeba se vyhnout využívání Dataverse, zejména u velkých knihoven dokumentů
  • Použití pokročilých filtrů dotazů, jako je filtrování podle autora, data změny nebo názvu

Poznámka

Obě možnosti vyžadují ověření uživatele. Uživatelé se mohou přihlásit dříve, než agent získá výsledky z obsahu SharePointu. Zjistěte více o synchronizaci, časování a limitech souborů v tématu Limity zdrojů vědomostí nestrukturovaných dat Copilot Studio.

Proč se ikona SharePoint nezobrazuje v části Nahrát soubory v dialogovém okně Přidat zdroj znalostí?

Po instalaci řešení a předtím, než se zobrazí dochází ve všech existujících organizacích k mírnému zpoždění. K ručnímu zahájení aktualizace postupujte podle těchto kroků:

  1. Přihlaste se do Centra pro správu Power Platform pomocí přihlašovacích údajů správce.

  2. V boční liště vyberte položku Spravovat.

  3. V seznamu produktů vyberte Aplikace Dynamics 365.

  4. Vyhledejte poweraiextensions.

  5. Vyberte tři tečky () pro Microsoft Dynamics 365 - PowerAIExtensions a vyberte Instalovat.

  6. V rozevírací nabídce vyberte své prostředí a pak vyberte Nainstalovat.

  7. Po dokončení instalace otevřete Power Apps v novém okně.

  8. V levém podokně vyberte Řešení.

  9. Vyberte Podrobností.

  10. Ověřte, že verze PowerAIExtensions Solution Anchor je nastavena na 1.01.688 nebo vyšší.

Co se stane, když do agenta přidám více než 500 znalostních objektů?

Nemůžete přidat další objekty, pokud nejdříve nesmažete předchozí objekty.

Má každý agent vlastní index zdroje znalostí?

Dataverse ukládá zdroje vědomostí pro použití v prostředí, ve kterém je vytváříte. Pokud stejnou složku SharePoint používá více agentů, všichni agenti použijí jednu instanci dané složky.

Co se stane, když přidám složku SharePoint nebo OneDrive, která má více než maximální počet souborů, složek a podsložek?

Copilot Studio načte a indexuje maximální počet souborů, složek a podsložek. Nezpracuje zbývající položky a neuvádí, které položky jsou nebo nejsou zpracovány.

Jeden z přidaných souborů se zobrazí jako součást zdroje vědomostí, ale nemůžu z něj získat odpovědi. Proč?

Tento problém může souviset s jedním z následujících důvodů:

  • Stránka Vědomosti neuvádí soubor ani složku jako Připraveno.
  • Název souboru obsahuje nepodporovaný znak (konkrétně pro soubory SharePoint).
  • Soubor má nastavení citlivosti Důvěrné nebo Vysoce důvěrné nebo je chráněn heslem.
  • Tento typ souboru není podporovaný.
  • Soubor nebo složka pochází z webu OneDrive nebo SharePoint jiného uživatele, který je s vámi nesdílel.
  • Soubor je soubor znalostní báze a váš účet nemá požadovaná oprávnění k zobrazení obsahu ve zdrojovém systému.