Wat is een kennisbron?

Opmerking

Azure AI Zoeken is beschikbaar via de Azure-portal, REST API's en Azure-SDK's. Het vormt ook een basis voor Foundry IQ, de beheerde kennislaag die bedrijfsinhoud transformeert in herbruikbare, machtigingsbewuste knowledge bases voor agents in de Microsoft Foundry-portal.

Important

Functies, mogelijkheden of eigenschappen die zijn gemarkeerd (preview) vallen niet onder een service level agreement, worden niet aanbevolen voor productieworkloads en kunnen worden gewijzigd of beperkt voordat ze algemeen beschikbaar worden. De Azure AI Zoeken preview-voorwaarden zijn van toepassing op alle preview-functionaliteit, ongeacht of deze zelfstandig is of deel uitmaakt van een algemeen beschikbare functie.

Een kennisbron is een resource op het hoogste niveau in uw Azure AI Zoeken-service die de inhoud definieert die wordt gebruikt in een agentische ophaalpijplijn. Elke kennisbron is geïndexeerd of extern, waarmee wordt bepaald hoe de inhoud wordt opgenomen, verwerkt en opgevraagd. Kennisbronnen zijn vereiste onderdelen van een knowledge base.

U kunt verwijzen naar meerdere kennisbronnen in één knowledge base. De agentische ophaalengine bevraagt ze allemaal in één aanvraag. Voor elke kennisbron worden subquery’s gegenereerd en de beste resultaten worden geretourneerd in de ophaalrespons.

Ondersteunde kennisbronnen

Azure AI Zoeken ondersteunt de volgende kennisbronnen voor agentische ophaalworkloads.

Soort Description Geïndexeerd of op afstand
Zoekindex Verpakt een bestaande index. Geïndexeerd
Azure Blob Hiermee wordt een indexeerpijplijn gegenereerd vanuit een blobcontainer. Geïndexeerd
Azure SQL (preview) Hiermee wordt een indexeerpijplijn gegenereerd vanuit een Azure SQL tabel of weergave. Geïndexeerd
Bestand (voorvertoning) Uploadt bestanden rechtstreeks naar Azure AI Zoeken. Geïndexeerd
OneLake Genereert een indexeerpijplijn vanuit een lakehouse. Geïndexeerd
Geïndexeerde SharePoint (preview) Hiermee wordt een indexeerpijplijn van een SharePoint-site gegenereerd. Geïndexeerd
Extern SharePoint (preview-versie) Hiermee haalt u inhoud op uit SharePoint. Op afstand
Fabric-gegevensagent (preview) Haalt antwoorden en ingesloten resources op uit een Microsoft Fabric gegevensagent. Op afstand
Fabric Ontology (preview) Haalt antwoorden op basis van entiteiten en relaties op uit een Microsoft Fabric ontologie. Op afstand
MCP server (preview) Haalt live, met hulpprogramma's ondersteunde resultaten op van een externe MCP-server. Op afstand
Iq voor werk (preview) Hiermee haalt u organisatie-intelligentie op van Work IQ. Op afstand
Web Haalt realtime grondgegevens op uit Microsoft Bing. Op afstand

Geïndexeerde kennisbronnen

Een geïndexeerde kennisbron verwijst naar een zoekindex die voldoet aan de criteria voor agentgestuurde gegevensophaling. Inhoud wordt opgenomen in de index vóór de querytijd via een van de drie paden:

  • Bring Your Own Index: Gebruik een zoekindexkennisbron om een bestaande index in uw zoekservice te verpakken.

  • Direct bestand uploaden: Gebruik een kennisbron voor bestanden om bestanden rechtstreeks naar Azure AI Zoeken te uploaden. De service verwerkt de bestanden en slaat geëxtraheerde inhoud op in een gegenereerde zoekindex, zonder dat er een externe opslag- of indexeerpijplijn is vereist.

  • Automatisch gegenereerde indexeerfunctiepijplijn: Voor alle andere geïndexeerde kennisbronnen maakt Azure AI Zoeken automatisch een volledige indexeerpijplijn van uw externe gegevensbron. Dit omvat een gegevensbron, vaardighedenset, indexeerfunctie en index die is gevuld en gesegmenteerd.

Query's worden lokaal uitgevoerd in uw zoekservice met behulp van volledige tekst (trefwoord), vector- of hybride query's.

Omdat een geïndexeerde kennisbron een onderliggende zoekindex heeft, kunnen verwijzingen in het antwoord door de service gegenereerde citatie-URL's (preview) bevatten die verwijzen naar de documenten in de index. Externe kennisbronnen hebben geen back-upindex, zodat ze geen bronvermeldings-URL's retourneren.

Externe kennisbronnen

Een externe kennisbron maakt rechtstreeks verbinding met een extern platform. Inhoud wordt nooit opgenomen in Azure AI Zoeken. In plaats daarvan wordt deze opgehaald bij query's via de systeemeigen API's van elk platform. De agentische retrieval-engine maakt de API-aanroep en presenteert de resultaten samen met eventuele geïndexeerde kennisbronnen in dezelfde respons.

Afhankelijk van het platform bereiken externe verbindingen inhoud via het openbare internet (zoals Bing) of binnen uw Microsoft tenant (zoals SharePoint en Fabric).

Uniforme classificatie

Voor zowel geïndexeerde als externe kennisbronnen stromen alle opgehaalde inhoud via dezelfde classificatiepijplijn. Resultaten worden beoordeeld op relevantie, samengevoegd over meerdere query's heen en opnieuw gerankt voordat ze worden teruggestuurd in de ophaalrespons.

Werken met kennisbronnen

Kennisbronnen zijn onafhankelijke objecten die u afzonderlijk van knowledge bases maakt en beheert. Houd rekening met het volgende:

  • Maak een kennisbron voordat u een knowledge base maakt. Knowledge bases verwijzen naar kennisbronnen op id, dus de kennisbron moet eerst bestaan.

  • Als u een kennisbron wilt verwijderen, moet u eerst knowledge bases bijwerken of verwijderen waarnaar wordt verwezen. Vervolgens kunt u de kennisbron verwijderen.

  • Een kennisbron en de bijbehorende knowledge base moeten aanwezig zijn in dezelfde zoekservice.

Kennisbronnen maken

Ondersteuning voor het maken in de Azure-portal, Microsoft Foundry-portal, REST API en Azure-SDK's verschilt per soort kennisbron. Zie de koppelingen in ondersteunde kennisbronnen voor instructies per soort.

Vertrouwelijkheidslabels opnemen (preview-versie)

Voor Blob-, geïndexeerde OneLake- en geïndexeerde SharePoint-kennisbronnen kunt u Microsoft Purview-gevoeligheidslabels opnemen door ingestionPermissionOptions zo in te stellen dat sensitivityLabel wordt opgenomen. Volg alle vereisten voordat u deze waarde instelt. Nadat ze met de index zijn gesynchroniseerd, worden labels opgenomen in ophaalreacties en gebruikt om toegangsbeheer op documentniveau af te dwingen tijdens het uitvoeren van query's. Zie Machtigingen afdwingen op het moment van query (preview) voor meer informatie.

Als uw geïndexeerde kennisbron gebruikmaakt van een gesegmenteerde index, zoals met geïntegreerde vectorisatie of een aangepaste vaardigheid voor tekst splitsen, moet u ook het vertrouwelijkheidslabel toewijzen aan elke segmentrij via indexprojecties in de vaardighedenset. Anders worden verwijzingen op chunkniveau in ophaalreacties niet geretourneerd als ze in het brondocument van labels zijn voorzien.

Afbeeldingen die in documenten zijn ingesloten weergeven (voorvertoning)

Voor blob, geïndexeerde OneLake en geïndexeerde SharePoint kennisbronnen kunt u een assetStore in de kennisbron ingestionParameters instellen om afbeeldingen te behouden die zijn ingesloten in uw brondocumenten. Wanneer u ook het serveren van afbeeldingen inschakelt voor de knowledge base, voegt de retrieve-actie die afbeeldingen toe aan de prompt voor antwoordsynthese, zodat de LLM kan redeneren over diagrammen, grafieken en uit afbeeldingen geëxtraheerde inhoud. Zie In documenten ingesloten afbeeldingen beschikbaar maken in agentische retrieval (preview) voor meer informatie.

Configureer assetStore en ingestionPermissionOptions niet op dezelfde kennisbron. Het aanbieden van afbeeldingen wordt niet ondersteund wanneer ingestionPermissionOptions is geconfigureerd.

Gegevensopname beperken tot een privénetwerk (preview)

Blob, geïndexeerde SharePoint en geïndexeerde Azure SQL kennisbronnen ondersteunen de uitvoering van een privé-indexeerfunctie. Voor blob en Azure SQL kunnen goedgekeurde gedeelde privékoppelingen de bronverbinding en Azure afhankelijkheden beveiligen. SharePoint Online is geen gedeeld privékoppelingsdoel, dus de privémodus is alleen van toepassing op de beveiligde Azure afhankelijkheden.

Op dit moment wordt privésynchronisatie niet ondersteund voor geïndexeerde OneLake-kennisbronnen.

Automatische analyse per taal gebruiken (preview)

Blob, geïndexeerde OneLake en geïndexeerde SharePoint kennisbronnen ondersteunen automatische analyse per taal voor meertalige inhoud. Indien ingeschakeld, detecteert Azure AI Zoeken de taal van elk brondocument en past automatisch een overeenkomende Microsoft taalanalyse toe. U geeft geen analyse op in de definitie van de kennisbron of in een query.

Kennisbronnen gebruiken

Nadat u een kennisbron hebt gemaakt, kunt u ernaar verwijzen in een knowledge base. De knowledge base bepaalt welke kennisbronnen u wilt opvragen. In de volgende secties worden opties beschreven voor het bepalen welke bronnen worden opgenomen en hoe de engine ertussen selecteert.

Altijd een query uitvoeren op een kennisbron

Stel alwaysQuery in op true in een definitie van een kennisbron, zodat deze in elke query wordt opgenomen, ongeacht hoeveel retrievalredenering er wordt toegepast.

Gebruik de ophaal- en redeneersinspanning om het gebruik van de LLM te beheren (preview)

De mate van retrievalredenering bepaalt hoeveel LLM-verwerking op elke zoekopdracht wordt toegepast. Niet alle oplossingen profiteren van LLM-queryplanning. Als eenvoud en snelheid prioriteit hebben, gebruikt u minimal effort om LLM-verwerking over te slaan. Bij inspanningsniveau low en medium plant en selecteert de LLM welke kennisbronnen moeten worden geraadpleegd, waarbij medium een extra iteratieve stap toevoegt voor diepgaandere resultaten. Zie De inspanning voor redeneerwerk bij ophalen instellen (preview) voor meer informatie over elk niveau.

De volgende factoren spelen een rol bij de selectie voor low en medium:

  • De name kennisbron.

  • De description index (voor geïndexeerde kennisbronnen).

  • De in de knowledgebasedefinitie of de retrievalInstructions opgegeven . Instructies voor het ophalen van informatiebronnen die de LLM selecteert of overslaat. Ze werken als een prompt: u kunt kortheid, toon en opmaak opgeven.