Een verrijkingscache configureren

Note

Azure AI Zoeken is beschikbaar via de Azure-portal, REST API's en Azure-SDK's. Het vormt ook een basis voor Foundry IQ, de beheerde kennislaag die bedrijfsinhoud transformeert in herbruikbare, machtigingsbewuste knowledge bases voor agents in de Microsoft Foundry-portal.

Belangrijk

Deze functie is in preview onder aanvullende gebruiksvoorwaarden. Preview REST API's ondersteunen deze functie.

In dit artikel wordt uitgelegd hoe u caching toevoegt aan een pijplijn voor vaardigheden, zodat u verrijkingsstappen stroomafwaarts kunt wijzigen zonder elke keer volledig opnieuw op te bouwen. Een vaardighedenset is standaard staatloos en het wijzigen van een deel van de samenstelling vereist een volledige herrun van de indexeerfunctie. Met een verrijkingscache bepaalt de indexeerfunctie welke onderdelen van de documentstructuur moeten worden vernieuwd op basis van wijzigingen in de vaardighedenset of indexeerfunctiedefinitie. De indexeerfunctie behoudt en hergebruikt waar mogelijk bestaande verwerkte uitvoer.

U plaatst inhoud in de cache in Azure Storage met behulp van een verbindingsreeks die u opgeeft. De indexeerfunctie maakt deze objecten wanneer deze wordt uitgevoerd. Houd rekening met de verrijkingscache van een intern onderdeel dat wordt beheerd door uw zoekservice die u niet mag wijzigen.

Belangrijk

Een verrijkingscache is geen back-up van de uitvoer van skillsets, de status van de indexer of geïndexeerde documenten. Er wordt niet bijgehouden welke documenten worden verwerkt. Raadpleeg de sectie Beperkingen voor grote gegevensbronnen voordat u caching inschakelt.

  • Een container met de naam ms-az-search-indexercache-<alpha-numeric-string>
  • Tabellen met de naam MsAzSearchIndexerCacheIndex<alpha-numeric-string>

Voorwaarden

  • Azure Storage voor het opslaan van verrijkingen in de cache. Het opslagaccount moet algemeen v2 zijn.

  • Als u alleen voor het indexeren van blobs gesynchroniseerde documenten wilt verwijderen uit zowel de cache als de index wanneer blobs uit uw gegevensbron worden verwijderd, schakelt u een verwijderingsbeleid in de indexeerfunctie in. Zonder dit beleid wordt documentverwijdering uit de cache niet ondersteund.

U moet bekend zijn met het instellen van indexeerders en vaardigheidsets. Begin met het overzicht van de indexeerfunctie en ga verder met vaardighedensets voor meer informatie over verrijkingspijplijnen.

Beperkingen

Voorzichtigheid

Als u de SharePoint indexeerfunctie (preview) gebruikt, vermijdt u incrementele verrijking. Onder bepaalde omstandigheden wordt de cache ongeldig. Als u het opnieuw wilt laden, voert u het opnieuw instellen van een indexeerfunctie en volledig opnieuw opbouwen uit.

Grote gegevensbronnen hebben een extra cachebeperking.

Voorzichtigheid

Voor grote gegevensbronnen kan een verrijkingscache de totale herverwerking verhogen wanneer langdurige vaardigheden, herhaalde onderbrekingen of frequente vaardigheidsfouten optreden. De indexeerfunctie geeft prioriteit aan de juistheid ten opzichte van het minimaliseren van herverwerking, zodat een cacheachterstand van herhaalde onderbrekingen het gedrag voor opnieuw proberen versterkt. Dit gedrag wordt verwacht, geen bug.

Als u wilt herstellen van een groeiende cacheachterstand, partitioneert u de gegevensbron in kleinere containers of virtuele mappen. Gebruik vervolgens parallelle indexeerfuncties die naar dezelfde index verwijzen. Als u de cache wilt ontkoppelen, stelt u de cache eigenschap in op null in de indexeerfunctie. Zie Grote gegevenssets indexeren voor hulp bij het partitioneringspatroon.

Machtigingen

Een Azure AI Zoeken identiteit moet schrijftoegang hebben tot Azure Storage:

  • Inzender voor opslagblobgegevens
  • Inzender voor opslagtabelgegevens

De verbindingsreeks syntaxis bepaalt of een door het systeem toegewezen of door de gebruiker toegewezen identiteit wordt gebruikt. Zie Connect to Azure Storage using a managed identity voor meer informatie.

De cache-eigenschap instellen

Gebruik deze procedure voor zowel nieuwe als bestaande indexeerfuncties.

Stel in de definitie van de indexeerfunctie het volgende cache in:

  • (Vereist) storageConnectionString moet ingesteld zijn op een Azure Storage verbindingstekenreeks.
  • (Optioneel) enableReprocessing (true standaard). Stel deze in op false om de incrementele verrijking tijdelijk te onderbreken, en schakel het later weer terug naar true.
  1. Kies aan de linkerkant Indexers.

  2. Selecteer Indexeerfunctie toevoegen om een nieuwe indexeerfunctie te maken of open een bestaande indexeerfunctie in de JSON-bewerkingsmodus.

  3. Schakel incrementele verrijking in, stel het opslagaccount voor de verrijkingscache in en sla de indexeerfunctie op.

    Schermopname van de Azure portaloptie voor verrijkingscache.

  4. Stel de indexeerfunctie opnieuw in als deze al bestaat.

  5. Voer de indexeerfunctie uit. Deze eenmalige volledige opbouw vult de cache. Nadat het is geladen, is incrementeel hergebruik van toepassing op volgende uitvoeringen.