Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Note
Azure AI Zoeken is beschikbaar via de Azure-portal, REST API's en Azure-SDK's. Het vormt ook een basis voor Foundry IQ, de beheerde kennislaag die bedrijfsinhoud transformeert in herbruikbare, machtigingsbewuste knowledge bases voor agents in de Microsoft Foundry-portal.
In dit artikel wordt het uitvoeringsmodel van de indexeerfunctie beschreven dat Azure AI Zoeken gebruikt voor zoekservices voor Serverless en Standard 3 High Density (S3 HD). Beide opties hebben een dagelijks runtimequotum op serviceniveau waarmee wordt bepaald hoeveel tijd voor de indexeerfunctie u kunt gebruiken per UTC-venster van 24 uur.
Important
De mogelijkheden die in dit artikel worden beschreven, zijn in preview onder aanvullende gebruiksvoorwaarden.
- Ondersteuning voor indexeerfuncties in S3 HD vereist de
2025-11-01-previewREST API of hoger. - Ondersteuning voor serverloze indexeerfuncties vereist de
2026-05-01-previewREST API of hoger.
Waar van toepassing
Het uitvoeringsmodel in dit artikel is van toepassing op:
-
Serverloze zoekservices die indexeerfuncties uitvoeren met behulp van de
2026-05-01-previewREST API of hoger. - S3 HD-zoekservices die indexeerfuncties uitvoeren met behulp van de
2025-11-01-previewREST API of hoger.
Ondersteunde indexeerfunctiedefinities, gegevensbronnen, vaardighedensets en door een indexeerfunctie ondersteunde kennisbronnen werken zonder dat beide opties hoeven te worden gewijzigd.
Uitvoeringsmodel
Indexeerfuncties op serverloze en S3 HD hebben de volgende uitvoeringskenmerken:
U richt de indexeerinfrastructuur niet in of beheert deze niet. De service regelt de capaciteit voor u.
Indexeerfuncties worden alleen uitgevoerd in de uitvoeringsomgeving met meerdere tenants. De privé-uitvoeringsomgeving, die wordt geleverd via gedeelde private link-resources, is niet beschikbaar voor indexeerfuncties op deze SKU's.
Als u voor S3 HD indexeerverbindingen nodig hebt om buiten het openbare internet te blijven, configureert u een netwerkbeveiligingsperimeter (NSP) in uw zoekservice om inkomend en uitgaand verkeer te beheren via expliciete toegangsregels.
Voor serverloos is er geen ondersteuning voor privéverbindingen.
Dagelijks cumulatief uitvoeringsquotum
Uitvoering van de indexeerfunctie wordt bepaald door een dagelijks runtimequotum dat om 00:00 UTC opnieuw wordt ingesteld. Het quotum is:
- Serviceniveau: Deze is van toepassing op de zoekservice als geheel.
- Cumulatief: De uitvoeringstijd van elke indexeerder binnen de service telt mee voor hetzelfde budget. Het quotum wordt niet toegepast per indexeerfunctie.
Alle actieve indexeerders verbruiken tijd uit één gedeeld servicebudget. De service reserveert geen runtime voor afzonderlijke indexeerfuncties of verdeelt het quotum automatisch op gelijke wijze. De cumulatieve duur van 12 indexeerfuncties die elk twee uur worden uitgevoerd, kan bijvoorbeeld alle 24 cumulatieve runtime-uren verbruiken, ongeacht of de uitvoeringen elkaar overlappen of op verschillende tijdstippen optreden.
De volgende tabel bevat het dagelijkse quotum per SKU en de minimale API-versie die deze ondersteunt:
| Artikelnummer (SKU) | Dagelijks quotum per UTC-venster van 24 uur | Minimale API-versie |
|---|---|---|
| S3 HD | 24 uur | 2025-11-01-preview |
| Serverloze architectuur | 24 uur | 2026-05-01-preview |
Wanneer het dagelijkse quotum is uitgeput:
Indexeerfuncties die momenteel worden uitgevoerd, stoppen binnen ongeveer vijf minuten.
Nieuwe indexeerfuncties verwerken geen documenten en retourneren onmiddellijk een tijdelijke fout die aangeeft dat het dagelijkse quotum is overschreden.
De uitvoering van de normale indexeerfunctie wordt hervat nadat de teller om 00:00 UTC opnieuw is ingesteld.
Herstellen van quotumuitputting
Om te herstellen van quotumuitputting en de kans te verkleinen dat u deze limiet opnieuw bereikt:
Wacht tot de volgende reset om 00:00 UTC plaatsvindt, of gebruik Get Service Statistics (REST API) om te bevestigen dat
remainingSecondsweer is aangevuld voordat nieuwe runs worden gestart.Plaats indexeerfuncties op gefaseerde planningen , zodat werk verspreid is over het 24-uursvenster in plaats van gelijktijdig te worden uitgevoerd.
U kunt actieve sessies niet pauzeren of stoppen. Gebruik Status van indexeerfunctie ophalen om deze te controleren en zie Indexeerfuncties uitvoeren of opnieuw instellen voor runtimebeheergedrag.
Als er nog runtime over is, maar indexeeruitvoeringen mislukken, zie Problemen met de indexer oplossen.
Verlaag de kosten van de vaardighedenset. Vaardigheden die externe services aanroepen, zoals de Azure OpenAI Embedding-vaardigheid, GenAI Prompt-vaardigheid en Azure Content Understanding-vaardigheid, verbruiken snel runtime. Verlaag het aantal vaardigheden, batchdocumenten of configureer een verrijkingscache om eerdere resultaten opnieuw te gebruiken in plaats van opnieuw te verwerken.
Bewaak
remainingSecondsproactief op zowel service- als indexerniveau, zodat u workloads kunt afremmen voordat ze uitvallen.
Cumulatieve bedrijfstijd controleren
In deze sectie wordt uitgelegd hoe u het runtimegebruik en het resterende budget bijhoudt met behulp van de REST API's van de Search Service. Er is geen portalweergave voor cumulatieve uitvoeringstijd tijdens de previewperiode.
Runtime op serviceniveau
Gebruik Get Service Statistics (REST API) om de cumulatieve indexeerfunctieruntime op te halen voor alle indexeerfuncties in de service voor het huidige venster van 24 uur:
GET {endpoint}/servicestats?api-version=2026-08-01-preview
Het antwoord bevat een indexersRuntime sectie. In de volgende JSON ziet u een service waarvan het dagelijkse quotum van 24 uur niet wordt gebruikt:
"indexersRuntime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Belangrijkste punten:
-
usedSeconds: Totaal aantal seconden dat alle indexeerfuncties in de service zijn uitgevoerd tijdens het huidige venster. -
remainingSeconds: Seconden nog steeds beschikbaar voordat het dagelijkse quotum wordt bereikt. Aanwezig wanneer een laagspecifieke limiet van toepassing is. -
beginningTimeenendingTime: Begin en einde van het huidige 24-uurs UTC-tellingsvenster.
Runtime op indexerniveau
Gebruik Status van indexeerfunctie ophalen (REST API) om de cumulatieve runtime voor een afzonderlijke indexeerfunctie op te halen:
GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview
Het antwoord bevat een runtime sectie. De volgende JSON toont een indexeerfunctie voor een service waarvan het dagelijkse quotum van 24 uur niet wordt gebruikt:
"runtime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Belangrijkste punten:
-
usedSeconds: Totaal aantal seconden dat de indexeerfunctie is uitgevoerd tijdens het huidige venster. -
remainingSeconds: Seconden zijn nog steeds beschikbaar voor alle indexeerfuncties in de service, niet alleen voor deze indexeerfunctie. Aanwezig wanneer een laagspecifieke limiet van toepassing is. -
beginningTimeenendingTime: Begin en einde van het huidige 24-uurs UTC-tellingsvenster.
Beste praktijken
Ondersteuning voor indexers op S3 HD en Serverless is beschikbaar als preview. Volg deze richtlijnen om de grootte van workloads op de juiste wijze te bepalen en om te plannen dat de facturering voor serverloos op een later tijdstip wordt geïntroduceerd.
S3 HD
Tijdens de previewfase is ondersteuning voor de S3 HD-indexer bedoeld voor workloads zonder skillsets of met kleine skillsets. Het dagelijkse quotum behouden:
Houd rekening met kleine indexen van ongeveer 1 GB.
Pas het gebruik van vaardighedensets zorgvuldig aan. Vaardigheden die externe services aanroepen, zoals de vaardigheid Azure OpenAI Embedding skill, GenAI Prompt skill en Azure Content Understanding skill aanzienlijk de runtime verhogen en het dagelijkse quotum snel verbruiken, met name in scenario's met meerdere tenants.
Verwacht beperkte parallelle uitvoering tijdens de preview. Gebruik geplande, gefaseerde uitvoeringen voor grote indexerclusters, zodat het werk over een periode van 24 uur wordt verspreid in plaats van met elkaar om hetzelfde budget te concurreren.
Illustratieve taak voor splitsen en insluiten
In één gecontroleerde S3 HD-test genereerden een Split-skill en één Azure OpenAI Embedding-skill chunks en embeddings. De werkbelasting heeft ongeveer 2,5 segmenten per brondocument geproduceerd en er zijn in deze test ongeveer 22.000 brondocumenten waargenomen tijdens een S3 HD-testvenster van 24 uur.
De volgende waarden zijn afgeronde, illustratieve fair-share-berekeningen op basis van de geaggregeerde observatie. Ze worden niet gemeten op basis van resultaten per indexer.
| Aantal indexeerfuncties | Illustratieve brondocumenten per indexeerfunctie per dag |
|---|---|
| 100 | Ongeveer 200 |
| 500 | Ongeveer 40 |
| 1,000 | Ongeveer 20 |
De service reserveert geen capaciteit en garandeert geen gelijke verdeling, uitvoeringsvolgorde of doorvoer voor deze aantallen indexers.
Note
Dit resultaat is waargenomen in één gecontroleerde test. Het is geen prestatiedoel, servicegarantie, capaciteitstoezegging, grootteformule of vervanging voor het testen van uw workload.
Doorvoer kan aanzienlijk variëren met documentcomplexiteit en -profiel, segmentering, het aantal en het type vaardigheden en vectoruitvoer, modellatentie, capaciteit en quotum, bron- en doelprestaties, gelijktijdigheid, planningsvolgorde, beperking, regio, fouten en nieuwe pogingen, documentscheuren of optische tekenherkenning (OCR) en ongelijke tenantvolumes. Test met representatieve productie-invoer voordat u capaciteit plant.
Serverloze architectuur
In de previewfase zijn serverloze indexeerders ontworpen om gegevensinname te vereenvoudigen voor retrieval-augmented generation (RAG) en kennisbankscenario's:
De uitvoering van de indexeerfunctie (met uitzondering van vaardigheden) is momenteel gratis. Bij het schrijven van documenten naar een index worden kosten in rekening gebracht.
De uitvoering van skillsets wordt op dezelfde manier gefactureerd als bij dedicated indexers. Aanroepen naar externe services, zoals de Azure OpenAI Embedding skill, GenAI Prompt skill en Azure Content Understanding skill, worden gefactureerd via de gekoppelde Foundry- of Azure AI Services-resource.
Limieten en quota
Zie Limieten voor indexeerders voor indexeerlimieten op Serverless en S3 HD.
De limieten voor runtime-quotums en indexeerfuncties op serviceniveau vervangen niet de invoer-, aanvraag- of verwerkingslimieten van vaardigheden en externe services in een vaardighedenset. Controleer elke vaardigheidsverwijzing afzonderlijk wanneer u de grootte van een verrijkingspijplijn aanwijst.