Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Opmerking
Azure AI Zoeken is beschikbaar via de Azure-portal, REST API's en Azure-SDK's. Het vormt ook een basis voor Foundry IQ, de beheerde kennislaag die bedrijfsinhoud transformeert in herbruikbare, machtigingsbewuste knowledge bases voor agents in de Microsoft Foundry-portal.
Maximumlimieten voor opslag, workloads en hoeveelheden indexen en andere objecten zijn afhankelijk van het prijsmodel van uw Azure AI Zoeken-service.
Azure AI Zoeken ondersteunt twee prijsmodellen, elk met gekoppelde servicelagen. De laag die u selecteert, is van invloed op de servicelimieten die in deze richtlijnen worden beschreven.
- Gereserveerd: vaste prijsstelling gemeten in Search Units (SU's). Opties voor servicelagen zijn: Basic, Standard (S1-S3, inclusief S3 HD), Geoptimaliseerd voor opslag (L1-L2) en een gratis laag met beperkte zoekservicemogelijkheden.
- Serverloos (preview): op verbruik gebaseerde prijzen gemeten op basis van rekeneenheden per uur (CU/hr) en per GB/maand voor geïndexeerde opslag. De huidige preview-laag is: Serverloze ontwikkelaar. Limieten worden bepaald door maxima per index, aantallen objecten per service en het throttlinggedrag van Serverless.
Belangrijk
De serverloze ontwikkelaarslaag is momenteel beschikbaar als preview-versie. Deze preview wordt geleverd zonder service level agreement en wordt niet aanbevolen voor productieworkloads. Bepaalde functies worden mogelijk niet ondersteund of hebben mogelijk beperkte mogelijkheden. Zie Aanvullende gebruiksvoorwaarden voor Microsoft Azure Previews voor meer informatie.
Facturering voor de serverloze ontwikkelaarslaag is nog niet ingeschakeld tijdens de preview. Geschatte kosten voor uw gebruik zijn beschikbaar in de Azure portal en telemetrie, maar dat gebruik wordt niet weergegeven op uw Azure factuur tijdens deze initiële periode. Microsoft ontvangt ten minste 30 dagen kennisgeving voordat de facturering begint. Het uitstel van facturering tijdens deze preview is tijdelijk. Serverless Developer is een betaald abonnement en u bent verantwoordelijk voor eventuele kosten die in rekening worden gebracht zodra de facturering start.
De serverloze ontwikkelaarslaag biedt geen ondersteuning voor migratie naar of van andere prijscategorieën en sommige functies die beschikbaar zijn in andere lagen, worden niet ondersteund tijdens openbare preview. Servicelimieten, ondersteunde functies en prijsgegevens kunnen vóór algemene beschikbaarheid veranderen.
De preview is momenteel alleen beschikbaar in VS - west-centraal, Zwitserland - noord en Japan - oost.
Zie Een prijsmodel en servicelaag kiezen voor meer informatie.
Quotum-, capaciteits- of limietfouten vaststellen
Quotum- en capaciteitsfouten zijn afkomstig van afzonderlijke besturingselementen. Gebruik de fout van de voltooide bewerking om te bepalen welke bewerking van toepassing is.
Als een bewerking voor maken, schalen of upgraden nog steeds wordt uitgevoerd, wacht u totdat de inrichtingsstatus Succeeded wordt gewijzigd of Failed. Een actieve bewerking is geen bewijs van een quotum- of capaciteitsprobleem. Als een schaalbewerking mislukt, raadpleegt u Fouten tijdens het schalen.
| Failure | Waarschijnlijke oorzaak | Eerste actie |
|---|---|---|
| Het maken van services is geblokkeerd in een abonnement en regio | Abonnementsquotum | Controleer in de Quota-service de limiet voor uw laag en regio en vraag vervolgens meer services aan. |
| Maken, schalen of upgraden mislukt, ook al is het quotum beschikbaar | Regionale capaciteitsbeperking | Controleer de voetnoten in regioondersteuning voor beperkte lagen en kies vervolgens een andere regio. |
| Replica, partitie, laag of objectaanvraag geweigerd | Service- of indexlimiet | Vergelijk uw configuratie- en objectaantallen met servicelimieten en indexlimieten. |
| De zoekservice retourneert beperkingsreacties onder belasting | Throttling | Verminder de aanvraagsnelheid of voeg zoekeenheden toe. Zie beperkingslimieten. |
| Indexeren mislukt in de buurt van een opslag- of vectorlimiet | Opslag- of vectorquotum | Vergelijk storageSize met partitieopslag voor schijf en vectorIndexSize met limieten voor vectorindexgrootte voor geheugen. |
| Indexeerfunctie, vaardigheid of vectorizer rapporteert een 429 van een andere service | Azure OpenAI of ander servicequotum | Volg de quotarichtlijnen voor de service die de fout heeft uitgegeven, zoals Azure OpenAI. |
Het beschikbare abonnementsquotum garandeert geen regionale capaciteit en het aanvragen van meer quota lost geen capaciteitsbeperking op. Als de fout zich blijft voordoen, opent u een ondersteuning voor Azure-aanvraag die het abonnement, de regio, de laag, de aangevraagde configuratie, volledige fouttekst, UTC-tijd en een correlatie- of bewerkings-id bevat.
Abonnementslimieten
U kunt meerdere factureerbare zoekservices (Basic en hoger) maken, tot het maximum aantal services dat is toegestaan voor elke laag, per regio. U kunt bijvoorbeeld maximaal 16 services maken op de Basic-laag en nog eens 16 services op de S1-laag binnen hetzelfde abonnement en dezelfde regio. Vervolgens kunt u 16 Basic-services in een andere regio maken voor een gecombineerd totaal van 32 Basic-services onder hetzelfde abonnement. Zie Een prijsmodel en servicelaag kiezen voor meer informatie over servicelagen.
U kunt de maximale servicelimieten verhogen op aanvraag. Als u meer services binnen hetzelfde abonnement nodig hebt, dient u een ondersteuningsaanvraag in.
| Hulpbron | Gratis 1 | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Maximum aantal services per regio | 1 | 16 | 16 | 8 | 6 | 6 | 6 | 6 | 5 |
| Maximum aantal zoekeenheden (SU)2 | Niet van toepassing. | 3 SU | 36 SU | 36 SU | 36 SU | 36 SU | 36 SU | 36 SU | Niet van toepassing. |
1 U kunt één gratis zoekservice per Azure-abonnement hebben. De gratis laag is gebaseerd op infrastructuur die wordt gedeeld met andere klanten. Omdat de hardware gedeeld is, wordt opschalen niet ondersteund en is de opslag beperkt tot 50 MB. Een gratis zoekservice kan worden verwijderd na langere perioden van inactiviteit om ruimte te maken voor meer services.
2 Zoekeenheden (SU) zijn factureringseenheden, toegewezen als een replica of een partitie. U hebt beide nodig. Zie De capaciteit van een zoekservice schatten en beheren voor meer informatie over SU-combinaties.
Beperkingen van diensten
Plan in het Dedicated-prijsmodel de capaciteit door replica's te vermenigvuldigen met partities (zoekeenheden).
| Hulpbron | Gratis | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Scheidingen | Niet van toepassing. | 3 1 | 12 | 12 | 12 | 3 | 12 | 12 | Niet van toepassing. |
| Replica's | Niet van toepassing. | 3 | 12 | 12 | 12 | 12 | 12 | 12 | Niet van toepassing. |
1 De Basic-laag ondersteunt drie partities en drie replica's, voor een totaal van negen zoekeenheden (SU) voor nieuwe zoekservices die zijn gemaakt na 3 april 2024. Oudere Basic-services zijn beperkt tot één partitie en drie replica's.
Een zoekservice is onderworpen aan een maximale opslaglimiet (partitiegrootte vermenigvuldigd met het aantal partities) of een vaste limiet voor het maximum aantal indexen of indexeerfuncties, afhankelijk van de limiet die het eerst voorkomt.
Service level agreements (SLA's) zijn van toepassing op factureerbare diensten met twee of meer replica's voor query-werkbelastingen of drie of meer replica's voor query- en indexeringswerkbelastingen. Het aantal partities is geen SLA-overweging. Zie Betrouwbaarheid in Azure AI Zoeken voor meer informatie.
Gratis services hebben geen vaste partities of replica's en delen resources met andere abonnees.
Partitieopslag (GB)
Opslaglimieten per service variëren op basis van twee factoren: de aanmaakdatum en regio van de service. De meeste ondersteunde regio's bieden hogere limieten voor nieuwere services.
In deze tabel ziet u de voortgang van de toename van het opslagquotum in GB in de loop van de tijd. Vanaf april 2024 kwamen hogere capaciteitspartities online in de regio's die worden vermeld in de voetnoten. Als u een oudere service in een ondersteunde regio hebt, controleert u of u uw service kunt upgraden om hogere opslaglimieten te krijgen.
| Aanmaakdatum van service | Eenvoudig | S1 | S2 | S3/HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|
| Vóór 3 april 2024 | 2 | vijfentwintig | 100 | 200 | 1,024 | 2,048 | Niet van toepassing. |
| 3 april 2024 tot en met 17 mei 2024 1 | 15 | 160 | 512 | 1,024 | 1,024 | 2,048 | Niet van toepassing. |
| Na 17 mei 2024 2 | 15 | 160 | 512 | 1,024 | 2,048 | 4,096 | Niet van toepassing. |
| Na 10 februari 2025 3 | 15 | 160 | 512 | 1,024 | 2,048 | 4,096 | Niet van toepassing. |
1 Hogere capaciteitsopslag voor Basic, S1, S2 en S3 in deze regio's. Amerika's: Brazilië Zuid, Canada Centraal, Canada Oost, VS Oost, VS Oost 2, VS Centraal, VS Noord-Centraal, VS Zuid-Centraal, VS West, VS West 2, VS West 3, VS West-Centraal. Europa: Frankrijk - centraal. Italië - noord, Europa - noord, Noorwegen - oost, Polen - centraal, Zwitserland - noord, Zweden - centraal, VK - zuid, VK - west. Midden-Oosten: UAE - noord. Afrika: Zuid-Afrika - Noord. Azië en Stille Oceaan: Australië - oost, Australië - zuidoost, India - centraal, Jio India - west, Azië - oost, Azië - zuidoost, Japan - oost, Japan - west, Korea - centraal, Korea - zuid.
2 Hogere capaciteitsopslag voor L1 en L2. Meer regio's bieden hogere capaciteit voor elke factureerbare laag. Amerika: VS - oost 2 EUAP. Europa: Duitsland - noord, Duitsland - west-centraal, Zwitserland - west. Azure Government: Texas, Arizona, Virginia. Afrika: Zuid-Afrika - Noord. Azië en Stille Oceaan: China - noord 3, China - oost 3.
3 Hogere opslagcapaciteit is beschikbaar in West-Europa.
Belangrijk
Momenteel zijn hogere opslaglimieten niet beschikbaar in de volgende regio's, waarvoor de limieten vóór 3 april gelden.
- Israël Centraal
- Qatar Centrale
- Spanje - centraal
- Zuid-India
Indexlimieten
| Hulpbron | Gratis | Basic 1 | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Maximum aantal indexen | 3 | 5 of 15 | 50 | 200 | 200 | 1000 per partitie ofwel 3000 per service | 10 | 10 | 30 |
| Maximum aantal eenvoudige velden per index 2 | 1000 | 100 | 1000 | 1000 | 1000 | 1000 | 1000 | 1000 | 1000 |
| Maximale dimensies per vectorveld | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 |
| Maximum aantal complexe verzamelingen per index | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 |
| Maximum aantal elementen voor alle complexe verzamelingen per document 3 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 |
| Maximale diepte van complexe velden | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 |
| Maximum aantal suggesties per index | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 |
| Maximaal aantal scoreprofielen per index | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| Maximaal aantal semantische configuraties per index | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| Maximum aantal functies per profiel | 8 | 8 | 8 | 8 | 8 | 8 | 8 | 8 | 8 |
| Maximale indexgrootte 4 | Niet van toepassing. | Niet van toepassing. | Niet van toepassing. | 1,88 TB | 2,34 TB | 100 GB | Niet van toepassing. | Niet van toepassing. | 1 GB |
1 Basisservices die vóór december 2017 zijn gemaakt, hebben lagere limieten (5 in plaats van 15) voor indexen. De Basic-laag is de enige laag met een ondergrens van 100 velden per index.
2 De bovengrens voor velden omvat zowel velden op het eerste niveau als geneste subvelden in een complexe verzameling. Als een index bijvoorbeeld 15 velden bevat en twee complexe verzamelingen met elk vijf subvelden heeft, is het aantal velden van uw index 25. Indexen met een zeer grote verzameling velden kunnen traag zijn. Beperk velden en kenmerken tot alleen de velden en kenmerken die u nodig hebt, en voer indexering en querytest uit om ervoor te zorgen dat de prestaties acceptabel zijn.
3 Er bestaat een bovengrens voor elementen omdat met een groot aantal elementen de benodigde opslagruimte voor uw index aanzienlijk wordt verhoogd. Een element van een complexe verzameling wordt gedefinieerd als lid van die verzameling. Stel bijvoorbeeld dat er een hoteldocument met een complexe verzameling kamers is. Elke kamer in de collectie Ruimten wordt beschouwd als een element. Tijdens het indexeren kan de indexeringsengine maximaal 3000 elementen in het hele document veilig verwerken.
Deze limiet is alleen geïntroduceerd in api-version=2019-05-06 complexe verzamelingen en is niet van toepassing op tekenreeksverzamelingen of complexe velden.
4 Voor de meeste lagen is de maximale indexgrootte de totale beschikbare opslag in uw zoekservice. Voor S2-, S3- en S3 HD-services met meerdere partities en dus meer opslag, wordt de maximale grootte van één index in de tabel geboden. Van toepassing op zoekservices die zijn gemaakt na 3 april 2024. Indexen voor services die zijn ingesteld met het serverloze model (preview) hebben een ingestelde maximale grootte in de tabel.
Mogelijk vindt u een aantal variaties in maximumlimieten als uw service wordt ingericht op een krachtiger cluster. De limieten hier vertegenwoordigen de gemeenschappelijke noemer. Indexen die zijn gebouwd aan de bovenstaande specificaties, zijn overdraagbaar over equivalente servicelagen in elke regio.
Documentlimieten
Elke index ondersteunt maximaal het volgende aantal documenten:
- 24 miljard op Basic, S1, S2 en S3
- 2 miljard op S3 HD
- 288 miljard op L1
- 576 miljard op L2
Elk document kan maximaal 16 mb groot zijn. De documentgroottelimiet is in feite van toepassing op de grootte van de nettolading van de indexerings-API-aanvraag, namelijk 16 mb. Die payload kan uit één document of een batch documenten bestaan. Voor een batch met één document is de maximale documentgrootte 16 MB JSON.
De limiet voor documentgrootte is van toepassing op pushmodusindexering waarmee documenten worden geüpload naar een zoekservice. Als u een indexeerfunctie gebruikt voor indexering in de pull-modus , kunnen uw bronbestanden elke bestandsgrootte hebben, afhankelijk van de limieten van de indexeerfunctie. Voor de blob-indexeerfunctie zijn de bestandsgroottelimieten groter voor hogere lagen. De S1-limiet is bijvoorbeeld 128 megabytes, de S2-limiet is 256 megabytes, enzovoort.
Wanneer u een schatting maakt van de documentgrootte, moet u alleen de velden indexeren die waarde toevoegen aan uw zoekscenario's. Sluit bronvelden uit die geen doel hebben in de query's die u wilt uitvoeren.
Limieten voor de grootte van vectorindexen
Wanneer u documenten indexeert met vectorvelden, maakt Azure AI Zoeken interne vectorindexen met behulp van de algoritmeparameters die u opgeeft.
De grootte van deze vectorindexen wordt beperkt door:
- Het geheugen dat is gereserveerd voor de vectorzoekfunctie voor het serviceniveau van uw service (of
SKU) in het Dedicated-prijsmodel. - Opslaglimieten per index in het serverloze prijsmodel.
Zie Vector-indexgrootte en onder limieten blijven voor hulp bij het beheren en maximaliseren van vectoropslag.
Vectorlimieten variëren naar:
Vanaf april 2024 zijn er hogere vectorlimieten voor nieuwe zoekdiensten in regio's die de extra capaciteit bieden, wat de meeste regio's zijn. Als u een oudere service in een ondersteunde regio hebt, controleert u of u uw service kunt upgraden naar de hogere vectorlimieten.
In het serverloze prijsmodel worden vectorlimieten per index gedefinieerd in plaats van per partitie.
-
Maximale grootte van vectorindexen per index (serverloos): 300 MB
- Deze grootte vertegenwoordigt ongeveer 30% van de totale indexopslag, consistent met de vector-naar-opslagverhouding die wordt gebruikt in toegewezen servicelagen.
- Deze grootte is een vaste limiet per index. Pogingen om deze limiet tijdens het indexeren te overschrijden, mislukken.
In deze tabel ziet u de voortgang van de toename van vectorquota in GB in de loop van de tijd. Het quotum is per partitie, dus als u een nieuwe Standard-service (S1) schaalt naar 6 partities, is het totale vectorquotum 35 vermenigvuldigd met 6.
| Aanmaakdatum van service | Eenvoudig | S1 | S2 | S3/HD | L1 | L2 |
|---|---|---|---|---|---|---|
| Vóór 1 juli 20231 | 0,5 | 1 | 6 | 12 | 12 | 36 |
| 1 juli 2023 tot en met 3 april 20242 | 1 | 3 | 12 | 36 | 12 | 36 |
| 3 april 2024 tot en met 17 mei 20243 | 5 | 35 | 150 | 300 | 12 | 36 |
| Na 17 mei 20244 | 5 | 35 | 150 | 300 | 150 | 300 |
1 Initiële vectorlimieten tijdens vroege preview.
2 Vectorlimieten tijdens de latere preview-periode. Drie regio's hadden niet de hogere limieten: Duitsland - west-centraal, India - west, Qatar - centraal.
3 Hoger vectorquotum op basis van de grotere partities voor ondersteunde lagen en regio's.
4 Hoger vectorquotum voor meer lagen en regio's op basis van updates van partitiegrootte.
De service dwingt een quotum voor vectorindexgrootte af:
- Gereserveerd: Per partitie in uw zoekservice
- Serverloos: Per index
Dit quotum is een vaste limiet om ervoor te zorgen dat uw service in orde blijft. Verdere indexeringspogingen zodra de limiet is overschreden, resulteert in een fout. U kunt indexering hervatten nadat u het beschikbare quotum hebt vrijgemaakt door:
- Vectordocumenten verwijderen
- Vectorgrootte of dimensionaliteit verkleinen
- (Alleen toegewezen) Partities uitschalen
Belangrijk
Hogere vectorlimieten zijn gekoppeld aan grotere partitiegrootten. Momenteel zijn hogere vectorlimieten niet beschikbaar in de volgende regio's, die onderhevig zijn aan de limieten van juli tot april.
- Israël Centraal
- Qatar Centrale
- Spanje - centraal
- Zuid-India
Limieten voor indexeerfuncties
Er bestaan maximale uitvoeringstijden om de service in zijn geheel evenwicht en stabiliteit te bieden, maar grotere gegevenssets hebben mogelijk meer indexeringstijd nodig dan het maximum toestaat. Als een indexeringstaak niet kan worden voltooid binnen de toegestane maximale tijd, voert u deze uit volgens een schema. De scheduler houdt de indexeringsstatus bij. Als een geplande indexeringstaak om welke reden dan ook wordt onderbroken, kan de indexeerfunctie ophalen waar deze voor het laatst is gebleven bij de volgende geplande uitvoering.
Opmerking
In het Serverless-prijsmodel verschilt het gedrag van indexers van Dedicated-services. Capaciteit wordt niet bepaald door replica's of partities. In plaats daarvan bepalen limieten per serviceobject, opslaglimieten per index en beperking op serviceniveau de indexeringslimieten. Als gevolg hiervan zijn sommige limieten, zoals maximale uitvoeringstijd, geen vaste waarden.
| Hulpbron | Gratis 1 | Basic 2 | S1 | S2 | S3 | S3 HD 3 | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Maximum aantal indexeerders | 3 | 5 of 15 | 50 | 200 | 200 | Niet van toepassing. | 10 | 10 | 30 |
| Maximum aantal gegevensbronnen | 3 | 5 of 15 | 50 | 200 | 200 | Niet van toepassing. | 10 | 10 | 30 per dienst |
| Maximale vaardigheden 4 | 3 | 5 of 15 | 50 | 200 | 200 | Niet van toepassing. | 10 | 10 | 30 |
| Maximale indexeringsbelasting per aanroep | 10.000 documenten | Alleen beperkt door maximaal aantal documenten | Alleen beperkt door maximaal aantal documenten | Alleen beperkt door maximaal aantal documenten | Alleen beperkt door maximaal aantal documenten | Niet van toepassing. | Geen limiet | Geen limiet | Alleen beperkt door maximaal aantal documenten |
| Minimaal rooster | 5 minuten | 5 minuten | 5 minuten | 5 minuten | 5 minuten | 5 minuten | 5 minuten | 5 minuten | 5 minuten |
| Maximale looptijd 5 | 1-3 of 3-10 min. | 2 of 24 uur | 2 of 24 uur | 2 of 24 uur | 2 of 24 uur | Niet van toepassing. | 2 of 24 uur | 2 of 24 uur | 2 uur |
| Blob-indexeerfunctie 7: maximale blobgrootte, MB | 16 | 16 | 128 | 256 | 256 | Niet van toepassing. | 256 | 256 | 256 |
| Blob-indexeerfunctie: maximum aantal tekens van inhoud dat is geëxtraheerd uit een blob 68 | 256,000 | 512.000 | 4 mil | 8 mil | 16 mil | Niet van toepassing. | 4 mil | 4 mil | 16 mil |
1 Gratis diensten hebben een maximale uitvoeringsduur van 3 minuten voor indexers bij blobbronnen en 1 minuut voor alle andere gegevensbronnen. De aanroep van de indexeerfunctie is eenmaal per 180 seconden. Voor AI-indexering waarbij Foundry Tools worden aangeroepen, zijn gratis services beperkt tot 20 gratis transacties per indexeerder per dag, waarbij een transactie wordt gedefinieerd als een document dat de verrijkingspijplijn succesvol heeft doorlopen. (Tip: u kunt een indexeerfunctie opnieuw instellen om het aantal opnieuw in te stellen.)
2 Basisservices die vóór december 2017 zijn gemaakt, hebben lagere limieten (5 in plaats van 15) voor indexeerfuncties, gegevensbronnen en vaardighedensets.
3 Ondersteuning voor S3 HD-indexeerfuncties is beschikbaar als preview, vereist REST API-versie 2025-11-01-preview of hoger en valt onder een dagelijks quotum op serviceniveau van zes uur aan cumulatieve uitvoeringstijd van indexeerfuncties voor alle indexeerfuncties samen. S3 HD-indexeerfuncties worden alleen uitgevoerd in de omgeving met meerdere tenants en bieden geen ondersteuning voor gedeelde private link-resources. In de previewfase is ondersteuning voor de S3 HD-indexer het meest geschikt voor kleine werklasten (met een indexgrootte van ongeveer 1 GB) zonder skillsets of met slechts minimale skillsets. Zie De uitvoering van de indexeerfunctie voor serverloze en S3 HD voor meer informatie.
4 Maximaal 30 vaardigheden per vaardighedenset.
5 Met betrekking tot de maximale duur van 2 of 24 uur voor indexeerfuncties: een maximum van 2 uur is het meest gebruikelijk en het is waarvoor u moet plannen. Het verwijst naar indexeerders die worden uitgevoerd in de openbare omgeving, die rekenintensieve verwerking uitbesteedt en meer resources voor queries vrijmaakt. De limiet van 24 uur is van toepassing als u de indexeerfunctie configureert voor uitvoering in een privéomgeving met alleen de infrastructuur die is toegewezen aan uw zoekservice. Sommige oudere indexeerfuncties kunnen niet worden uitgevoerd in de openbare omgeving en die indexeerfuncties hebben altijd een verwerkingsbereik van 24 uur. Als u ongeplande indexeerfuncties hebt die gedurende 24 uur continu worden uitgevoerd, kunt u ervan uitgaan dat deze indexeerfuncties niet naar de nieuwere infrastructuur kunnen worden gemigreerd. Als algemene regel moet voor taken die niet binnen twee uur kunnen worden voltooid, de indexer een schema van 5 minuten volgen, zodat de indexer snel kan doorgaan waar hij was gebleven. In de gratis laag is de maximale uitvoeringstijd van 3-10 minuten voor indexeerfuncties met vaardighedensets.
6 Het maximum aantal tekens is gebaseerd op Unicode-code-eenheden, met name UTF-16.
7 Wanneer u de parseermodus voor CSV-bestanden gebruikt delimitedText , is een buffergroottelimiet van 10 MB per bestandsrij van toepassing.
8 Wanneer u de parseermodus voor CSV-bestanden gebruikt delimitedText , is de limiet voor 'maximale geëxtraheerde inhoudsgrootte' niet van toepassing.
Resourcelimieten voor gedeelde privékoppelingen
Indexeerfuncties hebben toegang tot andere Azure-resources via privé-eindpunten die worden beheerd via de gedeelde private link-resource-API. In deze sectie worden de limieten beschreven die aan deze mogelijkheid zijn gekoppeld.
Opmerking
De Developer-laag van het serverloze prijsmodel ondersteunt gedeelde privékoppelingen of de netwerkbeveiligingsperimeter (NSP) naar gegevensbronnen niet. Privé-eindpunten en IP-firewallregels voor een privéverbinding met een serverloze service voor ontwikkelaars worden ondersteund.
| Hulpbron | Gratis | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Ondersteuning voor indexeerfunctie voor privé-eindpunten | Nee. | Ja | Ja | Ja | Ja | Nee. | Ja | Ja | Nee. |
| Ondersteuning voor privé-eindpunten voor indexeerfuncties met een vaardighedenset 1 | Nee. | Nee. | Ja | Ja | Ja | Nee. | Ja | Ja | Nee. |
| Ondersteuning voor privé-eindpunten voor vaardighedensets met een insluitingsvaardigheid 2 | Nee. | Ja | Ja | Ja | Ja | Nee. | Ja | Ja | Nee. |
| Maximum aantal privé-eindpunten | Niet van toepassing. | 10 ofwel 30 | 100 | 400 | 400 | Niet van toepassing. | 20 | 20 | Niet van toepassing. |
| Maximum aantal afzonderlijke resourcetypen 3 | Niet van toepassing. | 4 | 7 | 15 | 15 | Niet van toepassing. | 4 | 4 | Niet van toepassing. |
1 AI-verrijking en afbeeldingsanalyse zijn rekenintensief en verbruiken onevenredige hoeveelheden beschikbare verwerkingskracht. Daarom worden privéverbindingen uitgeschakeld op lagere lagen om de prestaties en stabiliteit van de zoekservice zelf te garanderen. In Basic-services worden privéverbindingen met een Microsoft Foundry-resource niet ondersteund om de stabiliteit van de service te behouden. Controleer voor de S1-laag of de service is gemaakt met hogere limieten na 3 april 2024. Indexeerfuncties met meer dan 2 Azure OpenAI Embedding- of Azure Vision multimodale insluitingsvaardigheden kunnen niet worden uitgevoerd in een privéomgeving en privéverbindingen zijn niet beschikbaar.
2 Privéverbindingen met een embedded model worden ondersteund voor Basic- en S1 zoekdiensten met hoge capaciteit die zijn gecreëerd na 3 april 2024, met de hogere limieten voor opslag en computatieve verwerking.
3 Het aantal afzonderlijke resourcetypen wordt berekend als het aantal unieke groupId waarden dat wordt gebruikt voor alle gedeelde private link-resources voor een bepaalde zoekservice, ongeacht de status van de resource.
Limieten voor synoniemen
Het maximum aantal synoniemenkaarten verschilt per laag. Elke regel kan maximaal 20 uitbreidingen hebben, waarbij een uitbreiding een equivalente term is. Neem bijvoorbeeld "kat": de associatie met "kitty", "feline" en "felis" (het geslacht van katten) telt als drie expansies.
| Hulpbron | Gratis | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Maximum aantal synoniemenkaarten | 3 | 3 | 5 | 10 | 20 | 20 | 10 | 10 | 20 per dienst |
| Maximum aantal regels per kaart | 5.000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 |
Limieten voor indexalias
Het maximum aantal indexaliassen varieert per laag en de aanmaakdatum van de service. Als de service op alle lagen na oktober 2022 is gemaakt, is het maximale aantal aliassen het dubbele van het maximale aantal toegestane indexen. Als de service vóór oktober 2022 is gemaakt, is de limiet het aantal toegestane indexen.
Opmerking
De serverloze modelontwikkelaarslaag biedt geen ondersteuning voor indexaliassen.
| Aanmaakdatum van service | Gratis | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Vóór oktober 2022 | 3 | 5 of 15 1 | 50 | 200 | 200 | 1000 per partitie ofwel 3000 per service | 10 | 10 | Niet van toepassing. |
| Na oktober 2022 | 6 | 30 | 100 | 400 | 400 | 2000 per partitie of 6000 per dienst | 20 | 20 | Niet van toepassing. |
1 Basisservices die vóór december 2017 zijn gemaakt, hebben lagere limieten (5 in plaats van 15) voor indexen.
Limieten voor agentisch ophalen
Een knowledge base bevat een of meer kennisbronnen en een poging om een redenering op te halen waarmee het niveau van LLM-verwerking (Large Language Model) voor agentisch ophalen wordt bepaald. Limieten variëren per prijscategorie, API-versie en redeneringsniveau.
| Hulpbron | Gratis | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|---|
| Maximum aantal kennisbronnen per service | 3 | 5 of 15 1 | 50 | 200 | 200 | 0 | 10 | 10 | 30 |
| Maximum aantal kennisbanken per service | 3 | 5 of 15 1 | 50 | 200 | 200 | 0 | 10 | 10 | 30 |
Maximum aantal kennisbronnen per knowledge base (minimal) 2 |
3 | 5 of 10 1 | 10 | 10 | 10 | 0 | 10 | 10 | 10 |
Maximum aantal kennisbronnen per knowledge base (low) |
3 | 3 | 3 | 3 | 3 | 0 | 3 | 3 | 3 |
Maximum aantal kennisbronnen per knowledge base (medium) |
3 | 5 | 5 | 5 | 5 | 0 | 5 | 5 | 5 |
1 Basisservices die vóór 3 april 2024 zijn gemaakt, hebben lagere limieten (5) voor kennisbronnen en knowledge bases.
Kennisbronnen per kennisbank
Limieten per knowledge base voor kennisbronnen zijn afhankelijk van de API-versie die wordt gebruikt om de knowledge base te maken of bij te werken. In alle 2026-05-01-previewpogingen tot retrieval-redenering gelden dezelfde beperkingen voor kennisbronnen. Eerdere preview-API-versies hebben lagere limieten voor low en medium redeneringsinspanningen.
| API-versie | Inspanning voor herwinning en verwerking van redenering | Gratis | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 |
|---|---|---|---|---|---|---|---|---|---|
2026-05-01-preview |
minimal, , lowmedium |
3 | 5 of 10 1 | 10 | 10 | 10 | 0 | 10 | 10 |
2026-05-01-preview, 2025-08-01-preview |
minimal
2 |
3 | 5 of 10 1 | 10 | 10 | 10 | 0 | 10 | 10 |
2026-05-01-preview, 2025-08-01-preview |
low |
3 | 3 | 3 | 3 | 3 | 0 | 3 | 3 |
2026-05-01-preview, 2025-08-01-preview |
medium |
3 | 5 | 5 | 5 | 5 | 0 | 5 | 5 |
2 In eerdere preview-API-versies ondersteunt de minimal redenering meer kennisbronnen dan low of medium omdat hiermee queryplanning op basis van LLM wordt overgeslagen.
Gegevenslimieten (AI-verrijking)
Gegevenslimieten zijn van toepassing op een AI-verrijkingspijplijn die aanroept naar Azure Language in Foundry Tools voor entiteitsherkenning, entiteitskoppeling, sleuteltermextractie, sentimentanalyse, taaldetectie en detectie van persoonlijke gegevens.
De maximale grootte van een record is 50.000 tekens zoals gemeten door String.Length. Als u uw gegevens wilt opsplitsen voordat u deze naar de sentimentanalyse verzendt, gebruikt u de vaardigheid Tekst splitsen.
Deze limieten zijn van toepassing op zowel dedicated- als serverloze prijsmodellen.
Snelheidsbeperkingen
Beperkingslimieten helpen de stabiliteit van de service te garanderen door de snelheid van API-aanvragen te beheren.
In het Dedicated-prijsmodel is throttling gebaseerd op zoekeenheden (replica’s × partities).
In het Serverless-prijsmodel wordt throttling niet gebaseerd op zoekeenheden. In plaats daarvan bepalen bewerkingslimieten op serviceniveau en het algehele verbruiksgedrag de doorvoer. Gebruiks- en servicelimieten beheren capaciteit, niet de configuratie van replica's en partities.
| Operatie | Gereserveerd (per zoekeenheid) | Serverloos (per service of per index) |
|---|---|---|
| Lijst met indexen (GET /indexes) | 3 aanvragen per seconde/SU | 3 aanvragen per seconde |
| Index ophalen (GET /indexes/{index}) | 10 aanvragen per seconde/SU | 10 aanvragen per seconde |
| Index maken (POST/indexen) | 12 aanvragen/min/SU | 12 aanvragen/min. |
| Index maken of bijwerken (PUT /indexes/{index}) | 6 aanvragen per seconde/SU | 6 aanvragen per seconde |
| Index verwijderen (DELETE /indexes/{index}) | 12 aanvragen/min/SU | 12 aanvragen/min. |
| Servicestatistieken (GET /servicestats) | 4 aanvragen per seconde/SU | 4 aanvragen per seconde |
| Zoekopdrachten (POST /indexes/{index}/docs/search) | Afhankelijk van het aantal SU's en de complexiteit van query's | 50 query's per seconde (cumulatieve leesbeperking per index) |
| Indexdocumenten (POST /indexes/{index}/docs/index) | Verschilt per aantal SU’s en indexeringswerklast | 5 aanvragen per seconde per index |
| Voorstellen (POST /indexes/{index}/docs/suggest) | Varieert per aantal SU's | Niet expliciet gedefinieerd |
| Automatisch aanvullen (POST /indexes/{index}/docs/autocomplete) | Varieert per aantal SU's | Niet expliciet gedefinieerd |
Limieten voor semantische rangschikker
Semantische ranker maakt gebruik van een wachtrijsysteem voor het beheren van gelijktijdige aanvragen. Met dit systeem kunnen zoekservices het hoogste aantal query's per seconde ophalen. Wanneer de limiet van gelijktijdige aanvragen is bereikt, plaatst het systeem extra aanvragen in een wachtrij. Als de wachtrij vol is, weigert het systeem verdere aanvragen en moeten ze opnieuw worden geprobeerd.
Het totale aantal query’s van de semantische rangschikker per seconde hangt af van de volgende factoren:
- De laag van de zoekservice. Zowel wachtrijcapaciteit als gelijktijdige aanvraaglimieten variëren per laag.
- Het aantal zoekeenheden in de zoekservice. De eenvoudigste manier om het maximum aantal gelijktijdige semantische rankerquery's te verhogen, is door meer zoekeenheden toe te voegen aan uw zoekservice.
- De totale beschikbare semantische rangschikkingscapaciteit in de regio.
- De hoeveelheid tijd die nodig is om een query uit te voeren met behulp van een semantische ranker. Deze tijd varieert op basis van hoe druk de zoekservice is.
In de volgende tabel worden de semantische rangschikkingslimieten per laag beschreven, afhankelijk van de beschikbare capaciteit in de regio. U kunt contact opnemen met Microsoft-ondersteuning om een limietverhoging aan te vragen.
| Hulpbron | Eenvoudig | S1 | S2 | S3 | S3 HD | L1 | L2 | Serverloze ontwikkelaar |
|---|---|---|---|---|---|---|---|---|
| Maximum aantal gelijktijdige aanvragen (per zoekeenheid) | 2 | 3 | 4 | 4 | 4 | 4 | 4 | 4 (per dienst) |
| Maximale grootte van aanvraagwachtrij (per zoekeenheid) | 4 | 6 | 8 | 8 | 8 | 8 | 8 | 8 (per service) |
API-aanvraaglimieten
Er bestaan limieten voor query's omdat niet-gebonden query's uw zoekservice kunnen stabiliseren. Dergelijke query's worden doorgaans programmatisch gemaakt. Als uw toepassing programmatisch zoekquery's genereert, ontwerpt u deze zodat er geen query's van niet-gebonden grootte worden gegenereerd.
Limieten voor nettoladingen bestaan om vergelijkbare redenen, waardoor de stabiliteit van uw zoekservice wordt gewaarborgd. De limiet is van toepassing op de volledige aanvraag, inclusief alle onderdelen. Als de aanvraag bijvoorbeeld meerdere documenten of opdrachten batcheert, moet de hele aanvraag binnen de ondersteunde limiet passen.
Als u een ondersteunde limiet moet overschrijden, test u uw workload zodat u weet wat u kunt verwachten.
Behalve waar vermeld, zijn de volgende API-aanvragen van toepassing op alle programmeerbare interfaces, inclusief de Azure SDK's.
Algemeen:
- De ondersteunde maximale nettoladinglimiet is 16 MB voor indexering en queryaanvraag via REST API en SDK's.
- Maximale URL-lengte van 8 kB (alleen van toepassing op REST API's).
API's indexeren:
- Maximaal 1.000 documenten per batch voor indexuploads, samenvoegingen, of verwijderingen ondersteund.
- Elke aanvraag ondersteunt tussen 1 en 32.000 indexeringsacties.
Query-API's:
- Maximaal 10 velden in een vectorquery
- Maximaal 32 velden in $orderby clausule.
- Maximaal 100.000 tekens in een zoekcomponent.
- Het maximum aantal componenten in de zoekopdracht is 3000.
- Maximale limieten voor query's met jokertekens en reguliere expressies, zoals afgedwongen door Lucene. Het beperkt het aantal patronen, variaties of overeenkomsten tot 1.000 exemplaren. Deze limiet is ingesteld om te voorkomen dat de motor overbelast raakt.
Zoektermen:
- De ondersteunde maximale zoektermgrootte is 32.766 bytes (32 kB minus 2 bytes) van UTF-8-gecodeerde tekst. Van toepassing op trefwoordzoekopdrachten en de teksteigenschap van vectorzoekopdrachten.
- De maximale zoektermgrootte wordt ondersteund door 1000 tekens voor zoeken in voorvoegsels en regex-zoekopdrachten.
API-antwoordlimieten
- Elke pagina met zoekresultaten retourneert maximaal 1000 documenten.
- Elke Suggest API-aanvraag retourneert maximaal 100 suggesties.
De zoekmachine retourneert standaard 50 resultaten, maar u kunt deze parameter tot aan de maximumlimiet overschrijven .
API-sleutellimieten
API-sleutels gebruiken voor serviceverificatie. Er bestaan twee typen API-sleutels. Beheerderssleutels, die u opgeeft in de aanvraagheader, bieden volledige lees-/schrijftoegang tot de service. Querysleutels die u in de URL opgeeft, zijn alleen-leesbaar en worden doorgaans gedistribueerd aan clienttoepassingen.
- Elke service ondersteunt maximaal twee beheerderssleutels.
- Elke service ondersteunt maximaal 50 querysleutels.