Tjänstbegränsningar i Azure AI-sökning

Anteckning

Azure AI-sökning är tillgängligt via Azure-portalen, REST-API:er och Azure-SDK:er. Den ligger också till grund för Foundry IQ, det hanterade kunskapsskiktet som omvandlar företagsinnehåll till återanvändbara, behörighetsmedvetna kunskapsbaser för agenter i Microsoft Foundry-portalen.

Maximala gränser för lagring, arbetsbelastningar och mängder index och andra objekt beror på prismodellen för din Azure AI-sökning-tjänst.

Azure AI-sökning stöder två prismodeller, var och en med associerade tjänstnivåer. Den nivå du väljer påverkar de tjänstgränser som beskrivs i den här vägledningen.

  • Dedikerad: Fast prissättning mätt i sökenheter (SU). Bland alternativen på tjänstnivån finns: Basic, Standard (S1-S3, inklusive S3 HD), Lagringsoptimerad (L1-L2) och en kostnadsfri nivå med begränsade söktjänstfunktioner.
  • Serverlös (förhandsversion): Förbrukningsbaserad prissättning mätt med beräkningsenheter per timme (CU/hr) och per GB/månad för indexerad lagring. Den aktuella förhandsgranskningsnivån är: Serverlös utvecklare. Gränser definieras av tak per index, antal objekt per tjänst och begränsningsbeteendet i Serverless.

Viktigt!

Nivån Serverless Developer är för närvarande i förhandsversion. Den här förhandsversionen tillhandahålls utan ett serviceavtal och rekommenderas inte för produktionsarbetsbelastningar. Vissa funktioner kanske inte stöds eller kan vara begränsade. Mer information finns i Kompletterande villkor för användning av Microsoft Azure-förhandsversioner.

Fakturering för nivån Serverlös utvecklare är ännu inte aktiverad under förhandsversionen. Uppskattade kostnader för din användning är tillgängliga i Azure-portalen och telemetrin, men den användningen visas inte på din Azure faktura under den första perioden. Microsoft anger minst 30 dagars varsel innan faktureringen börjar. Uppskjutning av fakturering under den här förhandsversionen är tillfällig. Serverlös utvecklare är en betald nivå och du kommer att ansvara för eventuella avgifter som ackumuleras när faktureringen börjar.

Nivån Serverlös utvecklare stöder inte migrering till eller från andra prisnivåer och vissa funktioner som är tillgängliga på andra nivåer stöds inte under den offentliga förhandsversionen. Tjänstbegränsningar, funktioner som stöds och prisinformation kan ändras före allmän tillgänglighet.

Förhandsversionen är för närvarande endast tillgänglig i USA, västra centrala, Schweiz, norra och Japan, östra.

Mer information finns i Välj en prismodell och tjänstnivå.

Diagnostisera kvot-, kapacitets- eller gränsfel

Kvot- och kapacitetsfel kommer från separata kontroller. Använd felet från den slutförda åtgärden för att hitta vilken som gäller.

Om en åtgärd för att skapa, skala eller uppgradera fortfarande körs väntar du på att etableringstillståndet ska bli Succeeded eller Failed. En pågående åtgärd är inte ett bevis på ett kvot- eller kapacitetsproblem. Om en skalningsåtgärd misslyckas kan du läsa Fel under skalning.

Failure Sannolik orsak Första åtgärden
Skapande av tjänst blockerad i en prenumeration och region Prenumerationskvot I tjänsten Kvoter kontrollerar du gränsen för din nivå och region och begär sedan fler tjänster.
Det går inte att skapa, skala eller uppgradera trots att kvoten är tillgänglig Villkor för regional kapacitet Kontrollera fotnoterna i regionstöd för begränsade nivåer och välj sedan en annan region.
Replik-, partitions-, nivå- eller objektbegäran avvisad Tjänst- eller indexgräns Jämför antalet konfigurationer och objekt med tjänstgränser och indexgränser.
Söktjänsten returnerar begränsningssvar under belastning Throttling Minska begärandefrekvensen eller lägg till sökenheter. Se Begränsningar.
Indexering misslyckas nära en lagrings- eller vektorgräns Lagrings- eller vektorkvot Jämför storageSize med partitionslagring för disk och vectorIndexSize med storleksbegränsningar för vektorindex för minne.
Indexerare, kompetens eller vektoriserare rapporterar 429 från en annan tjänst Azure OpenAI eller annan tjänstkvot Följ kvotvägledningen för tjänsten som utfärdade felet, till exempel Azure OpenAI.

Tillgänglig prenumerationskvot garanterar inte regional kapacitet och att begära mer kvot löser inte en kapacitetsbegränsning. Om felet kvarstår öppnar du en Azure support begäran som innehåller prenumeration, region, nivå, begärd konfiguration, fullständig feltext, UTC-tid och eventuella korrelations- eller åtgärds-ID.

Prenumerationsgränser

Du kan skapa flera fakturerbara söktjänster (Basic och högre), upp till det maximala antalet tjänster som tillåts på varje nivå, per region. Du kan till exempel skapa upp till 16 tjänster på basic-nivån och ytterligare 16 tjänster på S1-nivån inom samma prenumeration och region. Du kan sedan skapa ytterligare 16 Grundläggande tjänster i en annan region för sammanlagt 32 Basic-tjänster under samma prenumeration. Mer information om tjänstnivåer finns i Välj en prismodell och tjänstnivå.

Du kan höja maximala tjänstgränser efter begäran. Om du behöver fler tjänster i samma prenumeration skickar du en supportbegäran.

Resurs Gratis 1 Grundläggande S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Maximalt antal tjänster per region 1 16 16 8 6 6 6 6 5
Maximalt antal sökenheter (SU)2 Ej tillämpligt 3 SU 36 SU 36 SU 36 SU 36 SU 36 SU 36 SU Ej tillämpligt

1 Du kan ha en kostnadsfri söktjänst per Azure-prenumeration. Den kostnadsfria nivån baseras på infrastruktur som delas med andra kunder. Eftersom maskinvaran inte är dedikerad stöds inte uppskalning och lagringen är begränsad till 50 MB. En kostnadsfri söktjänst kan tas bort efter längre perioder av inaktivitet för att göra plats för fler tjänster.

2 Sökenheter (SU) är faktureringsenheter som fördelats som antingen en replik eller en partition. Du behöver båda. Mer information om SU-kombinationer finns i Uppskatta och hantera kapaciteten för en söktjänst.

Tjänstbegränsningar

I prismodellen Dedikerad planerar du kapacitet genom att multiplicera repliker med partitioner (sökenheter).

Resurs Kostnadsfri Grundläggande S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Partitioner Ej tillämpligt 3 1 12 12 12 3 12 12 Ej tillämpligt
Replikor Ej tillämpligt 3 12 12 12 12 12 12 Ej tillämpligt

1 Basic-nivån stöder tre partitioner och tre repliker, för totalt nio sökenheter (SU) på nya söktjänster som skapats efter den 3 april 2024. Äldre Basic-tjänster är begränsade till en partition och tre repliker.

En söktjänst omfattas av en maximal lagringsgräns (partitionsstorlek multiplicerat med antalet partitioner) eller en hård gräns för det maximala antalet index eller indexerare, beroende på vilken gräns som kommer först.

Avtal om servicenivå (SLA) gäller för fakturerbara tjänster som har två eller flera replikat för frågearbetsbelastningar, eller tre eller flera replikat för arbetsbelastningar inom frågor och indexering. Antalet partitioner är inte ett SLA-övervägande. Mer information finns i Tillförlitlighet i Azure AI-sökning.

Kostnadsfria tjänster har inte fasta partitioner eller repliker och delar resurser med andra prenumeranter.

Partitionslagring (GB)

Lagringsgränserna per tjänst varierar beroende på två faktorer: datum för tjänstskapande och region. De flesta regioner som stöds har högre gränser för nyare tjänster.

Den här tabellen visar hur lagringskvoten ökar i GB över tid. Från och med april 2024 kom partitioner med högre kapacitet online i de regioner som anges i fotnoterna. Om du har en äldre tjänst i en region som stöds kontrollerar du om du kan uppgradera tjänsten för att få högre lagringsgränser.

Datum då tjänsten skapades Grundläggande S1 S2 S3/HD L1 L2 Serverlös utvecklare
Före den 3 april 2024 2 25 100 200 1,024 2 048 Ej tillämpligt
3 april 2024 till och med 17 maj 2024 1 15 160 512 1,024 1,024 2 048 Ej tillämpligt
Efter den 17 maj 2024 2 15 160 512 1,024 2,048 4,096 Ej tillämpligt
Efter den 10 februari 2025 3 15 160 512 1,024 2 048 4,096 Ej tillämpligt

1 Lagring med högre kapacitet för Basic, S1, S2 och S3 i dessa regioner. Amerika: Brasilien Syd, Kanada Central, Kanada Öst, USA Öst, USA Öst 2, USA Central, USA Nordcentral, USA Sydcentral, USA Väst, USA Väst 2, USA Väst 3, USA Västcentral. Europa: Frankrike, centrala. Italien, norra, Europa, norra, Norge, östra, Polen, centrala, Schweiz, norra, Sverige, centrala, Storbritannien, södra, Storbritannien, västra. Mellanöstern: Förenade Arabemiraten, norra. Afrika: Sydafrika, norra. Asien och stillahavsområdet: Australien, östra, Australien, sydöstra, Indien, centrala, Jio Indien, västra, Asien, östra, Sydostasien, Japan, östra, Japan, västra, Korea, centrala, Sydkorea, södra.

2 Lagring med högre kapacitet för L1 och L2. Fler regioner ger högre kapacitet på varje fakturerbar nivå. Americas: Östra USA 2 EUAP. Europa: Tyskland, norra, Tyskland, västra centrala, Schweiz, västra. Azure Government: Texas, Arizona, Virginia. Afrika: Sydafrika, norra. Asien och stillahavsområdet: Kina, norra 3, Kina, östra 3.

3 Lagring finns i Västeuropa med högre kapacitet.

Viktigt!

För närvarande är högre lagringsgränser inte tillgängliga i följande regioner, som omfattas av gränserna före den 3 april.

  • Israel Centrala
  • Qatars centralområde
  • Centrala Spanien
  • Södra Indien

Indexgränser

Resurs Kostnadsfri Grundläggande 1 S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Maximalt antal index 3 5 eller 15 50 200 200 1 000 per partition eller 3 000 per tjänst 10 10 30
Maximalt antal enkla fält per index 2 1 000 100 1 000 1 000 1 000 1 000 1 000 1 000 1 000
Maximala dimensioner per vektorfält 4096 4096 4096 4096 4096 4096 4096 4096 4096
Maximalt antal komplexa samlingar per index 40 40 40 40 40 40 40 40 40
Maximalt antal element i alla komplexa samlingar per dokument 3 3000 3000 3000 3000 3000 3000 3000 3000 3000
Maximalt djup för komplexa fält 10 10 10 10 10 10 10 10 10
Maximalt antal förslag per index 1 1 1 1 1 1 1 1 1
Maximalt antal bedömningsprofiler per index 100 100 100 100 100 100 100 100 100
Maximala semantiska konfigurationer per index 100 100 100 100 100 100 100 100 100
Maximalt antal funktioner per profil 8 8 8 8 8 8 8 8 8
Maximal indexstorlek 4 Ej tillämpligt Ej tillämpligt Ej tillämpligt 1,88 TB 2,34 TB 100 GB Ej tillämpligt Ej tillämpligt 1 GB

1 Grundläggande tjänster som skapades före december 2017 har lägre gränser (5 i stället för 15) för index. Basic-nivån är den enda nivån med en lägre gräns på 100 fält per index.

2 Den övre gränsen för fält innehåller både fält på första nivån och kapslade underfält i en komplex samling. Om ett index till exempel innehåller 15 fält och har två komplexa samlingar med fem underfält vardera är fältantalet för ditt index 25. Index med en mycket stor fältsamling kan vara långsamma. Begränsa fält och attribut till bara de du behöver och kör indexerings- och frågetestet för att säkerställa att prestandan är acceptabel.

3 Det finns en övre gräns för element eftersom ett stort antal av dem avsevärt ökar det lagringsutrymme som krävs för ditt index. Ett element i en komplex samling definieras som medlem i samlingen. Anta till exempel ett hotelldokument med en komplex samling rum. Varje rum i samlingen Rum anses vara ett element. Under indexeringen kan indexeringsmotorn på ett säkert sätt bearbeta högst 3 000 element i hela dokumentet. Den här gränsen infördes i api-version=2019-05-06 och gäller endast för komplexa samlingar och inte för strängsamlingar eller komplexa fält.

4 För de flesta nivåer är den maximala indexstorleken den totala tillgängliga lagringen i söktjänsten. För S2-, S3- och S3 HD-tjänster med flera partitioner och därmed mer lagring tillhandahålls den maximala storleken på ett enda index i tabellen. Gäller för söktjänster som skapats efter den 3 april 2024. Index för tjänster som har konfigurerats med den serverlösa modellen (förhandsversion) har en angivna maximal storlek i tabellen.

Du kan hitta en viss variation i maximala gränser om din tjänst råkar etableras i ett mer kraftfullt kluster. Gränserna här representerar den gemensamma nämnaren. Index som skapats enligt ovanstående specifikationer är portabla på motsvarande tjänstnivåer i alla regioner.

Dokumentbegränsningar

Varje index stöder upp till följande antal dokument:

  • 24 miljarder på Basic, S1, S2 och S3
  • 2 miljarder på S3 HD
  • 288 miljarder på L1
  • 576 miljarder på L2

Varje dokument kan vara upp till cirka 16 megabyte stort. Dokumentstorleksgränsen gäller faktiskt för storleken på nyttolasten för indexerings-API-begäran, som är 16 megabyte. Den nyttolasten kan vara ett enda dokument eller en grupp dokument. För en batch med ett enda dokument är den maximala dokumentstorleken 16 MB JSON.

Dokumentstorleksgränsen gäller för push-lägesindexering som laddar upp dokument till en söktjänst. Om du använder en indexerare för pull-lägesindexering kan källfilerna vara valfri filstorlek, med indexeringsgränser. För blobindexeraren är filstorleksgränserna större för högre nivåer. S1-gränsen är till exempel 128 megabyte, S2-gränsen är 256 megabyte och så vidare.

När du beräknar dokumentstorleken bör du bara indexera de fält som lägger till värde i dina sökscenarier. Exkludera källfält som inte har något syfte i de frågor som du tänker köra.

Storleksgränser för vektorindex

När du indexerar dokument med vektorfält skapar Azure AI-sökning interna vektorindex med hjälp av de algoritmparametrar du anger.

Storleken på dessa vektorindex begränsas av:

  • Det minne som är reserverat för vectorsökning för din tjänsts prisnivå (eller SKU) i prismodellen Dedicated.
  • Lagringsgränser per index i prismodellen Serverlös.

Vägledning om hur du hanterar och maximerar vektorlagring finns i Vektorindexstorlek och att hålla sig under gränser.

Vektorgränser varierar beroende på:

Det finns högre vektorgränser från april 2024 och framåt på nya söktjänster i regioner som tillhandahåller den extra kapaciteten, vilket är de flesta av dem. Om du har en äldre tjänst i en region som stöds kontrollerar du om du kan uppgradera tjänsten till de högre vektorgränserna.

I prismodellen Serverlös definieras vektorgränser per index i stället för per partition.

  • Maximal vektorindexstorlek per index (serverlös): 300 MB
    • Den här storleken representerar cirka 30% av den totala indexlagringen, vilket överensstämmer med förhållandet mellan vektor och lagring som används på dedikerade tjänstnivåer.
    • Denna storlek är en fast gräns per index. Försök att överskrida den här gränsen under indexering misslyckas.

Den här tabellen visar utvecklingen av vektorkvotökningar i GB över tid. Kvoten är per partition, så om du skalar en ny standardtjänst (S1) till 6 partitioner är den totala vektorkvoten 35 multiplicerad med 6.

Datum då tjänsten skapades Grundläggande S1 S2 S3/HD L1 L2
Före den 1 juli 20231 0,5 1 6 12 12 36
1 juli 2023 till 3 april 20242 1 3 12 36 12 36
3 april 2024 till och med 17 maj 20243 5 35 150 300 12 36
Efter den 17 maj 20244 5 35 150 300 150 300

1 Inledande vektorgränser under tidig förhandsversion.

2 Vektorgränser under den senare förhandsgranskningsperioden. Tre regioner hade inte de högre gränserna: Tyskland västra centrala, Västra Indien, Qatar centrala.

3 Högre vektorkvot baserat på de större partitionerna för nivåer och regioner som stöds.

4 Högre vektorkvot för fler nivåer och regioner baserat på uppdateringar av partitionsstorlek.

Tjänsten tillämpar en vektorindexstorlekskvot:

  • Dedikerad: Per partition i söktjänsten
  • Serverlös: Per index

Den här kvoten är en hård gräns för att säkerställa att tjänsten förblir felfri. Ytterligare indexeringsförsök när gränsen överskrids resulterar i fel. Du kan återuppta indexeringen när du frigör den tillgängliga kvoten genom att:

  • Ta bort vektordokument
  • Minska vektorstorlek eller dimensionalitet
  • (Endast dedikerad) Skala ut partitioner

Viktigt!

Högre vektorgränser är knutna till större partitionsstorlekar. För närvarande är högre vektorgränser inte tillgängliga i följande regioner, som omfattas av gränserna för juli–april.

  • Israel Centrala
  • Qatars centralområde
  • Centrala Spanien
  • Södra Indien

Indexerares gränser

Det finns maximala körningstider för att ge balans och stabilitet till tjänsten som helhet, men större datamängder kan behöva mer indexeringstid än vad maxgränsen tillåter. Om ett indexeringsjobb inte kan slutföras inom den maximala tillåtna tiden kan du prova att köra det enligt ett schema. Schemaläggaren håller reda på indexeringsstatusen. Om ett schemalagt indexeringsjobb avbryts av någon anledning kan indexeraren fortsätta från där det avbröts senast vid nästa schemalagda körning.

Anteckning

I prismodellen Serverlös skiljer sig indexerarens beteende från dedikerade tjänster. Kapaciteten definieras inte av repliker eller partitioner. I stället styr objektgränser per tjänst, lagringstak per index och begränsning på tjänstnivå indexeringsgränser. Därför är vissa gränser, till exempel maximal körningstid, inte fasta värden.

Resurs Gratis 1 Grundläggande 2 S1 S2 S3 S3 HD 3 L1 L2 Serverlös utvecklare
Maximalt antal indexerare 3 5 eller 15 50 200 200 Ej tillämpligt 10 10 30
Maximalt antal datakällor 3 5 eller 15 50 200 200 Ej tillämpligt 10 10 30 per tjänst
Högsta antal färdighetssätt 4 3 5 eller 15 50 200 200 Ej tillämpligt 10 10 30
Maximal indexeringsbelastning per förfrågan 10 000 dokument Begränsas endast av maximalt antal dokument Begränsas endast av maximalt antal dokument Begränsas endast av maximalt antal dokument Begränsas endast av maximalt antal dokument Ej tillämpligt Ingen begränsning Ingen begränsning Begränsas endast av maximalt antal dokument
Minsta schema 5 minuter 5 minuter 5 minuter 5 minuter 5 minuter 5 minuter 5 minuter 5 minuter 5 minuter
Maximal körningstid 5 1-3 eller 3-10 min 2 eller 24 timmar 2 eller 24 timmar 2 eller 24 timmar 2 eller 24 timmar Ej tillämpligt 2 eller 24 timmar 2 eller 24 timmar 2 timmar
Blob-indexerare 7: maximal blobstorlek, MB 16 16 128 256 256 Ej tillämpligt 256 256 256
Blob-indexerare: maximalt antal tecken med innehåll som extraherats från en blob 68 256,000 512 000 4 mil 8 mil 16 mil Ej tillämpligt 4 mil 4 mil 16 mil

1 Kostnadsfria tjänster har en maximal körtid på 3 minuter för blobkällor och 1 minut för alla andra datakällor. Indexerarens anrop är en gång var 180:e sekund. För AI-indexering som anropar Foundry Tools är kostnadsfria tjänster begränsade till 20 kostnadsfria transaktioner per indexerare per dag, där en transaktion definieras som ett dokument som passerar genom berikningspipelinjen. (Tips: Du kan återställa en indexerare för att återställa antalet.)

2 Grundläggande tjänster som skapades före december 2017 har lägre gränser (5 i stället för 15) för indexerare, datakällor och kompetensuppsättningar.

3 S3 HD-indexerare stöds i förhandsversion, kräver REST API-version 2025-11-01-preview eller senare och omfattas av en daglig kvot på tjänstenivå på sex timmars sammanlagd körtid för indexerare, som delas av alla indexerare. S3 HD-indexerare körs endast i körningsmiljön för flera klientorganisationer och stöder inte delade privata länkresurser. I förhandsversionen lämpar sig S3 HD-indexeraren bäst för små arbetsbelastningar (cirka 1 GB indexstorlek) utan eller med endast minimala kunskapsuppsättningar. Mer information finns i Körning av Indexer på Serverless och S3 HD.

4 Högst 30 färdigheter per kompetensuppsättning.

5 Vad gäller den maximala varaktigheten på 2 eller 24 timmar för indexerare: ett maxvärde på 2 timmar är det vanligaste och det är vad du bör planera för. Den refererar till indexerare som körs i den offentliga miljön, som avlastar beräkningsintensiv bearbetning och lämnar fler resurser för frågor. Gränsen på 24 timmar gäller om du konfigurerar indexeraren att köras i en privat miljö med endast den infrastruktur som har allokerats till söktjänsten. Vissa äldre indexerare kan inte köras i den offentliga miljön, och dessa indexerare har alltid ett 24-timmars bearbetningsintervall. Om du har oplanerade indexerare som körs kontinuerligt i 24 timmar kan du anta att indexerarna inte kunde migreras till den nyare infrastrukturen. Som en allmän regel, för indexeringsjobb som inte kan slutföras inom två timmar, ska indexeraren sättas på ett 5-minutersschema så att den snabbt kan fortsätta där den slutade. På den kostnadsfria nivån är maximal körtid 3 till 10 minuter för indexerare med kompetensuppsättningar.

6 Det maximala antalet tecken baseras på Unicode-kodenheter, särskilt UTF-16.

7 När du använder delimitedText parsningsläge för CSV-filer gäller en buffertstorleksgräns på 10 MB per filrad.

8 När du använder delimitedText parsningsläge för CSV-filer gäller inte gränsen för "maximal extraherad innehållsstorlek".

Indexerare kan komma åt andra Azure-resurser via privata slutpunkter som hanteras via resurs-API:et för delad privat länk. I det här avsnittet beskrivs de gränser som är associerade med den här funktionen.

Anteckning

Utvecklarnivån i Serverless-prismodellen stöder inte delade privata länkar eller nätverkssäkerhetsperimeter (NSP) för datakällor. Privata slutpunkter och IP-brandväggsregler för en privat anslutning till en tjänst på serverlös utvecklarnivå stöds.

Resurs Kostnadsfri Grundläggande S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Stöd för privat slutpunktsindexerare Nej Ja Ja Ja Ja Nej Ja Ja Nej
Stöd för privata slutpunkter för indexerare med en färdighetsuppsättning 1 Nej Nej Ja Ja Ja Nej Ja Ja Nej
Stöd för privat åtkomstpunkt för färdighetsuppsättningar med en inbäddningsförmåga 2 Nej Ja Ja Ja Ja Nej Ja Ja Nej
Maximalt antal privata slutpunkter Ej tillämpligt 10 eller 30 100 400 400 Ej tillämpligt 20 20 Ej tillämpligt
Maximalt antal distinkta resurstyper 3 Ej tillämpligt 4 7 15 15 Ej tillämpligt 4 4 Ej tillämpligt

1 AI-berikning och bildanalys är beräkningsintensiva och förbrukar oproportionerliga mängder tillgänglig bearbetningskraft. Därför inaktiveras privata anslutningar på lägre nivåer för att säkerställa prestanda och stabilitet för själva söktjänsten. I Basic-tjänster stöds inte privata anslutningar till en Microsoft Foundry-resurs för att bevara tjänstens stabilitet. För S1-nivån kontrollerar du att tjänsten har skapats med högre gränser efter den 3 april 2024. Indexerare med fler än två Azure OpenAI-inbäddningar eller Azure Vision multimodala inbäddningsfärdigheter får inte köras i privata miljöer, och privata anslutningar är inte tillgängliga.

2 Privata anslutningar till en inbäddningsmodell stöds på grundläggande och S1-söktjänster med hög kapacitet som skapats efter den 3 april 2024, med de högre gränserna för lagring och beräkningsbearbetning.

3 Antalet distinkta resurstyper beräknas som antalet unika groupId värden som används för alla delade privata länkresurser för en viss söktjänst, oavsett resursens status.

Synonymgränser

Det maximala antalet synonymkartor varierar beroende på nivå. Varje regel kan ha upp till 20 expansioner, där en expansion är en motsvarande term. Till exempel räknas associationen mellan ”katt” och ”kitty”, ”felin” och ”Felis” (kattsläktet) som tre expansioner.

Resurs Kostnadsfri Grundläggande S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Maximalt antal synonymkartor 3 3 5 10 20 20 10 10 20 per tjänst
Maximalt antal regler per karta 5 000 20000 20000 20000 20000 20000 20000 20000 20000

Indexaliasgränser

Det maximala antalet indexalias varierar beroende på skapandedatum för nivå och tjänst. Om tjänsten skapades efter oktober 2022 på alla nivåer är det maximala antalet alias dubbelt så många index som tillåts. Om tjänsten skapades före oktober 2022 är gränsen antalet index som tillåts.

Anteckning

Nivån Utvecklare för den serverlösa modellen har inte stöd för indexalias.

Datum då tjänsten skapades Kostnadsfri Grundläggande S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Före oktober 2022 3 5 eller 15 1 50 200 200 1 000 per partition eller 3 000 per tjänst 10 10 Ej tillämpligt
Efter oktober 2022 6 30 100 400 400 2 000 per partition eller 6 000 per tjänst 20 20 Ej tillämpligt

1 Grundläggande tjänster som skapades före december 2017 har lägre gränser (5 i stället för 15) för index.

Gränser för agentisk hämtning

En kunskapsbas anger en eller flera kunskapskällor och ett hämtningsskäl som styr nivån för llm-bearbetning (large language model) för agentisk hämtning. Gränserna varierar beroende på prisnivå, API-version och resonemangsnivå.

Resurs Kostnadsfri Grundläggande S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Maximalt antal kunskapskällor per tjänst 3 5 eller 15 1 50 200 200 0 10 10 30
Maximalt antal kunskapsbaser per tjänst 3 5 eller 15 1 50 200 200 0 10 10 30
Maximalt antal kunskapskällor per kunskapsbas (minimal) 2 3 5 eller 10 1 10 10 10 0 10 10 10
Maximalt antal kunskapskällor per kunskapsbas (low) 3 3 3 3 3 0 3 3 3
Maximalt antal kunskapskällor per kunskapsbas (medium) 3 5 5 5 5 0 5 5 5

1 Grundläggande tjänster som skapats före den 3 april 2024 har lägre gränser (5) för kunskapskällor och kunskapsbaser.

Kunskapskällor per kunskapsbas

Gränser per kunskapsbas för kunskapskällor beror på vilken API-version som används för att skapa eller uppdatera kunskapsbasen. I 2026-05-01-preview stöder alla resonemangsinsatser för hämtning samma begränsningar för kunskapskällor. Tidigare förhandsversioner av API:et har lägre gränser för low och medium resonemang.

API-version Återhämtning av resonemangslogik Kostnadsfri Grundläggande S1 S2 S3 S3 HD L1 L2
2026-05-01-preview minimal, , lowmedium 3 5 eller 10 1 10 10 10 0 10 10
2026-05-01-preview, 2025-08-01-preview minimal 2 3 5 eller 10 1 10 10 10 0 10 10
2026-05-01-preview, 2025-08-01-preview low 3 3 3 3 3 0 3 3
2026-05-01-preview, 2025-08-01-preview medium 3 5 5 5 5 0 5 5

2 I tidigare förhandsversioner av API stöder resonemanget minimal fler kunskapskällor än low eller medium eftersom det kringgår LLM-baserad frågeplanering.

Datagränser (AI-berikning)

Databegränsningar gäller för en PIPELINE för AI-berikande som gör anrop till Azure Language i Foundry Tools för entitetsigenkänning, entitetslänkning, extrahering av nyckelfraser, attitydanalys, språkidentifiering och identifiering av personlig information.

Den maximala storleken på en post är 50 000 tecken, beräknat enligt String.Length. Om du behöver dela upp dina data innan du skickar dem till attitydanalysatorn använder du färdigheten Textdelning.

Dessa gränser gäller för både dedikerade och serverlösa prismodeller.

Kapacitetsbegränsningar

Begränsningsgränser bidrar till att säkerställa tjänstens stabilitet genom att kontrollera frekvensen för API-begäranden.

I prisnivån Dedikerad baseras begränsningen på sökenheter (repliker × partitioner).

I den serverlösa prismodellen baseras inte strypning på sökenheter. I stället är det driftsgränser på tjänstenivå och övergripande användningsmönster som styr genomströmningen. Användnings- och tjänstbegränsningar hanterar kapacitet, inte konfiguration av repliker och partitioner.

Operation Dedikerad (per sökenhet) Serverlös (per tjänst eller per index)
Lista index (GET /index) 3 begäranden per sekund/SU 3 begäranden per sekund
Hämta index (GET /index/{index}) 10 begäranden per sekund/SU 10 begäranden per sekund
Skapa index (POST /index) 12 begäranden/min/SU 12 begäranden/min
Skapa eller uppdatera index (PUT /index/{index}) 6 begäranden per sekund/SU 6 begäranden per sekund
Ta bort index (DELETE /index/{index}) 12 begäranden/min/SU 12 begäranden/min
Tjänststatistik (GET /servicestats) 4 begäranden per sekund/SU 4 begäranden per sekund
Sökfrågor (POST /index/{index}/docs/search) Varierar beroende på SU-antal och frågekomplexitet 50 förfrågningar/sekund (aggregerad läsbegränsning per index)
Indexdokument (POST /indexes/{index}/docs/index) Varierar beroende på SU-antal och indexeringsarbetsbelastning 5 begäranden per sekund per index
Föreslå (POST /indexes/{index}/docs/suggest) Varierar beroende på antal SU Inte uttryckligen definierad
Komplettera automatiskt (POST /index/{index}/docs/autocomplete) Varierar beroende på antal SU Inte uttryckligen definierad

Begränsningar för semantisk rangordning

Semantisk ranker använder ett kösystem för att hantera samtidiga begäranden. Det här systemet gör det möjligt för söktjänster att få så många frågor som möjligt per sekund. När gränsen för samtidiga begäranden har nåtts placerar systemet ytterligare begäranden i en kö. Om kön är full avvisar systemet ytterligare begäranden och de måste göras om.

De totala semantiska rankningsfrågorna per sekund varierar beroende på följande faktorer:

  • Söktjänstens nivå. Både kökapacitet och begränsningar för samtidiga begäranden varierar beroende på nivå.
  • Antalet sökenheter i söktjänsten. Det enklaste sättet att öka det maximala antalet samtidiga semantiska rankerfrågor är att lägga till fler sökenheter i söktjänsten.
  • Den totala tillgängliga semantiska rankerkapaciteten i regionen.
  • Hur lång tid det tar att hantera en fråga med hjälp av semantisk rangordning. Den här tiden varierar beroende på hur upptagen söktjänsten är.

I följande tabell beskrivs de semantiska strypningsgränserna för rankning efter nivå, beroende på tillgänglig kapacitet i regionen. Du kan kontakta Microsofts support för att begära en gränsökning.

Resurs Grundläggande S1 S2 S3 S3 HD L1 L2 Serverlös utvecklare
Maximalt antal samtidiga begäranden (per sökenhet) 2 3 4 4 4 4 4 4 (per tjänst)
Maximal köstorlek för begäran (per sökenhet) 4 6 8 8 8 8 8 8 (per tjänst)

API-begärandens gränser

Det finns begränsningar för frågor eftersom obundna frågor kan destabilisera din söktjänst. Vanligtvis skapas sådana frågor programmatiskt. Om ditt program genererar sökfrågor programmatiskt utformar du det så att det inte genererar frågor av obundna storlekar.

Det finns gränser för nyttolaster av liknande skäl, vilket säkerställer stabiliteten i söktjänsten. Gränsen gäller för hela begäran, inklusive alla dess komponenter. Om begäran till exempel batchar flera dokument eller kommandon måste hela begäran passa inom den gräns som stöds.

Om du måste överskrida en gräns som stöds testar du arbetsbelastningen så att du vet vad du kan förvänta dig.

Förutom där detta anges gäller följande API-begäranden för alla programmerbara gränssnitt, inklusive Azure SDK:er.

Allmänt:

  • Maximal nyttolastgräns som stöds är 16 MB för indexering och frågebegäran via REST API och SDK:er.
  • Maximal 8 KB URL-längd (gäller endast REST-API:er).

Indexerings-API:er:

  • Stöd för högst 1 000 dokument per batch med indexuppladdningar, sammanslagningar eller borttagningar.
  • Varje begäran stöder mellan 1 och 32 000 indexeringsåtgärder.

Fråge-API:er:

  • Maximalt 10 fält i en vektorfråga
  • Maximalt 32 fält i $orderby-klausul.
  • Högst 100 000 tecken i en söksats.
  • Maximalt antal satser i sökningen är 3 000.
  • Maxgränser för förfrågningar med jokertecken och reguljära uttryck, enligt Lucene. Det begränsar antalet mönster, variationer eller matchningar till 1 000 instanser. Den här gränsen är på plats för att undvika överbelastning av motorn.

Söktermer:

  • Maximal söktermsstorlek som stöds är 32 766 byte (32 KB minus 2 byte) UTF-8-kodad text. Gäller för nyckelordssökning och textegenskapen för vektorsökning.
  • Maximal söktermsstorlek som stöds är 1 000 tecken för prefixsökning och regex-sökning.

API-svarsgränser

  • Varje sida med sökresultat returnerar upp till 1 000 dokument.
  • Varje begäran till Suggest API returnerar upp till 100 förslag.

Sökmotorn returnerar som standard 50 resultat, men du kan åsidosätta den här parametern upp till maxgränsen.

API-nyckelgränser

Använd API-nycklar för tjänstautentisering. Det finns två typer av API-nycklar. Administratörsnycklar, som du anger i begärandehuvudet, ger fullständig läs- och skrivåtkomst till tjänsten. Frågenycklar, som du anger på URL:en, är skrivskyddade och distribueras vanligtvis till klientprogram.

  • Varje tjänst stöder upp till två administratörsnycklar.
  • Varje tjänst stöder upp till 50 frågenycklar.