Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Poznámka
Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.
Maximální limity úložiště, úloh a množství indexů a dalších objektů závisí na cenovém modelu vaší služby Azure AI Vyhledávač.
Azure AI Vyhledávač podporuje dva cenové modely, z nichž každá má přidružené úrovně služeb. Úroveň, kterou vyberete, má vliv na limity služeb uvedené v těchto doprovodných materiálech.
- Dedikované: Fixní cena stanovená podle vyhledávacích jednotek (SU). Mezi možnosti úrovně služby patří: Basic, Standard (S1-S3, včetně S3 HD), Optimalizováno pro úložiště (L1-L2) a úroveň Free s omezenými možnostmi vyhledávací služby.
- Bezserverová verze (Preview):Ceny založené na spotřebě měřené podle výpočetních jednotek za hodinu (CU/hr) a za GB/měsíc pro indexované úložiště. Aktuální úroveň Preview je: bezserverový vývojář. Omezení jsou definována limity na index, počty objektů na službu a chováním při omezování propustnosti ve službě Serverless.
Důležité
Bezserverová úroveň Developer je aktuálně ve verzi Preview. Tato verze Preview je poskytována bez smlouvy o úrovni služeb a nedoporučuje se pro produkční úlohy. Některé funkce nemusí být podporované nebo můžou mít omezené možnosti. Další informace najdete v dodatečných podmínkách použití pro verze Preview v Microsoft Azure.
Fakturace pro bezserverovou úroveň Developer ještě není ve verzi Preview povolená. Odhadované náklady na využití jsou k dispozici na portálu Azure a telemetrii, ale toto využití se během tohoto počátečního období nezobrazí na faktuře za Azure. Microsoft poskytne oznámení alespoň 30 dnů před zahájením fakturace. Odložení fakturace během této verze Preview je dočasné. Bezserverový vývojář je placená úroveň a po zahájení fakturace budete zodpovědní za případné poplatky.
Bezserverová úroveň Developer nepodporuje migraci do jiných cenových úrovní ani z jiných cenových úrovní a některé funkce, které jsou k dispozici na jiných úrovních, se ve verzi Public Preview nepodporují. Limity služeb, podporované funkce a podrobnosti o cenách se můžou před obecnou dostupností změnit.
Verze Preview je aktuálně dostupná pouze v oblasti USA – středozápad, Švýcarsko – sever a Japonsko – východ.
Další informace najdete v tématu Volba cenového modelu a úrovně služby.
Limity předplatného
Můžete vytvořit více fakturovatelných vyhledávacích služeb (základních a vyšších), až do maximálního počtu služeb povoleného v každé úrovni, pro každý region. Můžete například vytvořit až 16 služeb na úrovni Basic a dalších 16 služeb na úrovni S1 ve stejném předplatném a oblasti. Potom můžete vytvořit dalších 16 základních služeb v jiné oblasti pro kombinované celkem 32 základních služeb v rámci stejného předplatného. Další informace o úrovních služby najdete v tématu Volba cenového modelu a úrovně služby.
Maximální limity služeb můžete zvýšit podle požadavku. Pokud potřebujete další služby v rámci stejného předplatného, podejte žádost o podporu.
| Zdroj | Zdarma 1 | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Maximální počet služeb na region | 1 | 16 | 16 | 8 | 6 | 6 | 6 | 6 | 5 |
| Maximální vyhledávací jednotky (SU)2 | není k dispozici | 3 SJ | 36 SU | 36 SU | 36 SU | 36 SU | 36 SU | 36 SU | není k dispozici |
1 Na každé předplatné Azure můžete mít jednu bezplatnou vyhledávací službu. Bezplatná úroveň je založena na infrastruktuře sdílené s jinými zákazníky. Protože hardware není vyhrazený, škálování nahoru není podporováno a úložiště je omezeno na 50 MB. Bezplatná vyhledávací služba může být smazána po delších obdobích nečinnosti, aby se vytvořilo místo pro další služby.
2 Vyhledávací jednotky (SU) jsou fakturační jednotky, přidělené buď jako replika nebo jako část. Potřebujete obojí. Chcete-li se dozvědět více o kombinacích SU, podívejte se na Odhad a správa kapacity vyhledávací služby.
Limity služby
V cenovém modelu Dedicated naplánujte kapacitu vynásobením počtu replik počtem oddílů (jednotek vyhledávání).
| Zdroj | Free | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Oddíly | není k dispozici | 3 1 | 12 | 12 | 12 | 3 | 12 | 12 | není k dispozici |
| Repliky | není k dispozici | 3 | 12 | 12 | 12 | 12 | 12 | 12 | není k dispozici |
1 Úroveň Basic podporuje tři oddíly a tři repliky, celkem devět jednotek vyhledávání (SU) na nových vyhledávacích službách vytvořených po 3. dubnu 2024. Starší služby Basic jsou omezené na jeden oddíl a tři repliky.
Vyhledávací služba podléhá maximálnímu limitu úložiště (velikost oddílu vynásobeným počtem oddílů) nebo pevnému limitu maximálního počtu indexů nebo indexerů podle toho, který limit nastane dříve.
Smlouvy o úrovni služeb (SLA) se vztahují na fakturovatelné služby, které mají dvě nebo více replik pro úlohy dotazů nebo tři nebo více replik pro úlohy dotazů a indexování. Počet oddílů není zohledněn v SLA. Pro více informací viz Reliability in Azure AI Vyhledávač.
Bezplatné služby nemají pevné oddíly nebo repliky a sdílejí zdroje s ostatními účastníky.
Úložiště oddílu (GB)
Limity úložiště pro jednotlivé služby se liší na základě dvou faktorů: datum vytvoření služby a oblast. Většina podporovaných oblastí nabízí vyšší limity pro novější služby.
Tato tabulka ukazuje postupné zvyšování kvóty úložiště v GB v průběhu času. Od dubna 2024 byly v regionech uvedených v poznámkách pod čarou zprovozněny partitiony s vyšší kapacitou. Pokud máte starší službu v podporované oblasti, zkontrolujte, jestli můžete upgradovat službu , abyste získali vyšší limity úložiště.
| Datum vytvoření služby | Basic | S1 | S2 | S3/HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|
| Před 3. dubnem 2024 | 2 | 25 | 100 | 200 | 1,024 | 2 048 | není k dispozici |
| 3. dubna 2024 až 17. května 2024 1 | 15 | 160 | 512 | 1,024 | 1,024 | 2 048 | není k dispozici |
| Po 17. květnu 2024 2 | 15 | 160 | 512 | 1,024 | 2,048 | 4,096 | není k dispozici |
| Po 10. únoru 2025 3 | 15 | 160 | 512 | 1,024 | 2 048 | 4,096 | není k dispozici |
1 Vyšší kapacita úložiště pro Basic, S1, S2 a S3 v těchto oblastech. Amerika: Brazílie jih, Kanada střed, Kanada východ, Východní USA, Východní USA 2, Střední USA, Severní střed USA, Jižní střed USA, Západní USA, Západní USA 2, Západní USA 3, Západní střed USA. Evropa: Francie – střed. Itálie sever, Severní Evropa, Východní Norsko, Centrální Polsko, Severní Švýcarsko, Centrální Švédsko, Jihoanglie, Západní Anglie. Střední východ: Spojené arabské emiráty – sever. Afrika: Jižní Afrika – sever. Asie Tichomoří: Austrálie – východ, Austrálie – jihovýchod, Indie – střed, Jio Indie – západ, Východní Asie, Jihovýchodní Asie, Japonsko – východ, Japonsko – západ, Korea – střed, Korea – jih.
2 Úložiště s vyšší kapacitou pro L1 a L2. Více regionů poskytuje vyšší kapacitu na každé fakturační úrovni. Ameriky: Východ USA 2 EUAP. Europe: Severní Německo, Středozápadní Německo, Západní Švýcarsko. Azure Government: Texas, Arizona, Virginia. Afrika: Jižní Afrika – sever. Asie a Tichomoří: Čína Sever 3, Čína Východ 3.
3 Úložiště s vyšší kapacitou je k dispozici v západní Evropě.
Důležité
V současné době nejsou vyšší limity úložiště dostupné v následujících oblastech, které podléhají limitům před 3. dubnem.
- Izrael – střed
- Katar – střed
- Španělsko – střed
- Indie – jih
Limity indexu
| Zdroj | Free | Základní 1 | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Maximální indexy | 3 | 5 nebo 15 | 50 | 200 | 200 | 1000 na oddíl nebo 3000 na službu | 10 | 10 | 30 |
| Maximum jednoduchých polí na index 2 | 1 000 | 100 | 1 000 | 1 000 | 1 000 | 1 000 | 1 000 | 1 000 | 1 000 |
| Maximální rozměry na vektorové pole | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 |
| Maximální počet komplexních kolekcí na index | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 |
| Maximální počet prvků napříč všemi komplexními kolekcemi na dokument 3 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 |
| Maximální hloubka složitých polí | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 |
| Maximální počet návrhy na index | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 |
| Maximální počet hodnoticích profilů pro index | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| Maximální sémantická konfigurace na index | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| Maximální počet funkcí na profil | 8 | 8 | 8 | 8 | 8 | 8 | 8 | 8 | 8 |
| Maximální velikost indexu 4 | není k dispozici | není k dispozici | není k dispozici | 1,88 TB | 2,34 TB | 100 GB | není k dispozici | není k dispozici | 1 GB |
1 Základní služby vytvořené před prosincem 2017 mají nižší limity (5 místo 15) na indexy. Základní úroveň je jedinou úrovní, která má dolní limit 100 polí na index.
2 Horní limit polí zahrnuje jak pole první úrovně, tak vnořená podpole ve složité kolekci. Například pokud index obsahuje 15 polí a má dvě složitá kolekce, z nichž každá má pět podpolí, počet polí ve vašem indexu je 25. Indexy s velmi rozsáhlou kolekcí polí mohou být pomalé. Omezte pole a atributy pouze na ty, které potřebujete, a spusťte test indexace a dotazování, aby byla zajištěna přijatelná výkonnost.
3 Existuje horní limit pro prvky, protože velký počet z nich výrazně zvyšuje úložný prostor potřebný pro váš index. Prvkem složité kolekce je definován jako člen této kolekce. Předpokládejme například hotelový dokument se složitou kolekcí Pokoje. Každá místnost v kolekci Rooms je považována za prvek. Během indexování může indexovací engine bezpečně zpracovat maximálně 3 000 prvků v rámci celého dokumentu.
Tento limit byl zaveden v api-version=2019-05-06 a vztahuje se pouze na složité kolekce, nikoli na kolekce řetězců nebo složité pole.
4 U většiny úrovní je maximální velikost indexu celková dostupná velikost úložiště ve vyhledávací službě. Pro služby S2, S3 a S3 HD s více oddíly a tedy větším úložištěm je v tabulce uvedena maximální velikost jednoho indexu. Platí pro vyhledávací služby vytvořené po 3. dubnu 2024. Indexy pro služby nastavené pomocí bezserverového modelu (Preview) mají nastavenou maximální velikost uvedenou v tabulce.
Můžete zaznamenat určitou variabilitu v maximálních limitech, pokud je vaše služba zajištěna na výkonnějším klastru. Limity zde představují společného jmenovatele. Indexy vytvořené podle výše uvedených specifikací jsou přenosné napříč ekvivalentními servisními úrovněmi v jakékoli oblasti.
Limity dokumentu
Každý index podporuje až následující počet dokumentů:
- 24 miliard na úrovni Basic, S1, S2 a S3
- 2 miliardy na S3 HD
- 288 miliard na L1
- 576 miliard na L2
Každý dokument může mít velikost až 16 megabajtů. Limit velikosti dokumentu se ve skutečnosti vztahuje na velikost těla požadavku rozhraní API pro indexování, která činí 16 megabajtů. Tento datový obsah může tvořit jeden dokument nebo sada dokumentů. Pro dávku s jediným dokumentem je maximální velikost dokumentu 16 MB JSON.
Omezení velikosti dokumentu platí pro indexování v režimu nabízení , které nahrává dokumenty do vyhledávací služby. Pokud používáte indexátor pro indexování ve stahovacím režimu, vaše zdrojové soubory mohou mít libovolnou velikost, ale musí splňovat omezení indexátoru. U indexeru blobů jsou limity velikosti souborů větší pro vyšší úrovně. Například limit S1 je 128 megabajtů, limit S2 je 256 megabajtů atd.
Při odhadu velikosti dokumentu nezapomeňte indexovat pouze pole, která přidávají hodnotu do scénářů hledání. Vylučte zdrojová pole, která nemají žádný účel v dotazech, které chcete spustit.
Limity velikosti vektorového indexu
Když indexujete dokumenty s vektorovými poli, Azure AI Vyhledávač vytváří interní vektorové indexy pomocí parametrů algoritmu, které poskytnete.
Velikost těchto vektorových indexů je omezena:
- Paměť vyhrazená pro vektorové vyhledávání pro úroveň vaší služby (nebo
SKU) v cenovém modelu Dedicated. - Omezení úložiště pro jednotlivé indexy v cenovém modelu bez serveru
Pro návod, jak spravovat a maximalizovat úložiště vektorů, viz Velikost indexu vektoru a zůstávání pod limity.
Limity vektorů se liší podle:
Vyšší vektorové limity od dubna 2024 existují na nových vyhledávacích službách v regionech poskytujících dodatečnou kapacitu, což je většina z nich. Pokud máte starší službu v podporované oblasti, zkontrolujte, jestli můžete službu upgradovat na vyšší limity vektorů.
V bezserverovém cenovém modelu se limity vektorů definují pro jednotlivé indexy místo pro jednotlivé oddíly.
-
Maximální velikost vektorového indexu na index (bez serveru): 300 MB
- Tato velikost představuje přibližně 30% celkového úložiště indexů v souladu s poměrem vektoru k úložišti, který se používá v úrovních služby Dedicated.
- Tato velikost je pevný limit pro každý index. Pokusy o překročení tohoto limitu během indexování selžou.
Tato tabulka ukazuje postup zvyšování kvót vektoru v GB v průběhu času. Kvóta je na oddíl, takže pokud škálujete novou službu Standard (S1) na 6 oddílů, celková kvóta vektoru je 35 vynásobená 6.
| Datum vytvoření služby | Basic | S1 | S2 | S3/HD | L1 | L2 |
|---|---|---|---|---|---|---|
| Před 1. červencem 20231 | 0,5 | 1 | 6 | 12 | 12 | 36 |
| 1. července 2023 až 3. dubna 20242 | 1 | 3 | 12 | 36 | 12 | 36 |
| 3. dubna 2024 až 17. května 20243 | 5 | 35 | 150 | 300 | 12 | 36 |
| Po 17. květnu 20244 | 5 | 35 | sto padesát | 300 | 150 | 300 |
1 Omezení počátečních vektorů v rané verzi Preview.
Během pozdějšího předzobrazení období platí omezení vektoru 2. Tři oblasti neměly vyšší limity: Německo západní střed, Západní Indie, Centrální Katar.
3 Vyšší kvóta vektorů založená na větších přihrádkách pro podporované úrovně a regiony.
4 Vyšší kvóty vektorů pro více úrovní a regionů na základě aktualizací velikosti oddílů.
Služba vynucuje kvótu velikosti vektorového indexu:
- Vyhrazené: Jednotlivé oddíly ve vyhledávací službě
- Serverless: na každý index
Tato kvóta je pevný limit, aby vaše služba zůstala v pořádku. Další pokusy o indexování po překročení limitu způsobí selhání. Jakmile uvolníte dostupnou kvótu, můžete indexování obnovit pomocí:
- Odstraňování vektorových dokumentů
- Zmenšení velikosti vektoru nebo rozměrnosti
- (Pouze pro vyhrazené) Horizontální škálování oddílů
Důležité
Vyšší limity vektorů jsou svázané s většími velikostmi oddílů. V současné době nejsou vyšší limity vektorů dostupné v následujících oblastech, na které se vztahují limity z července do dubna.
- Izrael – střed
- Katar – střed
- Španělsko – střed
- Indie – jih
Omezení indexátoru
Maximální doby běhu existují, aby poskytovaly vyváženost a stabilitu službě jako celku, ale větší datové sady mohou potřebovat více času na indexování, než maximální doba povoluje. Pokud se úloha indexování nemůže dokončit v maximálním povoleném čase, zkuste ji spustit podle plánu. Plánovač sleduje stav indexování. Pokud je plánovaná práce indexování přerušena z jakéhokoliv důvodu, indexer může při příštím plánovaném spuštění pokračovat tam, kde skončil.
Poznámka
V bezserverovém cenovém modelu se chování indexeru liší od vyhrazených služeb. Kapacita není definována replikami nebo oddíly. Místo toho limity objektů pro jednotlivé služby, limity úložiště pro indexy a omezování na úrovni služby řídí limity indexování. V důsledku toho některé limity, jako je například maximální doba provádění, nejsou pevné hodnoty.
| Zdroj | Zdarma 1 | Základní 2 | S1 | S2 | S3 | S3 HD 3 | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Maximální indexátory | 3 | 5 nebo 15 | 50 | 200 | 200 | není k dispozici | 10 | 10 | 30 |
| Maximální datové zdroje | 3 | 5 nebo 15 | 50 | 200 | 200 | není k dispozici | 10 | 10 | 30 na službu |
| Maximální sady dovedností 4 | 3 | 5 nebo 15 | 50 | 200 | 200 | není k dispozici | 10 | 10 | 30 |
| Maximální indexovací zatížení na jedno spuštění | 10 000 dokumentů | Omezeno pouze maximálním počtem dokumentů | Omezeno pouze maximálním počtem dokumentů | Omezeno pouze maximálním počtem dokumentů | Omezeno pouze maximálním počtem dokumentů | není k dispozici | Bez omezení | Bez omezení | Omezeno pouze maximálním počtem dokumentů |
| Minimální plán | 5 min. | 5 min. | 5 min. | 5 min. | 5 min. | 5 min. | 5 min. | 5 min. | 5 min. |
| Maximální doba běhu 5 | 1–3 nebo 3–10 min | 2 nebo 24 hodin | 2 nebo 24 hodin | 2 nebo 24 hodin | 2 nebo 24 hodin | není k dispozici | 2 nebo 24 hodin | 2 nebo 24 hodin | 2 hodiny |
| Indexer objektů blob 7: maximální velikost objektu blob, MB | 16 | 16 | 128 | 256 | 256 | není k dispozici | 256 | 256 | 256 |
| Indexer objektů blob: maximální počet znaků obsahu extrahovaný z objektu blob 68 | 256,000 | 512 000 | 4 mil | 8 mil | 16 mil | není k dispozici | 4 mil | 4 mil | 16 mil |
1 Bezplatné služby mají maximální dobu vykonání indexeru 3 minuty pro blobové zdroje a 1 minutu pro všechny ostatní datové zdroje. Vyvolání indexeru je jednou za 180 sekund. Pro indexování AI, které volají Foundry Tools, jsou bezplatné služby omezeny na 20 bezplatných transakcí na indexer a den, kde transakce je definována jako dokument, který úspěšně prochází obohacovacím kanálem. (Tip: Indexer můžete resetovat a obnovit jeho počet.)
2 Základní služby vytvořené před prosincem 2017 mají nižší limity (5 místo 15) u indexerů, zdrojů dat a sad dovedností.
3 Podpora indexeru S3 HD je ve verzi Preview, vyžaduje rozhraní REST API ve verzi 2025-11-01-preview nebo novější a vztahuje se na ni denní kvóta na úrovni služby v délce šesti hodin kumulativní doby běhu indexeru sdílené všemi indexery. Indexery S3 HD běží jenom v prostředí pro spouštění s více tenanty a nepodporují sdílené prostředky privátního propojení. Ve verzi Preview je podpora indexeru S3 HD nejvhodnější pro malé úlohy (s velikostí indexu přibližně 1 GB) bez dovednostní sady nebo jen s minimální dovednostní sadou. Další informace naleznete v tématu Spuštění indexeru v prostředí Serverless a S3 HD.
4 Maximálně 30 dovedností na sadu dovedností.
5 Pokud jde o maximální délku trvání 2 nebo 24 hodin pro indexery: nejběžnější je maximální délka 2 hodiny a s tou byste měli počítat. Odkazuje na indexery spuštěné ve veřejném prostředí, které přesměrovává výpočetně náročné zpracování a ponechá více prostředků pro dotazy. Limit 24 hodin platí, pokud indexer nakonfigurujete tak, aby běžel v privátním prostředí pouze pomocí infrastruktury, která je přidělená vaší vyhledávací službě. Některé starší indexery nemohou běžet ve veřejném prostředí a tyto indexery mají vždy 24hodinový rozsah zpracování. Pokud máte neplánované indexery, které běží nepřetržitě 24 hodin, můžete předpokládat, že tyto indexery nelze migrovat na novější infrastrukturu. Obecně platí, že pro úlohy indexování, které se nedají dokončit do dvou hodin, nastavte indexér na plán s intervalem 5 minut, aby mohl indexér rychle pokračovat tam, kde skončil. Na bezplatné úrovni je maximální doba běhu 3-10 minut určena pro indexátory s dovednostmi.
6 Maximální počet znaků je založen na jednotkách kódu Unicode, konkrétně UTF-16.
7 Při použití delimitedText režimu analýzy souborů CSV platí limit velikosti vyrovnávací paměti 10 MB na řádek souboru.
8 Při použití delimitedText režimu analýzy souborů CSV se limit maximální extrahovaného obsahu nevztahuje.
Limity prostředků sdíleného soukromého odkazu
Indexery mohou přistupovat k dalším zdrojům Azure přes privátní koncové body spravované prostřednictvím API pro sdílené zdroje privátních odkazů. Tato sekce popisuje omezení spojená s touto schopností.
Poznámka
Úroveň Developer cenového modelu Serverless nepodporuje sdílené privátní odkazy ani obvod zabezpečení sítě (NSP) pro zdroje dat. Podporují se privátní koncové body a pravidla brány firewall protokolu IP pro privátní připojení ke službě bezserverové úrovně Developer.
| Zdroj | Free | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Podpora indexeru privátního koncového bodu | Ne | Ano | Ano | Ano | Ano | Ne | Ano | Ano | Ne |
| Podpora soukromého koncového bodu pro indexery se sadu dovedností 1 | Ne | Ne | Ano | Ano | Ano | Ne | Ano | Ano | Ne |
| Podpora privátního koncového bodu pro skillsety s embedovanou dovedností 2 | Ne | Ano | Ano | Ano | Ano | Ne | Ano | Ano | Ne |
| Maximální počet privátních koncových bodů | není k dispozici | 10 nebo 30 | 100 | 400 | 400 | není k dispozici | 20 | 20 | není k dispozici |
| Maximální počet různých typů zdrojů 3 | není k dispozici | 4 | 7 | 15 | 15 | není k dispozici | 4 | 4 | není k dispozici |
1 Obohacení AI a analýza obrazu jsou výpočetně náročné a spotřebovávají nepřiměřené množství dostupného výpočetního výkonu. Z tohoto důvodu jsou na nižších úrovních deaktivována soukromá připojení, aby byla zajištěna výkonnost a stabilita samotné vyhledávací služby. U služeb Basic nejsou privátní připojení k prostředku Microsoft Foundry podporována, aby se zachovala stabilita služeb. Pro úroveň S1 se ujistěte, že služba byla vytvořena s vyššími limity po 3. dubnu 2024. Indexery s více než 2 dovednostmi Azure OpenAI Embedding nebo multimodálním vkládáním ve službě Azure Vision nemohou být spuštěny v soukromém prostředí a soukromá připojení nejsou dostupná.
2 Privátní připojení k vkládacímu modelu se podporují ve vysokokapacitních vyhledávacích službách Basic a S1 vytvořených po 3. dubnu 2024 s vyššími limity pro ukládání a výpočetní zpracování.
3 Počet různých typů zdrojů se vypočítá jako počet jedinečných groupId hodnot použitých ve všech sdílených prostředcích soukromého spojení pro danou vyhledávací službu, bez ohledu na stav zdroje.
Omezení synonym
Maximální počet map synonym se liší podle úrovně. Každé pravidlo může mít až 20 rozšíření, kde jedno rozšíření je ekvivalentní termín. Například pro výraz „kočka“ se spojení s „kitty“, „feline“ a „felis“ (rod koček) počítají jako tři rozšíření.
| Zdroj | Free | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Maximální mapy synonym | 3 | 3 | 5 | 10 | 20 | 20 | 10 | 10 | 20 na službu |
| Maximální počet pravidel na mapu | 5 000 | 20 000 | 20 000 | 20 000 | 20 000 | 20 000 | 20 000 | 20 000 | 20 000 |
Limity aliasů indexu
Maximální počet aliasů indexu se liší podle úrovně a data vytvoření služby. Pokud byla služba vytvořena po říjnu 2022, maximální počet aliasů na všech úrovních je dvojnásobkem maximálního povoleného počtu indexů. Pokud byla služba vytvořena před říjnem 2022, limit je počet povolených indexů.
Poznámka
Úroveň Developer v modelu Serverless nepodporuje aliasy indexů.
| Datum vytvoření služby | Free | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Před říjnem 2022 | 3 | 5 nebo 15 1 | 50 | 200 | 200 | 1000 na oddíl nebo 3000 na službu | 10 | 10 | není k dispozici |
| Po říjnu 2022 | 6 | 30 | 100 | 400 | 400 | 2000 na oddíl nebo 6000 na službu | 20 | 20 | není k dispozici |
1 Základní služby vytvořené před prosincem 2017 mají nižší limity (5 místo 15) na indexy.
Limity autonomního načítání
Znalostní báze určuje jeden nebo více zdrojů znalostí a úsilí o načtení, které řídí úroveň zpracování velkého jazykového modelu (LLM) pro načítání agentů. Limity se liší podle cenové úrovně, verze rozhraní API a úrovně úsilí.
| Zdroj | Free | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|---|
| Maximální počet zdrojů znalostí na službu | 3 | 5 nebo 15 1 | 50 | 200 | 200 | 0 | 10 | 10 | 30 |
| Maximální počet znalostních bází na službu | 3 | 5 nebo 15 1 | 50 | 200 | 200 | 0 | 10 | 10 | 30 |
Maximální počet zdrojů znalostí na znalostní bázi (minimal) 2 |
3 | 5 nebo 10 1 | 10 | 10 | 10 | 0 | 10 | 10 | 10 |
Maximální počet zdrojů znalostí na znalostní bázi (low) |
3 | 3 | 3 | 3 | 3 | 0 | 3 | 3 | 3 |
Maximální počet zdrojů znalostí na znalostní bázi (medium) |
3 | 5 | 5 | 5 | 5 | 0 | 5 | 5 | 5 |
1 Základní služby vytvořené před 3. dubnem 2024 mají nižší limity (5) pro zdroje znalostí a znalostní báze.
Zdroje znalostí podle znalostní báze
Limity zdrojů znalostí pro jednotlivé znalostní báze závisí na verzi API použité při vytvoření nebo aktualizaci znalostní báze. V 2026-05-01-preview všechny postupy uvažování při načítání podporují stejná omezení zdrojů znalostí. Dřívější preview verze rozhraní API mají nižší limity pro low a medium úsilí o uvažování.
| Verze rozhraní API | Úsilí při odůvodňování v procesu načítání | Free | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 |
|---|---|---|---|---|---|---|---|---|---|
2026-05-01-preview |
minimal, low, medium |
3 | 5 nebo 10 1 | 10 | 10 | 10 | 0 | 10 | 10 |
2026-05-01-preview, 2025-08-01-preview |
minimal
2 |
3 | 5 nebo 10 1 | 10 | 10 | 10 | 0 | 10 | 10 |
2026-05-01-preview, 2025-08-01-preview |
low |
3 | 3 | 3 | 3 | 3 | 0 | 3 | 3 |
2026-05-01-preview, 2025-08-01-preview |
medium |
3 | 5 | 5 | 5 | 5 | 0 | 5 | 5 |
2 V dřívějších preview verzích rozhraní API podporuje minimal více zdrojů znalostí než low nebo medium, protože obchází plánování dotazů založené na LLM.
Datové limity (obohacení AI)
Omezení dat platí pro kanál rozšiřování AI , který volá jazyk Azure Language in Foundry Tools pro rozpoznávání entit, propojení entit, extrakci klíčových frází, analýzu mínění, rozpoznávání jazyka a detekci osobních informací.
Maximální velikost záznamu je 50 000 znaků, měřeno pomocí String.Length. Pokud potřebujete rozdělit svá data před jejich odesláním do analyzátoru sentimentu, použijte dovednost Text Split.
Tato omezení platí pro cenové modely Dedicated i Bezserverové.
Limity škrcení
Limity pro omezování pomáhají zajistit stabilitu služby tím, že regulují frekvenci požadavků na rozhraní API.
V cenovém modelu Dedicated je omezování založené na jednotkách vyhledávání (repliky × oddíly).
V cenovém modelu bez serveru není omezování založené na jednotkách vyhledávání. Místo toho platí, že limity operací na úrovni služby a celkové chování při spotřebě řídí propustnost. Limity využití a služeb slouží ke správě kapacity, nikoli ke konfiguraci replik a oddílů.
| Operation | Vyhrazené (na jednotku vyhledávání) | Bezserverová služba (podle služby nebo indexu) |
|---|---|---|
| Výpis indexů (GET /indexes) | 3 požadavky/s/SU | 3 žádosti za sekundu |
| Získání indexu (GET /indexes/{index}) | 10 požadavků/s/SU | 10 požadavků za sekundu |
| Vytvoření indexu (POST /indexes) | 12 požadavků/min/SU | 12 požadavků za minutu |
| Vytvoření nebo aktualizace indexu (PUT /indexes/{index}) | 6 požadavků/s/SU | 6 požadavků za sekundu |
| Odstranění indexu (DELETE /indexes/{index}) | 12 požadavků/min/SU | 12 požadavků za minutu |
| Statistika služby (GET /servicestats) | 4 požadavky/s/SU | 4 žádosti za sekundu |
| Vyhledávací dotazy (POST /indexes/{index}/docs/search) | Liší se podle počtu jednotek SU a složitosti dotazů. | 50 dotazů za sekundu (souhrnný limit čtení na index) |
| Dokumenty indexu (POST /indexes/{index}/docs/index) | Liší se podle počtu jednotek SU a úlohy indexování | 5 požadavků za sekundu na index |
| Návrhy (POST /indexes/{index}/docs/suggest) | Liší se podle počtu jednotek SU | Není explicitně definováno. |
| Automatické dokončování (POST /indexes/{index}/docs/autocomplete) | Liší se podle počtu jednotek SU | Není explicitně definováno. |
Omezení regulace semantického hodnotitele
Semantic ranker používá frontový systém ke správě souběžných požadavků. Tento systém umožňuje vyhledávacím službám získat nejvyšší možný počet dotazů za sekundu. Když dosáhnete limitu souběžných požadavků, systém umístí další požadavky do fronty. Pokud je fronta plná, systém odmítne další žádosti a musí se opakovat.
Celkový počet dotazů sémantického hodnoticího modulu za sekundu se liší v závislosti na následujících faktorech:
- Úroveň vyhledávací služby. Kapacita fronty a limity současných požadavků se liší podle úrovně.
- Počet vyhledávacích jednotek ve vyhledávací službě. Nejjednodušší způsob, jak zvýšit maximální počet současných dotazů na sémantický řadič, je přidat více vyhledávacích jednotek do vaší vyhledávací služby.
- Celková dostupná kapacita sémantického pořadí v regionu.
- Doba, kterou trvá obsluhovat dotaz pomocí sémantického rankeru. Tato doba závisí na tom, jak je vyhledávací služba vytížená.
Následující tabulka popisuje omezení škrcení sémantického rankeru podle úrovně, s ohledem na dostupnou kapacitu v regionu. Pokud chcete požádat o navýšení limitu, můžete kontaktovat podporu Microsoftu.
| Zdroj | Basic | S1 | S2 | S3 | S3 HD | L1 | L2 | Bezserverový vývojář |
|---|---|---|---|---|---|---|---|---|
| Maximální počet souběžných požadavků (na jednotku vyhledávání) | 2 | 3 | 4 | 4 | 4 | 4 | 4 | 4 (na jednu službu) |
| Maximální velikost fronty požadavků (na vyhledávací jednotku) | 4 | 6 | 8 | 8 | 8 | 8 | 8 | 8 (na jednu službu) |
Limity požadavků API
Omezení dotazů existují, protože neomezené dotazy mohou destabilizovat vaši vyhledávací službu. Tyto dotazy se obvykle vytvářejí prostřednictvím kódu programu. Pokud vaše aplikace generuje vyhledávací dotazy programově, navrhněte je tak, aby negenerovala dotazy s nevázanou velikostí.
Omezení na užitečné zatížení existují ze stejných důvodů, zajišťující stabilitu vaší vyhledávací služby. Omezení platí pro celou žádost včetně všech jejích součástí. Například pokud žádost seskupuje několik dokumentů nebo příkazů, musí se celá žádost vejít do podporovaného limitu.
Pokud potřebujete překročit podporovaný limit, otestujte úlohu , abyste věděli, co očekávat.
Pokud není uvedeno jinak, následující požadavky na API platí pro všechny programovatelné rozhraní, včetně Sady Azure SDK.
Obecné:
- Podporovaný maximální limit velikosti datového balíku je 16 MB pro indexování a dotazování prostřednictvím REST API a SDK.
- Maximální délka adresy URL 8 kB (platí jenom pro rozhraní REST API).
Rozhraní API indexování:
- Podpora maximálně 1 000 dokumentů na jednu dávku pro nahrávání, slučování nebo mazání indexů.
- Každý požadavek podporuje 1 až 32 000 akcí indexování.
Dotazovací API:
- Maximálně 10 polí v vektorovém dotazu
- Maximálně 32 polí v klauzuli $orderby.
- Maximálně 100 000 znaků v jedné vyhledávací podmínce.
- Maximální počet klauzulí ve vyhledávání je 3 000.
- Maximální limity pro dotazy s zástupnými znaky a regulárními výrazy, jak jsou vynuceny Lucene. Omezuje počet vzorců, variací nebo shod na 1 000 případů. Tento limit je zaveden, aby se zabránilo přetížení motoru.
Vyhledávací dotazy:
- Maximální podporovaná velikost vyhledávacího termínu je 32 766 bajtů (32 KB minus 2 bajty) UTF-8 kódovaného textu. Platí pro vyhledávání pomocí klíčových slov a vlastnost textu pro vektorové vyhledávání.
- Maximální podporovaná délka vyhledávacího termínu je 1 000 znaků pro vyhledávání s předponou a vyhledávání s regulárními výrazy.
Limity pro reakce API
- Každá stránka výsledků hledání vrátí až 1 000 dokumentů.
- Každý požadavek rozhraní API pro návrhy vrátí až 100 návrhů.
Vyhledávač vrací ve výchozím nastavení 50 výsledků, ale tento parametr můžete přepsat až do maximálního limitu.
Limity klíče API
Pro ověřování služby použijte klíče rozhraní API. Existují dva typy klíčů rozhraní API. Klíče správce, které zadáte v hlavičce požadavku, poskytují úplný přístup pro čtení i zápis ke službě. Klíče dotazů, které zadáte na adrese URL, jsou určené jen pro čtení a obvykle se distribuují do klientských aplikací.
- Každá služba podporuje až dva klíče správce.
- Každá služba podporuje až 50 klíčů dotazu.