Odhad a správa kapacity vyhledávací služby

Poznámka:

Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.

Azure AI Vyhledávač nabízí dva cenové modely, které zpracovávají kapacitu odlišně:

  • Vyhrazené: Kapacitu plánujte určením počtu replik a oddílů a výběrem úrovně služby.

    • Kapacitu předem zřiďte přímo pomocí replik a oddílů.
    • Odhad požadované kapacity úložiště (partitionů) a požadované propustnosti (replik).
    • Zvolte úroveň služby, která zřídí kapacitu potřebnou na základě očekávané poptávky ve špičce.
    • Po počáteční konfiguraci kapacity platíte hodinovou sazbu měřenou podle jednotek vyhledávání (SU) bez ohledu na využití.
  • Bezserverová verze (Preview):Služba automaticky spravuje kapacitu na základě limitů využití a služeb. Nemusíte předem zřizovat kapacitu. Místo toho optimalizujte efektivitu úloh, abyste mohli spravovat náklady.

    • Kapacita se automaticky škáluje s poptávkou (při nečinnosti se může škálovat na nulu).
    • Fakturujete se na základě skutečného využití měřeného výpočetními jednotkami (CU) a úložištěm.
    • Plánování se místo infrastruktury zaměřuje na tyto faktory nákladů: vzory dotazů, velikost indexu a růst a vzorce příjmu dat. Viz Optimalizace nákladů na bezserverový model.
Dimension Dedicated Serverless
Model kapacity Zřízeno (repliky × oddíly) Na základě spotřeby
Scaling Příručka Automatické
Uživatelský ovládací prvek Explicitní (konfigurace replik a oddílů) Nepřímá (ovlivněná charakteristikami úloh)
Billing Pevná hodinová sazba za jednotku vyhledávání (SU) Platby na základě spotřeby pro výpočetní jednotky (CU) a úložiště
Náklady na nečinnost Účtováno vždy (minimální rezervovaná kapacita) Při nečinnosti se škáluje na nulu
Zaměření optimalizace Určení velikosti infrastruktury Efektivita úloh
Nejlepší pro Předvídatelné, stabilní úlohy Proměnné, nárazové úlohy nebo úlohy s více tenanty, včetně scénářů řízených agenty
Přístup k plánování kapacity Velikost a škálování infrastruktury (repliky a oddíly) Optimalizace efektivity úloh a vzorů využití
Dopad na neefektivitu Latence a škálování tlaku Zvýšení přímých nákladů

Important

Bezserverová úroveň Developer je aktuálně ve verzi Preview. Tato verze Preview je poskytována bez smlouvy o úrovni služeb a nedoporučuje se pro produkční úlohy. Některé funkce nemusí být podporované nebo můžou mít omezené možnosti. Další informace najdete v dodatečných podmínkách použití pro verze Preview v Microsoft Azure.

Fakturace pro bezserverovou úroveň Developer ještě není ve verzi Preview povolená. Odhadované náklady na využití jsou k dispozici na portálu Azure a telemetrii, ale toto využití se během tohoto počátečního období nezobrazí na faktuře za Azure. Microsoft poskytne oznámení alespoň 30 dnů před zahájením fakturace. Odložení fakturace během této verze Preview je dočasné. Bezserverový vývojář je placená úroveň a po zahájení fakturace budete zodpovědní za případné poplatky.

Bezserverová úroveň Developer nepodporuje migraci do jiných cenových úrovní ani z jiných cenových úrovní a některé funkce, které jsou k dispozici na jiných úrovních, se ve verzi Public Preview nepodporují. Limity služeb, podporované funkce a podrobnosti o cenách se můžou před obecnou dostupností změnit.

Verze Preview je aktuálně dostupná pouze v oblasti USA – středozápad, Švýcarsko – sever a Japonsko – východ.

Další informace najdete tady: jak:

Plánování kapacity pro vyhrazený model

V modelu Dedicated zřídíte kapacitu pomocí jednotek vyhledávání (SU):

  • Jednotka vyhledávání (SU) = repliky × oddíly
  • Replika: Kopie vyhledávače. Poskytuje propustnost dotazů a vysokou dostupnost.
  • Oddíl: Jednotky úložiště. Poskytuje propustnost úložiště a indexování.

Každá služba začíná s 1 replikou × 1 oddílem (1 SU). Repliky a oddíly můžete nezávisle přidávat nebo odebírat, aby se přizpůsobily proměnlivému zatížení. Přidání kapacity zvyšuje náklady na provoz vyhledávací služby.

Koncepce Definice
Jednotka vyhledávání Jeden přírůstek celkové dostupné kapacity. Ke spuštění služby se vyžaduje minimálně jedna vyhledávací jednotka. V závislosti na cenové úrovni se maximální rozsahy liší od jedné do 36 jednotek.

Počet jednotek vyhledávání se rovná počtu replik vynásobených počtem oddílů: R × P = SU. Každá služba startuje s jednou replikou a jedním oddílem, což spotřebuje jednu jednotku: 1 × 1 = 1. Přidání druhé repliky spotřebovává dvě jednotky: 2 × 1 = 2.

Vyhledávací jednotka je také fakturační jednotka vyhledávací služby.
Replika Instance vyhledávací služby, které se používají především k vyrovnávání zatížení operací dotazů. Každá replika hostuje jednu kopii indexu. Pokud přidělíte tři repliky, máte k dispozici tři kopie indexu pro obsluhu dotazových požadavků.
Oddíl Fyzické úložiště a vstupně-výstupní operace pro operace čtení a zápisu (například při opětovném sestavení nebo aktualizaci indexu) Každý oddíl má část celkového indexu. Pokud přidělíte tři oddíly, index se rozdělí na třetiny.

V tabulce oddílů a replik najdete možné kombinace, které zůstanou pod limitem 36 jednotek.

Fyzické charakteristiky replik a oddílů, jako je rychlost zpracování a vstupně-výstupní operace disku, se liší podle úrovně služby. Ve standardní vyhledávací službě jsou repliky a oddíly rychlejší a větší než ty u základní služby.

Kdy přidat kapacitu pro vyhrazený model

Zvažte přidání replik nebo oddílů v případech, kdy:

  • Latence dotazů se zvyšuje nebo nejsou splněna kritéria smlouvy o úrovni služeb.
  • Četnost chyb HTTP 503 (Nedostupná služba) se zvyšuje.
  • Četnost chyb HTTP 429 (Příliš mnoho požadavků) se zvyšuje, což značí omezování požadavků.
  • Očekává se velké objemy dotazů.
  • Úlohy indexování jsou pomalé nebo zapadají.
  • Propustnost úložiště nebo indexování není dostatečná.

Pokyny ke škálování:

  • Přidejte repliky pro zvýšení propustnosti a dostupnosti dotazů.
  • Přidejte oddíly pro zvýšení výkonu úložiště a indexování.
  • Úlohy náročné na dotazy obvykle vyžadují více replik.
  • Velké indexy mohou vyžadovat další repliky pro zachování výkonu.

Important

Dokončení operací škálování může nějakou dobu trvat a zvýšit náklady. Vždy ověřte změny pomocí testování výkonu a odhadů cen.

Zvolená úroveň služby určuje velikost oddílu a jeho rychlost. Každá úroveň je optimalizovaná podle sady charakteristik, které odpovídají různým scénářům. Pokud zvolíte vyšší úroveň, možná budete potřebovat méně oddílů , než kdybyste zvolili S1. Jednou z otázek, na které je potřeba odpovědět prostřednictvím samostatně řízeného testování, je to, zda větší a dražší partice přináší lepší výkon než dvě levnější partice ve službě nastavené na nižší úrovni.

Jedna služba musí mít dostatek prostředků pro zpracování všech úloh (indexování a dotazů). Ani jedna pracovní zátěž neběží na pozadí. Indexování můžete naplánovat pro časy, kdy jsou požadavky na dotazy přirozeně méně časté, ale služba jinak nezpřednostňuje jeden úkol před druhým. Kromě toho určité množství redundance vyhladí výkon dotazů při interní aktualizaci služeb či uzlů.

Obecně platí, že vyhledávací aplikace obvykle potřebují více replik než partice, zejména když jsou operace služby přikloněné k úlohám dotazů. Každá replika je kopií vašeho indexu, takže služba může rozkládat požadavky mezi více kopií. Azure AI Vyhledávač spravuje veškeré vyrovnávání zatížení a replikaci indexu. Počet replik přidělených vaší službě můžete kdykoli změnit. Ve standardní vyhledávací službě můžete přidělit až 12 replik a 3 repliky ve vyhledávací službě Basic. Přidělení repliky můžete provést z portálu Azure nebo některé z programových možností.

Další oddíly jsou užitečné pro náročné úlohy indexování. Další oddíly šíří operace čtení a zápisu napříč větším počtem výpočetních prostředků.

Dotazování větších indexů trvá déle. Můžete například zjistit, že každé postupné zvýšení počtu oddílů vyžaduje menší, ale úměrné zvýšení replik. Složitost vašich dotazů a objem dotazů má vliv na to, jak rychle se dotazy provádějí.

Informace o omezeních služeb a platných rozsahech škálování najdete v následujících tématech:

Poznámka:

Přidání dalších replik nebo partice zvyšuje náklady na provoz služby a může představovat mírné změny v pořadí výsledků. Nezapomeňte zkontrolovat cenovou kalkulačku, abyste pochopili důsledky fakturace při přidávání dalších uzlů. Tabulka kombinací oddílů a replik vám může pomoct porovnat počet jednotek vyhledávání potřebných pro konkrétní konfiguraci. Další informace o tom, jak další repliky ovlivňují zpracování dotazů, najdete v tématu Řazení výsledků.

Správa a úprava kapacity

Změna kapacity není okamžitá. V závislosti na objemu dat a typu operace může škálování trvat několik minut až několik hodin.

Při škálování vyhledávací služby si můžete vybrat z následujících nástrojů a přístupů:

Poznámka:

Pokud byla vaše vyhledávací služba vytvořena před dubnem nebo květnem 2024, může mít nárok na jednorázový upgrade na novější infrastrukturu s většími velikostmi oddílů bez dalších poplatků. Tento upgrade může zvýšit dostupné úložiště na oddíl a snížit počet oddílů požadovaných pro vaši úlohu. Další informace najdete v Vylepšete svou vyhledávací službu.

Pokud chcete zvýšit nebo snížit kapacitu služby, máte dvě možnosti:

Přidání nebo odebrání oddílů a replik

  1. Přejděte do vyhledávací služby na portálu Azure.

  2. V levém podokně vyberte Nastavení>Škála.

    Následující snímek obrazovky zobrazuje standardní službu, která je zřízená s jednou replikou a jedním oddílem. Vzorec v dolní části označuje, kolik jednotek hledání se používá (1). Pokud by jednotková cena byla 100 USD (nikoli reálná cena), měsíční náklady na provoz této služby by byly v průměru 100 USD.

    Snímek obrazovky stránky Škála zobrazující aktuální hodnoty repliky a oddílu.

  3. Pomocí posuvníku zvyšte nebo snižte počet oddílů a pak vyberte Uložit.

    Tento příklad přidá druhou repliku a oddíl. Všimněte si počtu jednotek vyhledávání; teď je čtyři, protože fakturační vzorec je repliky vynásobené oddíly (2 x 2). Zdvojnásobení kapacity více než zdvojnásobí náklady na provoz služby. Pokud by náklady na jednotku vyhledávání byly 100 USD, nová měsíční faktura by teď byla 400 USD.

    Aktuální náklady na jednotku jednotlivých úrovní najdete na stránce s cenami.

    Snímek obrazovky se stránkou Škálování s přidanými replikami a oddíly

  4. Zkontrolujte své oznámení, abyste potvrdili, že operace byla zahájena.

    Screenshot oznámení o operaci škálování na portálu Azure portal.

    Dokončení této operace může trvat několik hodin. Probíhá na pozadí, takže vyhledávací služba zůstává plně funkční a dostupná pro operace čtení a zápisu.

    Operaci nemůžete zrušit ani sledovat její průběh. Během probíhajících změn se ale zobrazí následující zpráva.

    Screenshot zprávy o aktualizaci na portálu Azure portal.

Změna cenové úrovně

Poznámka:

Portál Azure a Služby – aktualizace (REST API) podporují změny mezi úrovněmi Basic a Standard (S1, S2 a S3). Úrovně můžete upgradovat nebo downgradovat za předpokladu, že vaše aktuální konfigurace služby nepřekračuje limity cílové úrovně. Vaše oblast také nemůže mít omezení kapacity na cílové úrovni.

Cenová úroveň určuje maximální úložiště vyhledávací služby pro cenový model Dedicated. Pokud potřebujete více nebo méně kapacity, můžete přejít na jinou cenovou úroveň, která vyhovuje vašim potřebám úložiště. (To platí jenom pro úrovně cenového modelu Dedicated. Úroveň Vývojář bezserverového modelu nejde po výběru změnit.

Kromě kapacity cenové úrovně určují limity indexů, indexerů a dalších vyhledávacích objektů. Než budete pokračovat, porovnejte limity služby aktuální úrovně a požadované úrovně. Obecně platí, že přechod na vyšší úroveň zvyšuje limit úložiště a limit vektorů, zvyšuje propustnost požadavků a snižuje latenci, zatímco přepnutí na nižší úroveň má opačný účinek.

Přechod na vyšší cenovou úroveň také zvyšuje náklady na provoz vyhledávací služby. Další informace najdete na stránce s cenami.

Chcete-li změnit cenovou úroveň:

  1. Přejděte do vyhledávací služby na portálu Azure.

  2. V levém podokně vyberte Nastavení>Škála.

  3. Pod aktuální úrovní vyberte Změnit cenovou úroveň.

    Snímek obrazovky tlačítka Změnit cenovou úroveň na portálu Azure.

  4. Na stránce Vybrat cenovou úroveň vyberte jinou úroveň ze seznamu.

    Můžete přepínat mezi úrovněmi Basic, S1, S2 a S3, ale nemůžete přepnout na free, S3HD, L1 nebo L2. Tyto úrovně se nedají vybrat a zobrazují se šedě.

    Screenshot stránky Vybrat cenovou úroveň a seznam dostupných úrovní na portálu Azure.

  5. Pokud chcete spustit operaci škálování, vyberte Uložit.

    Screenshot tlačítka Uložit na portálu Azure portal.

    Dokončení této operace může trvat několik hodin. Probíhá na pozadí, takže vyhledávací služba zůstává plně funkční a dostupná pro operace čtení a zápisu.

    Operaci nemůžete zrušit ani sledovat její průběh. Během probíhajících změn se ale zobrazí následující zpráva.

    Screenshot zprávy o aktualizaci na portálu Azure portal.

Jak se zpracovávají žádosti o škálování pro vyhrazený model

Když vyhledávací služba obdrží žádost o škálování, bude následující:

  1. Zkontroluje, jestli je požadavek platný.
  2. Spustí zálohování dat a systémových informací.
  3. Zkontroluje, jestli je služba již v nasazování (přidává aktuálně nebo eliminuje repliky nebo oddíly).
  4. Zahajuje nastavení.

Škálování služby může trvat několik minut až několik hodin v závislosti na velikosti služby a rozsahu požadavku. Doba trvání zálohování se také liší v závislosti na množství dat a počtu oddílů a replik.

Předchozí kroky nejsou úplně po sobě jdoucí. Systém například spustí zřizování, když to může bezpečně provést, což může být v době, kdy se zálohování chýlí ke konci.

Chyby při škálování

Následující tabulka uvádí příčiny a řešení chyb, ke kterým může dojít během operací škálování.

Zpráva o chybě Příčina Solution
Operace aktualizace služeb nejsou v tuto chvíli povolené, protože zpracováváme předchozí požadavek. Probíhá další operace škálování. Zkontrolujte stránku Přehled na portálu Azure nebo pomocí rozhraní REST API Search Management, Azure PowerShell nebo Azure CLI zjistěte stav vyhledávací služby. Pokud je stav "zřizování", počkejte, až se změní na "úspěšné" nebo "neúspěšné", než zkusíte znovu. 1, 2
Nepodařilo se škálovat vyhledávací službu servicename. Chyba: Počet objektůActualCount překračuje povolený limit: MaximumCount. Vaše aktuální konfigurace služby překračuje limity cílové cenové úrovně. Zkontrolujte, jestli využití úložiště, vektorové využití, indexy, indexery a další objekty odpovídají limitům služby nižší úrovně. Například úroveň Basic podporuje až 15 indexů, takže pokud máte 16 indexů, nemůžete přejít z úrovně S1 na Basic. Před dalším pokusem upravte své zdroje.

1 Pro zálohy neexistuje žádný stav, protože se jedná o interní operace, které pravděpodobně nebudou narušovat cvičení škálování.

2 Pokud se zdá, že vyhledávací služba je ve stavu zřizování zastavená, zkontrolujte, jestli nejsou opuštěné indexy, které jsou nepoužitelné, s nulovými objemy dotazů a bez aktualizací indexu. Nepoužitelný index může blokovat změny kapacity služby. Konkrétně hledejte indexy šifrované pomocí klíče CMK , jejichž klíče už nejsou platné. Odstraňte index nebo obnovte klíče, aby se index vrátil do režimu online, a odblokujte operaci škálování.

Kombinace oddílů a replik

Následující graf platí pro úroveň Standard a vyšší. Zobrazuje všechny možné kombinace oddílů a replik, které podléhají maximálnímu počtu 36 jednotek vyhledávání na službu.

1 oddíl 2 oddíly 3 oddíly 4 oddíly 6 oddílů 12 oddílů
1 replika 1 SU 2 SU 3 SJ 4 SU 6 SU 12 SU
2 kopie 2 SU 4 SU 6 SU 8 SU 12 SU 24 SU
3 repliky 3 SJ 6 SU 9 SU 12 SU 18 SU 36 SU
4 repliky 4 SU 8 SU 12 SU 16 SU 24 SU neuplatňuje se
5 kopií 5 SU 10 SU 15 SU 20 SU 30 SU neuplatňuje se
6 replik 6 SU 12 SU 18 SU 24 SU 36 SU neuplatňuje se
12 replik 12 SU 24 SU 36 SU neuplatňuje se neuplatňuje se neuplatňuje se

Základní vyhledávací služby mají nižší počet jednotek vyhledávání.

  • Ve vyhledávacích službách vytvořených před 3. dubnem 2024 mohou základní služby mít přesně jeden oddíl a až tři repliky, přičemž maximální limit je tři SU. Jediným nastavitelným prostředkem jsou repliky. Možná ale budete moct zvýšit počet oddílů upgradem služby.

  • Ve vyhledávacích službách vytvořených po 3. dubnu 2024 v podporovaných oblastech můžou mít základní služby až tři oddíly a tři repliky. Maximální limit SU je devět, aby podporoval úplnou sadu oddílů a replik.

Pro vyhledávací služby na libovolné fakturovatelné úrovni bez ohledu na datum vytvoření potřebujete minimálně dvě repliky pro zajištění vysoké dostupnosti dotazů.

Informace o fakturačních sazbách na úroveň a měnu najdete na stránce s cenami Azure AI Vyhledávač.

Odhadněte kapacitu pomocí cenové úrovně modelu Dedicated

Vaše potřeby úložiště závisí na velikosti indexů, které očekáváte při sestavování. Neexistují žádné pevné heuristické ani obecné pokyny, které pomáhají s odhady. Jediným způsobem, jak určit velikost indexu, je vytvořit jeden. Jeho velikost závisí na tokenizaci a vkládání a jestli povolíte sugestory, filtrování a řazení, nebo můžete využít kompresi vektorů.

Odhad kapacity na fakturovatelné úrovni, Basic nebo vyšší Úroveň Free běží na fyzických prostředcích sdílených více zákazníky a podléhá faktorům nad rámec vaší kontroly. Pouze vyhrazené prostředky fakturovatelné vyhledávací služby mohou pojmout delší doby vzorkování a zpracování pro realističtější odhady množství indexu, velikosti a objemů dotazů během vývoje.

  1. Zkontrolujte limity služeb na jednotlivých úrovních a zjistěte, jestli nižší úrovně můžou podporovat požadovaný počet indexů. Zvažte, jestli potřebujete více kopií indexu pro aktivní vývoj, testování a produkci.

    Vyhledávací služba podléhá limitům objektů (maximální počet indexů, indexerů, sad dovedností atd.) a limitů úložiště. Kterýkoli limit je dosažen jako první, je považován za platný limit.

  2. Vytvořte službu na fakturovatelné úrovni. Úrovně jsou optimalizované pro určité úlohy. Například úroveň Optimalizováno pro úložiště má limit 10 indexů, protože je navržená tak, aby podporovala nízký počet velkých indexů.

    • Pokud si nejste jistí ohledně projektovaného zatížení, začněte na nízké úrovni, jako je Basic nebo S1.

    • Pokud testování zahrnuje rozsáhlé indexování a načítání dotazů, začněte vysoko na úrovni S2 nebo dokonce S3.

    • Pokud indexujete velké množství dat a zatížení dotazů je relativně nízké, začněte s optimalizací úložiště v L1 nebo L2, stejně jako u interní obchodní aplikace.

  3. Vytvořte počáteční index , abyste zjistili, jak se zdrojová data překládají na index. Toto je jediný způsob, jak odhadnout velikost indexu. Atributy definic polí ovlivňují požadavky fyzického úložiště:

  4. Sledujte úložiště, limity služeb, objem dotazů a latenci na portálu Azure. Portál Azure zobrazuje dotazy za sekundu, omezené dotazy a latenci vyhledávání. Tyto hodnoty vám můžou pomoct při rozhodování, jestli jste vybrali správnou úroveň.

  5. Přidejte repliky pro zajištění vysoké dostupnosti nebo ke zmírnění pomalého výkonu dotazů.

    Neexistují žádné pokyny k tomu, kolik replik je potřeba k přizpůsobení zatížení dotazů. Výkon dotazů závisí na složitosti dotazu a konkurenčních úlohách. I když přidávání replik jasně vede k lepšímu výkonu, výsledek není striktně lineární: přidání tří replik nezaručuje trojitou propustnost. Pokyny k odhadu QPS pro vaše řešení najdete v tématu Analýza výkonu a monitorování dotazů.

U invertovaného indexu se velikost a složitost určují obsahem, ne nutně množstvím dat, která do něj vytáčíte. Velký zdroj dat s vysokou redundancí může mít za následek menší index než menší datovou sadu, která obsahuje vysoce proměnlivý obsah. Proto je zřídka možné odvodit velikost indexu na základě velikosti původní datové sady.

Požadavky na úložiště se dají nafouknout, pokud zahrnete data, která nikdy nevyhledáte. V ideálním případě dokumenty obsahují jenom data, která potřebujete pro vyhledávání.

Důležité informace o smlouvě o úrovni služeb

Smlouvy o úrovni služeb (SLA) se nezabývá funkcemi úrovně Free a Preview. U všech fakturovatelných úrovní se smlouvy SLA projeví při zřizování dostatečné redundance pro vaši službu.

  • Dvě nebo více replik splňují SLA požadavky pro dotazy (čtení).

  • Tři nebo více replik splňuje SLA pro dotazy a indexování (čtení a zápis).

Počet oddílů nemá vliv na úrovně SLA.

Optimalizace nákladů na bezserverový model

V bezserverovém cenovém modelu:

  • Služba automaticky spravuje kapacitu.
  • Nemusíte konfigurovat repliky, oddíly ani jednotky vyhledávání.
  • Výpočty se dynamicky škálují na základě úlohy (dotazování a indexování poptávky) a při nečinnosti se můžou škálovat na nulu.

Další informace o omezeních bezserverového modelu najdete v tématu Omezení služeb.

Fakturace je založená na dvou dimenzích:

  • Využití výpočetních prostředků (CU): Účtuje se na základě operací dotazování a indexování.
  • Indexované úložiště: Účtováno za GB za měsíc.

Vzhledem k tomu, že fakturace je založená na spotřebě, jsou náklady přímo svázané s využitím:

  • Složité dotazy spotřebovávají více výpočetních prostředků.
  • Neefektivní návrh schématu zvyšuje náklady na indexování i dotazování.
  • Špatné vzory dotazů s velkými nebo často aktualizovanými indexy zvyšují využití úložiště a výpočetních prostředků.

Optimalizace efektivity úloh

Vzhledem k tomu, že se v bezserverovém modelu zobrazuje neefektivita jako náklady, platíte za stejnou práci více, pokud neprovádíte návrh pracující s úlohami. Nejlepší způsob, jak řídit bezserverové výdaje, je efektivně navrhovat indexy a dotazy od začátku.

Při návrhu úloh pro efektivitu při používání cenového modelu bezserverové architektury zvažte:

Návrh indexu

  • Zahrnout pouze pole použitá v dotazech.
  • Pokud je to možné, zmenšete rozměry vektoru.
  • Vyhněte se zbytečným filtrovacím, řadicím nebo fasetovým atributům.

Vzory dotazů

  • Slouží $select k omezení vrácených polí.
  • Použijte filtry co nejdříve, abyste zmenšili množiny výsledků.
  • Vyhněte se hlubokému stránkování ($skip).
  • Upřednostněte cílené dotazy před širokými fulltextovým dotazy.
  • Hybridní vyhledávání používejte pečlivě kvůli vyšším nákladům na výpočetní prostředky.

Monitoring

  • Monitorování spotřeby CU za účelem identifikace drahých dotazů
  • Sledujte růst úložiště a odeberte nepoužitá data.

V bezserverové podobě se zvýšení výkonu (rychlejší, cílenější dotazy) obvykle snižuje náklady.

Další informace najdete v článku Optimalizace nákladů pomocí serverless cenového modelu v Azure AI Vyhledávač.

Aspekty regionální kapacity

Kapacita a dostupnost se můžou lišit podle podporované oblasti. Některé oblasti můžou mít omezení zřizování nových služeb nebo škálování stávajících služeb.

Poznámka:

Ve verzi Public Preview je cenový model bez serveru dostupný jenom v omezené sadě oblastí. Podívejte se na oznámení o verzi Preview na začátku tohoto článku.

Pokud váš preferovaný region Azure AI Vyhledávač není k dispozici kvůli omezené kapacitě, viz Jak řešit omezení kapacity regionů ve službě Azure AI Vyhledávač.

Další kroky