Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Poznámka
Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.
V Azure AI Vyhledávač funkce semantického rankeru měřitelně zlepšuje relevanci vyhledávání tím, že využívá jazykové modely Microsoftu k opětovnému řazení výsledků hledání. Sémantický ranker je také integrovaný do agentického vyhledávání. Tento článek je základní úvod, který vám pomůže pochopit chování a výhody sémantického rankeru.
Sémantický ranker je prémiová funkce, která se účtuje podle využití, ale můžete ji použít zdarma v souladu s limity služeb pro úroveň Free. Tento článek doporučujeme pro pozadí, ale pokud chcete raději začít, postupujte podle těchto kroků.
Co je sémantické hodnocení?
Sémantický ranker je kolekce funkcí na straně dotazu, které zlepšují kvalitu počátečního výsledku hledání seřazeného podle BM25 nebo RRF pro textové dotazy, textovou část vektorových dotazů a hybridní dotazy. Sémantické řazení rozšiřuje kanál spouštění dotazů třemi způsoby:
Za prvé, vždy přidá sekundární hodnocení k počáteční sadě výsledků, která byla vyhodnocena pomocí BM25 nebo Reciprocal Rank Fusion (RRF). Toto sekundární hodnocení využívá vícejazyčné modely hlubokého učení přizpůsobené Microsoft Bing, aby podporovaly nejvíce sémanticky relevantních výsledků.
Za druhé vrátí titulky a volitelně extrahuje odpovědi v odpovědi, které můžete vykreslit na vyhledávací stránce, aby se zlepšilo vyhledávání uživatele.
Za třetí, pokud povolíte přepsání dotazu, rozbalí počáteční řetězec dotazu na více sémanticky podobných řetězců dotazu.
Sekundární řazení a "odpovědi" se vztahují na odpověď na dotaz. Přepsání dotazu je součástí žádosti o dotaz.
Tady jsou možnosti sémantického rerankeru.
| Schopnosti | Popis |
|---|---|
| Pořadí L2 | Použije kontext nebo sémantický význam dotazu k výpočtu nového skóre relevance nad předem seřazenými výsledky. |
| Sémantické titulky a zvýraznění | Extrahuje doslovné věty a fráze z polí, která nejlépe shrnují obsah, a zvýrazní klíčové pasáže pro snadné skenování. Titulky, které shrnují výsledek, jsou užitečné, když jsou jednotlivá pole obsahu pro stránku výsledků hledání příliš hustá. Zvýrazněný text zvyšuje úroveň nejrelevavantnějších termínů a frází, aby uživatelé mohli rychle zjistit, proč byla shoda považována za relevantní. |
| Sémantické odpovědi | Nepovinná a dodatečná dílčí struktura vrácená ze sémantického dotazu. Poskytuje přímou odpověď na dotaz, který vypadá jako otázka. Vyžaduje, aby dokument obsahuje text s vlastnostmi odpovědi. |
| Přepsání dotazu | Pomocí textových dotazů nebo textové části vektorového dotazu vytvoří sémantický ranker až 10 variant dotazu, třeba opraví překlepy nebo pravopisné chyby nebo přehraje dotaz pomocí vygenerovaných synonym. Přepsaný dotaz se spustí na vyhledávacím webu. Výsledky jsou hodnoceny pomocí skórování BM25 nebo RRF, a následně je znovu vyhodnotí sémantický ranker. |
Jak funguje sémantický ranker
Sémantický ranker vezme dotaz a výsledky a pak je pošle do modelů pro rozpoznávání jazyka hostovaných Microsoft. Skenuje pro lepší shody.
Následující obrázek vysvětluje koncept. Představte si termín "kapitál". Má různé významy v závislosti na tom, jestli je kontext finance, zákon, zeměpis nebo gramatika. Díky porozumění jazyku sémantický ranker rozpozná kontext a podporuje výsledky, které odpovídají záměru dotazu.
Sémantické řazení využívá mnoho zdrojů a času. Aby bylo možné dokončit zpracování v rámci očekávané latence operace dotazu, systém konsoliduje a snižuje vstupy do sémantického rankeru. Tento přístup pomáhá co nejrychleji dokončit krok opětovného řazení.
Sémantické řazení má tři kroky:
- Shromažďování a shrnutí vstupů
- Hodnotit výsledky pomocí sémantického rankeru
- Výstup přehodnocených výsledků, titulků a odpovědí
Jak systém shromažďuje a shrnuje vstupy
V sémantickém řazení předává subsystém dotazů výsledky hledání jako vstup pro sumarizaci a modely řazení. Vzhledem k tomu, že modely řazení mají omezení velikosti vstupu a jsou náročné na zpracování, musí být výsledky hledání velikostně upraveny a strukturovány (souhrnně) pro efektivní zpracování.
Sémantický ranker začíná výsledkem seřazeným podle BM25 z textového dotazu nebo výsledku seřazeného RRF z vektoru nebo hybridního dotazu. Cvičení pro přerovnání používá pouze text. I když výsledky obsahují více než 50 výsledků, pouze prvních 50 výsledků postupuje k sémantickému hodnocení. Sémantické řazení obvykle používá informační a popisná pole.
Pro každý dokument ve výsledku hledání přijímá model sumarizace až 2 000 tokenů, kde je token přibližně 10 znaků. Model sestaví vstupy z polí "title", "keyword" a "content" uvedených v sémantické konfiguraci.
Systém ořezává příliš dlouhé řetězce, aby se zajistilo, že celková délka splňuje vstupní požadavky shrnovacího kroku. Důležitost přidání polí do sémantické konfigurace podle priority spočívá v tomto procesu oříznutí. Pokud máte velmi velké dokumenty s poli náročnými na text, systém ignoruje cokoli po maximálním limitu.
Sémantické pole Limit tokenů titul 128 tokenů Klíčová slova 128 tokenů obsah zbývající tokeny Výstup sumarizace je souhrnný řetězec pro každý dokument, který se skládá z nejrelevavantnějších informací z každého pole. Systém odesílá souhrnné řetězce do rankeru pro hodnocení a do modelů strojového porozumění čtení pro titulky a odpovědi.
Od listopadu 2024 je maximální délka každého generovaného souhrnného řetězce předaného sémantickému rankeru 2 048 tokenů. Dříve to bylo 256 tokenů.
Jak jsou výsledky vyhodnoceny
Systém vyhodnocuje výsledky na základě titulku a veškerého dalšího obsahu ze souhrnného řetězce, který vyplní délku 2 048 tokenů.
Systém vyhodnotí titulky pro koncepční a sémantickou relevanci vzhledem k zadanému dotazu.
Systém přiřadí každému dokumentu @search.rerankerScore na základě sémantické relevance dokumentu pro daný dotaz. Skóre se pohybuje od 4 do 0 (vysoké až nízké), kde vyšší skóre označuje vyšší význam.
Skóre Význam 4.0 Dokument je vysoce relevantní a zcela odpovídá na otázku, i když část může obsahovat další text nesouvisející s otázkou. 3.0 Dokument je relevantní, ale chybí podrobnosti, které by ho dokončily. 2.0 Dokument je poněkud relevantní; odpovídá na otázku buď částečně, nebo pouze na některé aspekty otázky. 1.0 Dokument souvisí s otázkou a odpovídá na malou část. 0.0 Dokument není relevantní. Systém seřadí shody sestupně podle skóre a zahrne je do datové části odpovědi dotazu. Datová část obsahuje odpovědi, jednoduchý text, zvýrazněné popisky a všechna pole, která jste označili jako získatelná nebo specifikovali v klauzuli SELECT.
Poznámka
U každého daného dotazu mohou distribuce @search.rerankerScore vykazovat mírné odchylky z důvodu podmínek na úrovni infrastruktury. Aktualizace modelu řazení můžou také ovlivnit distribuci. Z těchto důvodů, pokud píšete vlastní kód pro minimální prahové hodnoty nebo nastavujete vlastnost prahové hodnoty pro vektorové a hybridní dotazy, nevytvářejte limity příliš podrobné.
Výstupy sémantického rankeru
V každém souhrnném řetězci najdou modely porozumění strojovému čtení pasáže, které jsou nejvýraznější.
Výstupy jsou:
Sémantický titulek dokumentu. Každý titulek je k dispozici ve verzi prostého textu a ve verzi zvýraznění a často je méně než 200 slov na dokument.
Volitelná sémantická odpověď za předpokladu
answers, že jste zadali parametr, dotaz byl položen jako otázka a v dlouhém řetězci se nachází pasáž, která poskytuje pravděpodobnou odpověď na otázku.
Titulky a odpovědi jsou vždy doslovný text z indexu. V tomto pracovním postupu neexistuje žádný model generativní umělé inteligence, který generuje nebo skládá nový obsah.
Sémantické funkce a omezení
Co může sémantický ranker dělat:
Zvýšit úroveň shod, které jsou sémanticky blíže záměru původního dotazu.
Najděte texty, které se mají použít pro titulky a odpovědi. Odpověď vrátí titulky a odpovědi, které můžete vykreslit na stránce výsledků hledání.
To, co sémantický ranker nemůže udělat, je znovu spustit dotaz na celý korpus a najít sémanticky relevantní výsledky. Sémantické řazení přeřadí existující sadu výsledků, která se skládá z 50 nejlepších výsledků podle výchozího algoritmu řazení. Sémantický ranker navíc nemůže vytvářet nové informace ani řetězce. Jazykové modely extrahují titulky a odpovědi doslovně z vašeho obsahu, takže pokud výsledky neobsahují text podobný odpovědi, nevygenerují ho.
I když sémantické hodnocení není v každém scénáři přínosné, může určitý obsah výrazně těžit z jeho schopností. Jazykové modely v sémantických žebříčcích fungují nejlépe na prohledávatelném obsahu, který je bohatý na informace a strukturovaný jako próza. Znalostní báze, online dokumentace nebo dokumenty, které obsahují popisný obsah, vidí největší zisky z možností sémantického rankeru.
Základní technologie pochází z Bingu a Microsoft Research a je integrovaná do infrastruktury Azure AI Vyhledávač jako doplňková funkce. Další informace o výzkumu a investicích do umělé inteligence podporující sémantický ranker najdete v tématu Jak AI od Bingu pohání Azure AI Vyhledávač (Microsoft Research Blog).
Následující video obsahuje přehled možností.
Jak sémantický ranker používá mapy synonym
Pokud povolíte podporu mapování synonym přidružených k poli v indexu vyhledávání a zahrnete toto pole do sémantické konfigurace rankeru, sémantický ranker automaticky použije nakonfigurované synonyma během procesu opětovného řazení.
Dostupnost a ceny
Sémantický ranker je k dispozici ve vybraných oblastech. Dá se použít jako samostatná funkce nebo jako integrovaná součást agentního načítání. Každá funkce se účtuje nezávisle.
Sémantic ranker nabízí bezplatný plán (výchozí) s měsíčním příspěvkem bezplatné žádosti a standardním plánem pro průběžné platby po využití bezplatného příspěvku. Další informace najdete v tématu Povolení nebo zakázání fakturace sémantického třídicího algoritmu.
Poplatky za sémantický ranker se účtují, když požadavky na dotazy zahrnují queryType=semantic a hledaný řetězec není prázdný (například search=pet friendly hotels in New York). Pokud je hledaný řetězec prázdný (search=*), nebude se vám nic účtovat, i když je typ dotazu nastavený na sémantickou.
Jak začít
(Volitelné) Přejděte na standardní fakturační plán využití nad rámec bezplatné měsíční kvóty.
Nastavte dotazy tak, aby vracely sémantické titulky a zvýraznění.
(Volitelné) Vrátí sémantické odpovědi.