Indexes - Analyze
Pokazuje, jak analizator dzieli tekst na tokeny.
POST {endpoint}/indexes('{indexName}')/search.analyze?api-version=2026-04-01
Parametry identyfikatora URI
| Nazwa | W | Wymagane | Typ | Opis |
|---|---|---|---|---|
|
endpoint
|
path | True |
string (uri) |
Adres URL punktu końcowego usługi wyszukiwania. |
|
index
|
path | True |
string |
Nazwa indeksu. |
|
api-version
|
query | True |
string minLength: 1 |
Wersja interfejsu API do użycia dla tej operacji. |
Nagłówek żądania
| Nazwa | Wymagane | Typ | Opis |
|---|---|---|---|
| Accept |
Nagłówek Accept. |
||
| x-ms-client-request-id |
string (uuid) |
Nieprzezroczystym, globalnie unikatowym identyfikatorem ciągu generowanego przez klienta dla żądania. |
Treść żądania
| Nazwa | Wymagane | Typ | Opis |
|---|---|---|---|
| text | True |
string |
Tekst do podziału na tokeny. |
| analyzer |
Nazwa analizatora do użycia w celu przerwania danego tekstu. Jeśli ten parametr nie zostanie określony, należy zamiast tego określić tokenizator. Parametry tokenizatora i analizatora wzajemnie się wykluczają. |
||
| charFilters |
Opcjonalna lista filtrów znaków do użycia podczas przerywania danego tekstu. Ten parametr można ustawić tylko w przypadku używania parametru tokenizatora. |
||
| normalizer |
Nazwa normalizatora, który ma być używany do normalizacji danego tekstu. |
||
| tokenFilters |
Opcjonalna lista filtrów tokenów do użycia podczas przerywania danego tekstu. Ten parametr można ustawić tylko w przypadku używania parametru tokenizatora. |
||
| tokenizer |
Nazwa tokenizatora używanego do dzielenia danego tekstu. Jeśli ten parametr nie zostanie określony, należy zamiast tego określić analizator. Parametry tokenizatora i analizatora wzajemnie się wykluczają. |
Odpowiedzi
| Nazwa | Typ | Opis |
|---|---|---|
| 200 OK |
Żądanie zakończyło się pomyślnie. |
|
| Other Status Codes |
Nieoczekiwana odpowiedź na błąd. |
Zabezpieczenia
api-key
Typ:
apiKey
W:
header
OAuth2Auth
Typ:
oauth2
Flow:
implicit
Adres URL autoryzacji:
https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Zakresy
| Nazwa | Opis |
|---|---|
| https://search.azure.com/.default |
Przykłady
SearchServiceIndexAnalyze
Przykładowe żądanie
POST https://exampleservice.search.windows.net/indexes('example-index')/search.analyze?api-version=2026-04-01
{
"text": "Text to analyze",
"analyzer": "ar.lucene"
}
Przykładowa odpowiedź
{
"tokens": [
{
"token": "text",
"startOffset": 0,
"endOffset": 4,
"position": 0
},
{
"token": "to",
"startOffset": 5,
"endOffset": 7,
"position": 1
},
{
"token": "analyze",
"startOffset": 8,
"endOffset": 15,
"position": 2
}
]
}
Definicje
| Nazwa | Opis |
|---|---|
| Accept |
Nagłówek Accept. |
|
Analyzed |
Informacje o tokenie zwróconym przez analizator. |
|
Analyze |
Określa niektóre składniki tekstowe i analityczne używane do dzielenia tego tekstu na tokeny. |
|
Analyze |
Wynik testowania analizatora tekstu. |
|
Char |
Definiuje nazwy wszystkich filtrów znaków obsługiwanych przez wyszukiwarkę. |
|
Error |
Dodatkowe informacje o błędzie zarządzania zasobami. |
|
Error |
Szczegóły błędu. |
|
Error |
Typowa odpowiedź na błędy dla wszystkich interfejsów API usługi Azure Resource Manager w celu zwrócenia szczegółów błędu dla operacji, które zakończyły się niepowodzeniem. (Jest to również zgodne z formatem odpowiedzi na błąd OData). |
|
Lexical |
Definiuje nazwy wszystkich analizatorów tekstu obsługiwanych przez wyszukiwarkę. |
|
Lexical |
Definiuje nazwy wszystkich normalizatorów tekstu obsługiwanych przez wyszukiwarkę. |
|
Lexical |
Definiuje nazwy wszystkich tokenizatorów obsługiwanych przez wyszukiwarkę. |
|
Token |
Definiuje nazwy wszystkich filtrów tokenów obsługiwanych przez wyszukiwarkę. |
Accept
Nagłówek Accept.
| Wartość | Opis |
|---|---|
| application/json;odata.metadata=minimal |
AnalyzedTokenInfo
Informacje o tokenie zwróconym przez analizator.
| Nazwa | Typ | Opis |
|---|---|---|
| endOffset |
integer (int32) |
Indeks ostatniego znaku tokenu w tekście wejściowym. |
| position |
integer (int32) |
Pozycja tokenu w tekście wejściowym względem innych tokenów. Pierwszy token w tekście wejściowym ma pozycję 0, następny ma pozycję 1 itd. W zależności od używanego analizatora niektóre tokeny mogą mieć taką samą pozycję, na przykład jeśli są synonimami siebie nawzajem. |
| startOffset |
integer (int32) |
Indeks pierwszego znaku tokenu w tekście wejściowym. |
| token |
string |
Token zwrócony przez analizator. |
AnalyzeRequest
Określa niektóre składniki tekstowe i analityczne używane do dzielenia tego tekstu na tokeny.
| Nazwa | Typ | Opis |
|---|---|---|
| analyzer |
Nazwa analizatora do użycia w celu przerwania danego tekstu. Jeśli ten parametr nie zostanie określony, należy zamiast tego określić tokenizator. Parametry tokenizatora i analizatora wzajemnie się wykluczają. |
|
| charFilters |
Opcjonalna lista filtrów znaków do użycia podczas przerywania danego tekstu. Ten parametr można ustawić tylko w przypadku używania parametru tokenizatora. |
|
| normalizer |
Nazwa normalizatora, który ma być używany do normalizacji danego tekstu. |
|
| text |
string |
Tekst do podziału na tokeny. |
| tokenFilters |
Opcjonalna lista filtrów tokenów do użycia podczas przerywania danego tekstu. Ten parametr można ustawić tylko w przypadku używania parametru tokenizatora. |
|
| tokenizer |
Nazwa tokenizatora używanego do dzielenia danego tekstu. Jeśli ten parametr nie zostanie określony, należy zamiast tego określić analizator. Parametry tokenizatora i analizatora wzajemnie się wykluczają. |
AnalyzeResult
Wynik testowania analizatora tekstu.
| Nazwa | Typ | Opis |
|---|---|---|
| tokens |
Lista tokenów zwróconych przez analizator określony w żądaniu. |
CharFilterName
Definiuje nazwy wszystkich filtrów znaków obsługiwanych przez wyszukiwarkę.
| Wartość | Opis |
|---|---|
| html_strip |
Filtr znaków, który próbuje usunąć konstrukcje HTML. Zobacz https://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/charfilter/HTMLStripCharFilter.html |
ErrorAdditionalInfo
Dodatkowe informacje o błędzie zarządzania zasobami.
| Nazwa | Typ | Opis |
|---|---|---|
| info |
Dodatkowe informacje. |
|
| type |
string |
Dodatkowy typ informacji. |
ErrorDetail
Szczegóły błędu.
| Nazwa | Typ | Opis |
|---|---|---|
| additionalInfo |
Dodatkowe informacje o błędzie. |
|
| code |
string |
Kod błędu. |
| details |
Szczegóły błędu. |
|
| message |
string |
Komunikat o błędzie. |
| target |
string |
Cel błędu. |
ErrorResponse
Typowa odpowiedź na błędy dla wszystkich interfejsów API usługi Azure Resource Manager w celu zwrócenia szczegółów błędu dla operacji, które zakończyły się niepowodzeniem. (Jest to również zgodne z formatem odpowiedzi na błąd OData).
| Nazwa | Typ | Opis |
|---|---|---|
| error |
Obiekt błędu. |
LexicalAnalyzerName
Definiuje nazwy wszystkich analizatorów tekstu obsługiwanych przez wyszukiwarkę.
| Wartość | Opis |
|---|---|
| ar.microsoft |
Microsoft analizator dla arabskiego. |
| ar.lucene |
Analizator Lucene dla języka arabskiego. |
| hy.lucene |
Analizator Lucene dla języka ormiańskiego. |
| bn.microsoft |
Microsoft analizator dla bengalskiego. |
| eu.lucene |
Analizator Lucene dla języka baskijskiego. |
| bg.microsoft |
Microsoft analizator dla bułgarskiego. |
| bg.lucene |
Analizator Lucene dla języka bułgarskiego. |
| ca.microsoft |
Microsoft analyzer dla katalońskiego. |
| ca.lucene |
Analizator Lucene dla języka katalońskiego. |
| zh-Hans.microsoft |
Microsoft Analyzer for Chinese (Simplified). |
| zh-Hans.lucene |
Analizator Lucene dla języka chińskiego (uproszczony). |
| zh-Hant.microsoft |
Microsoft analizator dla chińskiego (tradycyjny). |
| zh-Hant.lucene |
Analizator Lucene dla języka chińskiego (tradycyjnego). |
| hr.microsoft |
Microsoft analizator dla chorwackiego. |
| cs.microsoft |
Microsoft analizator dla czeskiego. |
| cs.lucene |
Analizator Lucene dla Czech. |
| da.microsoft |
Microsoft analizator dla duńskiego. |
| da.lucene |
Analizator Lucene dla języka duńskiego. |
| nl.microsoft |
Microsoft Analyzer for Dutch. |
| nl.lucene |
Analizator Lucene dla języka niderlandzkiego. |
| en.microsoft |
Microsoft Analyzer for English. |
| en.lucene |
Analizator Lucene dla języka angielskiego. |
| et.microsoft |
Microsoft analizator dla estońskiego. |
| fi.microsoft |
Microsoft analizator dla języka fińskiego. |
| fi.lucene |
Analizator Lucene dla języka fińskiego. |
| fr.microsoft |
Microsoft Analyzer dla francuskiego. |
| fr.lucene |
Analizator Lucene dla języka francuskiego. |
| gl.lucene |
Analizator Lucene dla języka galicyjskiego. |
| de.microsoft |
Microsoft analizator dla niemieckiego. |
| de.lucene |
Analizator Lucene dla języka niemieckiego. |
| el.microsoft |
Microsoft analizator dla greki. |
| el.lucene |
Analizator Lucene dla języka greckiego. |
| gu.microsoft |
Microsoft analyzer for Gujarati. |
| he.microsoft |
Microsoft analizator dla hebrajskiego. |
| hi.microsoft |
Microsoft analizator dla języka hindi. |
| hi.lucene |
Lucene analyzer dla języka hindi. |
| hu.microsoft |
Microsoft analizator dla węgierskiego. |
| hu.lucene |
Analizator Lucene dla języka węgierskiego. |
| is.microsoft |
Microsoft analizator dla islandzkiego. |
| id.microsoft |
Microsoft analyzer for Indonesian (Bahasa). |
| id.lucene |
Analizator Lucene dla języka indonezyjskiego. |
| ga.lucene |
Analizator Lucene dla języka irlandzkiego. |
| it.microsoft |
Microsoft Analyzer dla włoskiego. |
| it.lucene |
Analizator Lucene dla języka włoskiego. |
| ja.microsoft |
Microsoft analizator dla języka japońskiego. |
| ja.lucene |
Analizator Lucene dla języka japońskiego. |
| kn.microsoft |
Microsoft analizator dla kannada. |
| ko.microsoft |
Microsoft analizator dla koreańskiego. |
| ko.lucene |
Analizator Lucene dla języka koreańskiego. |
| lv.microsoft |
Microsoft analizator dla łotewskiego. |
| lv.lucene |
Lucene analyzer dla języka łotewskiego. |
| lt.microsoft |
Microsoft analizator dla litewskiego. |
| ml.microsoft |
Microsoft analyzer dla malajalam. |
| ms.microsoft |
Microsoft analyzer for Malay (łacina). |
| mr.microsoft |
Microsoft analyzer for Marathi. |
| nb.microsoft |
Microsoft analyzer for Norwegian (Bokmål). |
| no.lucene |
Analizator Lucene dla języka norweskiego. |
| fa.lucene |
Analizator Lucene dla języka perskiego. |
| pl.microsoft |
Microsoft analizator dla języka polskiego. |
| pl.lucene |
Analizator Lucene dla języka polskiego. |
| pt-BR.microsoft |
Microsoft analyzer for Portuguese (Brazylia). |
| pt-BR.lucene |
Analizator Lucene dla języka portugalskiego (Brazylia). |
| pt-PT.microsoft |
Microsoft analyzer for Portuguese (Portugalia). |
| pt-PT.lucene |
Analizator Lucene dla języka portugalskiego (Portugalia). |
| pa.microsoft |
Microsoft analyzer for Punjabi. |
| ro.microsoft |
Microsoft analizator dla rumuńskiego. |
| ro.lucene |
Analizator Lucene dla języka rumuńskiego. |
| ru.microsoft |
Microsoft analizator dla rosyjskiego. |
| ru.lucene |
Analizator Lucene dla języka rosyjskiego. |
| sr-cyrillic.microsoft |
Microsoft analyzer for Serbian (cyrylica). |
| sr-latin.microsoft |
Microsoft analyzer for Serbian (Latin). |
| sk.microsoft |
Microsoft analyzer dla słowackiego. |
| sl.microsoft |
Microsoft analizator dla słoweńskiego. |
| es.microsoft |
Microsoft Analyzer dla języka hiszpańskiego. |
| es.lucene |
Analizator Lucene dla języka hiszpańskiego. |
| sv.microsoft |
Microsoft analizator dla szwedzkiego. |
| sv.lucene |
Analizator Lucene dla języka szwedzkiego. |
| ta.microsoft |
Microsoft analizator dla tamilskiego. |
| te.microsoft |
Microsoft analyzer for Telugu. |
| th.microsoft |
Microsoft analizator dla tajskich. |
| th.lucene |
Analizator Lucene dla języka tajskiego. |
| tr.microsoft |
Microsoft analizator dla tureckiego. |
| tr.lucene |
Analizator Lucene dla języka tureckiego. |
| uk.microsoft |
Microsoft analizator dla języka ukraińskiego. |
| ur.microsoft |
Microsoft analyzer for Urdu. |
| vi.microsoft |
Microsoft analyzer for Vietnamese. |
| standard.lucene |
Standardowy analizator Lucene. |
| standardasciifolding.lucene |
Standardowy analizator składany ASCII Lucene. Zobacz https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#Analyzers |
| keyword |
Traktuje całą zawartość pola jako pojedynczy token. Jest to przydatne w przypadku danych, takich jak kody pocztowe, identyfikatory i niektóre nazwy produktów. Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/KeywordAnalyzer.html |
| pattern |
Elastycznie oddziela tekst na terminy za pomocą wzorca wyrażenia regularnego. Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/PatternAnalyzer.html |
| simple |
Dzieli tekst w miejscach niebędących literami i konwertuje je na małe litery. Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/SimpleAnalyzer.html |
| stop |
Dzieli tekst na litery inne niż litery; Stosuje małe litery i filtry tokenu stopword. Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopAnalyzer.html |
| whitespace |
Analizator używający tokenizatora białych znaków. Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/WhitespaceAnalyzer.html |
LexicalNormalizerName
Definiuje nazwy wszystkich normalizatorów tekstu obsługiwanych przez wyszukiwarkę.
| Wartość | Opis |
|---|---|
| asciifolding |
Konwertuje znaki alfabetyczne, liczbowe i symboliczne Unicode, które nie znajdują się w pierwszych 127 znakach ASCII (bloku Unicode "Basic Latin") na ich odpowiedniki ASCII, jeśli takie odpowiedniki istnieją. Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ASCIIFoldingFilter.html |
| elision |
Usuwa elizji. Na przykład "l'avion" (płaszczyzna) zostanie przekonwertowana na "avion" (płaszczyzna). Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/util/ElisionFilter.html |
| lowercase |
Normalizuje tekst tokenu na małe litery. Zobacz https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/LowerCaseFilter.html |
| standard |
Standardowy normalizator, który składa się z małych liter i asciifoldingu. Zobacz http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/reverse/ReverseStringFilter.html |
| uppercase |
Normalizuje tekst tokenu do wielkich liter. Zobacz https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/UpperCaseFilter.html |
LexicalTokenizerName
Definiuje nazwy wszystkich tokenizatorów obsługiwanych przez wyszukiwarkę.
TokenFilterName
Definiuje nazwy wszystkich filtrów tokenów obsługiwanych przez wyszukiwarkę.