Indexes - Analyze

Bir çözümleyicinin metni belirteçlere nasıl ayırdığını gösterir.

POST {endpoint}/indexes('{indexName}')/search.analyze?api-version=2026-04-01

URI Parametreleri

Name İçinde Gerekli Tür Description
endpoint
path True

string (uri)

Arama hizmetinin uç nokta URL'si.

indexName
path True

string

Dizinin adı.

api-version
query True

string

minLength: 1

Bu işlem için kullanılacak API sürümü.

İstek Başlığı

Name Gerekli Tür Description
Accept

Accept

Kabul Et başlığı.

x-ms-client-request-id

string (uuid)

İstek için opak, genel olarak benzersiz, istemci tarafından oluşturulan bir dize tanımlayıcısı.

İstek Gövdesi

Name Gerekli Tür Description
text True

string

Belirteçlere bölünecek metin.

analyzer

LexicalAnalyzerName

Verilen metni kesmek için kullanılacak çözümleyicinin adı. Bu parametre belirtilmezse, bunun yerine bir belirteç oluşturucu belirtmeniz gerekir. Belirteç oluşturucu ve çözümleyici parametreleri birbirini dışlar.

charFilters

CharFilterName[]

Verilen metni kırarken kullanılacak isteğe bağlı karakter filtreleri listesi. Bu parametre yalnızca belirteç oluşturucu parametresi kullanılırken ayarlanabilir.

normalizer

LexicalNormalizerName

Verilen metni normalleştirmek için kullanılacak normalleştiricinin adı.

tokenFilters

TokenFilterName[]

Verilen metni kırarken kullanılacak isteğe bağlı belirteç filtreleri listesi. Bu parametre yalnızca belirteç oluşturucu parametresi kullanılırken ayarlanabilir.

tokenizer

LexicalTokenizerName

Verilen metni kesmek için kullanılacak belirteç oluşturucunun adı. Bu parametre belirtilmezse, bunun yerine bir çözümleyici belirtmeniz gerekir. Belirteç oluşturucu ve çözümleyici parametreleri birbirini dışlar.

Yanıtlar

Name Tür Description
200 OK

AnalyzeResult

İstek başarılı oldu.

Other Status Codes

ErrorResponse

Beklenmeyen bir hata yanıtı.

Güvenlik

api-key

Tür: apiKey
İçinde: header

OAuth2Auth

Tür: oauth2
Akış: implicit
Yetkilendirme URL’si: https://login.microsoftonline.com/common/oauth2/v2.0/authorize

Kapsamlar

Name Description
https://search.azure.com/.default

Örnekler

SearchServiceIndexAnalyze

Örnek isteği

POST https://exampleservice.search.windows.net/indexes('example-index')/search.analyze?api-version=2026-04-01


{
  "text": "Text to analyze",
  "analyzer": "ar.lucene"
}

Örnek yanıt

{
  "tokens": [
    {
      "token": "text",
      "startOffset": 0,
      "endOffset": 4,
      "position": 0
    },
    {
      "token": "to",
      "startOffset": 5,
      "endOffset": 7,
      "position": 1
    },
    {
      "token": "analyze",
      "startOffset": 8,
      "endOffset": 15,
      "position": 2
    }
  ]
}

Tanımlar

Name Description
Accept

Kabul Et başlığı.

AnalyzedTokenInfo

Çözümleyici tarafından döndürülen belirteç hakkındaki bilgiler.

AnalyzeRequest

Bu metni belirteçlere bölmek için kullanılan bazı metin ve çözümleme bileşenlerini belirtir.

AnalyzeResult

Bir çözümleyicinin metin üzerinde test edilmesi sonucu.

CharFilterName

Arama motoru tarafından desteklenen tüm karakter filtrelerinin adlarını tanımlar.

ErrorAdditionalInfo

Kaynak yönetimi hatası ek bilgileri.

ErrorDetail

Hata ayrıntısı.

ErrorResponse

Başarısız işlemlerin hata ayrıntılarını döndürmek için tüm Azure Resource Manager API'leri için genel hata yanıtı. (Bu, OData hata yanıt biçimini de izler.).

LexicalAnalyzerName

Arama motoru tarafından desteklenen tüm metin çözümleyicilerinin adlarını tanımlar.

LexicalNormalizerName

Arama motoru tarafından desteklenen tüm metin normalleştiricilerinin adlarını tanımlar.

LexicalTokenizerName

Arama motoru tarafından desteklenen tüm tokenizer'ların adlarını tanımlar.

TokenFilterName

Arama motoru tarafından desteklenen tüm belirteç filtrelerinin adlarını tanımlar.

Accept

Kabul Et başlığı.

Değer Description
application/json;odata.metadata=minimal

AnalyzedTokenInfo

Çözümleyici tarafından döndürülen belirteç hakkındaki bilgiler.

Name Tür Description
endOffset

integer (int32)

Giriş metnindeki belirtecin son karakterinin dizini.

position

integer (int32)

Giriş metnindeki belirtecin diğer belirteçlere göre konumu. Giriş metnindeki ilk belirtecin konumu 0, sonrakinin konumu 1 vb. olur. Kullanılan çözümleyiciye bağlı olarak, bazı belirteçler birbiriyle eş anlamlıysa, aynı konuma sahip olabilir.

startOffset

integer (int32)

Giriş metnindeki belirtecin ilk karakterinin dizini.

token

string

Çözümleyici tarafından döndürülen belirteç.

AnalyzeRequest

Bu metni belirteçlere bölmek için kullanılan bazı metin ve çözümleme bileşenlerini belirtir.

Name Tür Description
analyzer

LexicalAnalyzerName

Verilen metni kesmek için kullanılacak çözümleyicinin adı. Bu parametre belirtilmezse, bunun yerine bir belirteç oluşturucu belirtmeniz gerekir. Belirteç oluşturucu ve çözümleyici parametreleri birbirini dışlar.

charFilters

CharFilterName[]

Verilen metni kırarken kullanılacak isteğe bağlı karakter filtreleri listesi. Bu parametre yalnızca belirteç oluşturucu parametresi kullanılırken ayarlanabilir.

normalizer

LexicalNormalizerName

Verilen metni normalleştirmek için kullanılacak normalleştiricinin adı.

text

string

Belirteçlere bölünecek metin.

tokenFilters

TokenFilterName[]

Verilen metni kırarken kullanılacak isteğe bağlı belirteç filtreleri listesi. Bu parametre yalnızca belirteç oluşturucu parametresi kullanılırken ayarlanabilir.

tokenizer

LexicalTokenizerName

Verilen metni kesmek için kullanılacak belirteç oluşturucunun adı. Bu parametre belirtilmezse, bunun yerine bir çözümleyici belirtmeniz gerekir. Belirteç oluşturucu ve çözümleyici parametreleri birbirini dışlar.

AnalyzeResult

Bir çözümleyicinin metin üzerinde test edilmesi sonucu.

Name Tür Description
tokens

AnalyzedTokenInfo[]

İstekte belirtilen çözümleyici tarafından döndürülen belirteçlerin listesi.

CharFilterName

Arama motoru tarafından desteklenen tüm karakter filtrelerinin adlarını tanımlar.

Değer Description
html_strip

HTML yapılarını ayırmaya çalışan bir karakter filtresi. Bkz. https://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/charfilter/HTMLStripCharFilter.html

ErrorAdditionalInfo

Kaynak yönetimi hatası ek bilgileri.

Name Tür Description
info

Ek bilgiler.

type

string

Ek bilgi türü.

ErrorDetail

Hata ayrıntısı.

Name Tür Description
additionalInfo

ErrorAdditionalInfo[]

Hata ek bilgileri.

code

string

Hata kodu.

details

ErrorDetail[]

Hata ayrıntıları.

message

string

Hata iletisi.

target

string

Hata hedefi

ErrorResponse

Başarısız işlemlerin hata ayrıntılarını döndürmek için tüm Azure Resource Manager API'leri için genel hata yanıtı. (Bu, OData hata yanıt biçimini de izler.).

Name Tür Description
error

ErrorDetail

Hata nesnesi.

LexicalAnalyzerName

Arama motoru tarafından desteklenen tüm metin çözümleyicilerinin adlarını tanımlar.

Değer Description
ar.microsoft

Arapça için Microsoft analizörü.

ar.lucene

Arapça için Lucene analizörü.

hy.lucene

Ermenice için Lucene analizörü.

bn.microsoft

Bangla için Microsoft analizörü.

eu.lucene

Bask için Lucene analizörü.

bg.microsoft

Bulgarca için Microsoft analizörü.

bg.lucene

Bulgarca için Lucene analizörü.

ca.microsoft

Katalan için Microsoft analizörü.

ca.lucene

Katalanca için Lucene analizörü.

zh-Hans.microsoft

Çince için Microsoft analizörü (Basitleştirilmiş).

zh-Hans.lucene

Çince için Lucene analizörü (Basitleştirilmiş).

zh-Hant.microsoft

Çince için Microsoft analizörü (Geleneksel).

zh-Hant.lucene

Çince (Geleneksel) için Lucene analizörü.

hr.microsoft

Hırvatça için Microsoft analizörü.

cs.microsoft

Çekçe için Microsoft analizörü.

cs.lucene

Çekçe için Lucene analizörü.

da.microsoft

Dança için Microsoft analizörü.

da.lucene

Danca için Lucene analizörü.

nl.microsoft

Hollanda için Microsoft analizörü.

nl.lucene

Hollandaca için Lucene analizörü.

en.microsoft

İngilizce için Microsoft analizörü.

en.lucene

İngilizce için Lucene analizörü.

et.microsoft

Estonca için Microsoft analizörü.

fi.microsoft

Microsoft analizörü for Finnce.

fi.lucene

Fince için Lucene analizörü.

fr.microsoft

Fransızca için Microsoft analizörü.

fr.lucene

Fransızca için Lucene analizörü.

gl.lucene

Galiçyaca için Lucene analizörü.

de.microsoft

Almanca için Microsoft analizörü.

de.lucene

Almanca için Lucene analizörü.

el.microsoft

Yunanca için Microsoft analizörü.

el.lucene

Yunanca için Lucene analizörü.

gu.microsoft

Gujarati için Microsoft analizörü.

he.microsoft

İbranice için Microsoft analizörü.

hi.microsoft

Hintçe için Microsoft analizörü.

hi.lucene

Hintçe için Lucene analizörü.

hu.microsoft

Macarca için Microsoft analizörü.

hu.lucene

Macarca için Lucene analizörü.

is.microsoft

İzlanda için Microsoft analizörü.

id.microsoft

Endonezce (Bahasa) için Microsoft analizörü.

id.lucene

Endonezya için Lucene analizörü.

ga.lucene

İrlandalılar için Lucene analizörü.

it.microsoft

İtalyanca için Microsoft analizörü.

it.lucene

İtalyanca için Lucene analizörü.

ja.microsoft

Japonca için Microsoft analizörü.

ja.lucene

Japonca için Lucene analizörü.

kn.microsoft

Kannada için Microsoft analizörü.

ko.microsoft

Korece için Microsoft analizörü.

ko.lucene

Korece için Lucene analizörü.

lv.microsoft

Letonca için Microsoft analizörü.

lv.lucene

Letonca için Lucene analizörü.

lt.microsoft

Litvanca için Microsoft analizörü.

ml.microsoft

Malayalam için Microsoft analizörü.

ms.microsoft

Malay (Latince) için Microsoft analizörü.

mr.microsoft

Marathi için Microsoft analizörü.

nb.microsoft

Microsoft analyzer for Norwegian (Bokmål).

no.lucene

Norveççe için Lucene analizörü.

fa.lucene

Farsça için Lucene analizörü.

pl.microsoft

Polonya için Microsoft analizörü.

pl.lucene

Lehçe için Lucene analizörü.

pt-BR.microsoft

Portekizce için Microsoft analizörü (Brezilya).

pt-BR.lucene

Portekizce (Brezilya) için Lucene analizörü.

pt-PT.microsoft

Portekizce (Portekiz) için Microsoft analizörü.

pt-PT.lucene

Portekizce (Portekiz) için Lucene analizörü.

pa.microsoft

Pencapça için Microsoft analizörü.

ro.microsoft

Rumence için Microsoft analizörü.

ro.lucene

Romence için Lucene analizörü.

ru.microsoft

Rusça için Microsoft analizörü.

ru.lucene

Rusça için Lucene analizörü.

sr-cyrillic.microsoft

Sırbça için Microsoft analizörü (Kiril).

sr-latin.microsoft

Microsoft analizörü Sırpça (Latince) için.

sk.microsoft

Slovakça için Microsoft analizörü.

sl.microsoft

Slovence için Microsoft analizörü.

es.microsoft

İspanyolca için Microsoft analizörü.

es.lucene

İspanyolca için Lucene analizörü.

sv.microsoft

İsveççe için Microsoft analizörü.

sv.lucene

İsveççe için Lucene analizörü.

ta.microsoft

Tamil için Microsoft analizörü.

te.microsoft

Telugu için Microsoft analizörü.

th.microsoft

Tayca için Microsoft analizörü.

th.lucene

Tay dili için Lucene analizörü.

tr.microsoft

Microsoft analizörü için Türkçe.

tr.lucene

Türkçe için Lucene analizörü.

uk.microsoft

Ukraynaca için Microsoft analizörü.

ur.microsoft

Microsoft analizörü Urduca için.

vi.microsoft

Vietnamca için Microsoft analizörü.

standard.lucene

Standart Lucene analizörü.

standardasciifolding.lucene

Standart ASCII Katlanır Lucene analizörü. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#Analyzers

keyword

Bir alanın içeriğinin tamamını tek bir belirteç olarak ele alır. Bu, posta kodları, kimlikler ve bazı ürün adları gibi veriler için kullanışlıdır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/KeywordAnalyzer.html

pattern

Normal ifade deseni aracılığıyla metni esnek bir şekilde terimlere ayırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/PatternAnalyzer.html

simple

Metni harf olmayanlara böler ve küçük harfe dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/SimpleAnalyzer.html

stop

Metni harf olmayanlara böler; Küçük harf ve stopword belirteci filtrelerini uygular. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopAnalyzer.html

whitespace

Boşluk tokenizer'ı kullanan bir çözümleyici. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/WhitespaceAnalyzer.html

LexicalNormalizerName

Arama motoru tarafından desteklenen tüm metin normalleştiricilerinin adlarını tanımlar.

Değer Description
asciifolding

İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ASCIIFoldingFilter.html

elision

Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/util/ElisionFilter.html

lowercase

Belirteç metnini küçük harf olarak normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/LowerCaseFilter.html

standard

Küçük harf ve asciifolding'den oluşan standart normalleştirici. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/reverse/ReverseStringFilter.html

uppercase

Belirteç metnini büyük harf olarak normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/UpperCaseFilter.html

LexicalTokenizerName

Arama motoru tarafından desteklenen tüm tokenizer'ların adlarını tanımlar.

Değer Description
classic

Çoğu Avrupa dili belgesini işlemek için uygun olan dil bilgisi tabanlı belirteç oluşturucu. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/ClassicTokenizer.html

edgeNGram

Bir kenardan gelen girişi verilen boyutların n gramını belirteci haline getirmektedir. Bkz. https://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/EdgeNGramTokenizer.html

keyword_v2

Girişin tamamını tek bir belirteç olarak yayar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/KeywordTokenizer.html

letter

Metni harf olmayanlara böler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/LetterTokenizer.html

lowercase

Metni harf olmayanlara böler ve küçük harfe dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/LowerCaseTokenizer.html

microsoft_language_tokenizer

Dile özgü kuralları kullanarak metni böler.

microsoft_language_stemming_tokenizer

Dile özgü kuralları kullanarak metni böler ve sözcükleri temel formlarına küçültür.

nGram

Girişi verilen boyutların n gramını belirteci haline getirmektedir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/NGramTokenizer.html

path_hierarchy_v2

Yol benzeri hiyerarşiler için belirteç oluşturucu. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/path/PathHierarchyTokenizer.html

pattern

Farklı belirteçler oluşturmak için regex desen eşleştirmesi kullanan belirteç oluşturucu. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/pattern/PatternTokenizer.html

standard_v2

Standart Lucene çözümleyicisi; Standart belirteç oluşturucu, küçük harfli filtre ve durdurma filtresinden oluşur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/StandardTokenizer.html

uax_url_email

URL'ler ve e-postalar tek bir belirteç olacak şekilde işlenir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/UAX29URLEmailTokenizer.html

whitespace

Metni boşlukta böler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/WhitespaceTokenizer.html

TokenFilterName

Arama motoru tarafından desteklenen tüm belirteç filtrelerinin adlarını tanımlar.

Değer Description
arabic_normalization

Ortografiyi normalleştirmek için Arapça normalleştiriciyi uygulayan bir belirteç filtresi. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ar/ArabicNormalizationFilter.html

apostrophe

Kesme işaretinden sonraki tüm karakterleri (kesme işareti de dahil) siler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/tr/ApostropheFilter.html

asciifolding

İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ASCIIFoldingFilter.html

cjk_bigram

Standart belirteç oluşturucudan oluşturulan CJK terimlerinin büyük simgelerini oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/cjk/CJKBigramFilter.html

cjk_width

CJK genişlik farklarını normalleştirir. Tam genişlikteki ASCII varyantlarını eşdeğer temel Latinceye, yarım genişlikteki Katakana varyantlarını ise eşdeğer Kana'ya katlar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/cjk/CJKWidthFilter.html

classic

İngilizce sahiplik ve noktaları kısaltmalardan kaldırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/ClassicFilter.html

common_grams

Dizin oluştururken sık karşılaşılan terimler için bigrams oluşturun. Tek terimler de dizine eklenir ve ikili kelime birimleri üzerine yerleştirilir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/commongrams/CommonGramsFilter.html

edgeNGram_v2

Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/EdgeNGramTokenFilter.html

elision

Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/util/ElisionFilter.html

german_normalization

Almanca karakterleri, German2 kartopu algoritmasının buluşsal yöntemlerine göre normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/de/GermanNormalizationFilter.html

hindi_normalization

Yazım varyasyonlarındaki bazı farklılıkları kaldırmak için Hintçe metinleri normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/hi/HindiNormalizationFilter.html

indic_normalization

Hint dillerindeki metnin Unicode gösterimini normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/in/IndicNormalizationFilter.html

keyword_repeat

Gelen her belirteci bir kez anahtar sözcük, bir kez de anahtar sözcük olmayan olarak iki kez yayar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/KeywordRepeatFilter.html

kstem

İngilizce için yüksek performanslı kstem filtresi. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/en/KStemFilter.html

length

Çok uzun veya çok kısa sözcükleri kaldırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/LengthFilter.html

limit

Dizin oluşturma sırasında belirteç sayısını sınırlar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/LimitTokenCountFilter.html

lowercase

Belirteç metnini küçük harfe göre normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/LowerCaseFilter.html

nGram_v2

Verilen boyutların n gramını oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/NGramTokenFilter.html

persian_normalization

Farsça için normalleştirme uygular. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/fa/PersianNormalizationFilter.html

phonetic

Fonetik eşleşmeler için belirteçler oluşturun. Bkz. https://lucene.apache.org/core/4_10_3/analyzers-phonetic/org/apache/lucene/analysis/phonetic/package-tree.html

porter_stem

Belirteç akışını dönüştürmek için Porter kök oluşturma algoritmasını kullanır. Bkz. http://tartarus.org/~martin/PorterStemmer

reverse

Belirteç dizesini tersine çevirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/reverse/ReverseStringFilter.html

scandinavian_normalization

Değiştirilebilir İskandinav karakterlerinin kullanımını normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ScandinavianNormalizationFilter.html

scandinavian_folding

Folds İskandinav karakterler ååÃ... äææÃ"Æ->a ve öÖÜ̧Ü̃-o>. Ayrıca aa, ae, ao, oe ve oo çift sesli harf kullanımına karşı ayrımcılığa neden olur ve yalnızca ilkini bırakır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ScandinavianFoldingFilter.html

shingle

Belirteç birleşimlerini tek bir belirteç olarak oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/shingle/ShingleFilter.html

snowball

Snowball tarafından oluşturulan kök ayırıcı kullanarak sözcüklerin köklerini oluşturan bir filtre. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/snowball/SnowballFilter.html

sorani_normalization

Sorani metninin Unicode gösterimini normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ckb/SoraniNormalizationFilter.html

stemmer

Dile özgü gövde filtresi. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#TokenFilters

stopwords

Belirteç akışından duraklama sözcüklerini kaldırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopFilter.html

trim

Belirteçlerden öndeki ve sondaki boşlukları kırpılır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/TrimFilter.html

truncate

Terimleri belirli bir uzunlukta kısaltın. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/TruncateTokenFilter.html

unique

Önceki belirteçle aynı metindeki belirteçleri filtreler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/RemoveDuplicatesTokenFilter.html

uppercase

Belirteç metnini büyük harfe göre normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/UpperCaseFilter.html

word_delimiter

Sözcükleri alt sözcüklere böler ve alt sözcük gruplarında isteğe bağlı dönüştürmeler gerçekleştirir.