LexicalTokenizerName type
Meghatározza a keresőmotor által támogatott összes tokenizeres nevét.
<xref:KnownLexicalTokenizerName> a LexicalTokenizerName használatával felcserélhető, ez a szám tartalmazza a szolgáltatás által támogatott ismert értékeket.
A szolgáltatás által támogatott ismert értékek
klasszikus: Nyelvtanalapú tokenizer, amely alkalmas a legtöbb európai nyelvű dokumentum feldolgozására. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/ClassicTokenizer.html
edgeNGram: A megadott méret(ek) n-grammjára tokenizálja egy él bemenetét. Lásd: https://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/EdgeNGramTokenizer.html
keyword_v2: A teljes bemenetet egyetlen jogkivonatként bocsátja ki. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/KeywordTokenizer.html
betű: A szöveget nem betűkre osztja. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/LetterTokenizer.html
kisbetűs: A szöveget nem betűkre osztja, és kisbetűssé alakítja. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/LowerCaseTokenizer.html
microsoft_language_tokenizer: A szöveget nyelvspecifikus szabályokkal osztja el.
microsoft_language_stemming_tokenizer: Nyelvspecifikus szabályokkal osztja el a szöveget, és csökkenti a szavak alapformáit.
nGram: A megadott méret(ek) n-grammjába tokenizálja a bemenetet. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/NGramTokenizer.html
path_hierarchy_v2: Elérésiút-szerű hierarchiák tokenizerje. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/path/PathHierarchyTokenizer.html
minta: A regex mintaegyezést használó tokenizer különböző jogkivonatokat hoz létre. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/pattern/PatternTokenizer.html
standard_v2: Standard Lucene-elemző; A standard tokenizerből, kisbetűs szűrőből és stop szűrőből áll. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/StandardTokenizer.html
uax_url_email: Az URL-címeket és az e-maileket tokenizálja egy jogkivonatként. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/UAX29URLEmailTokenizer.html
üres tér: A szóközökben lévő szöveget osztja el. Lásd: http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/WhitespaceTokenizer.html
type LexicalTokenizerName = string