MicrosoftLanguageTokenizer interface

Nyelvspecifikus szabályokkal osztja el a szöveget.

Extends

Tulajdonságok

isSearchTokenizer

A tokenizer használatát jelző érték. Állítsa igaz értékre, ha keresési jogkivonat-képzőként használják, állítsa hamis értékre, ha indexelő jogkivonat-képzőként használják. Az alapértelmezett érték hamis.

language

A használni kívánt nyelv. Az alapértelmezett érték az angol.

maxTokenLength

A jogkivonat maximális hossza. A maximális hossznál hosszabb jogkivonatok fel vannak osztva. A használható jogkivonatok maximális hossza 300 karakter. A 300 karakternél hosszabb jogkivonatok először 300 hosszúságú jogkivonatokra lesznek felosztva, majd az egyes jogkivonatok felosztása a jogkivonatok maximális hossza alapján történik. Az alapértelmezett érték 255.

odatatype

A tokenizer típusát meghatározó URI-töredék.

Örökölt tulajdonságok

name

A tokenizer neve. Csak betűket, számjegyeket, szóközöket, kötőjeleket vagy aláhúzásjeleket tartalmazhat, csak alfanumerikus karakterekkel kezdődhet és végződhet, és legfeljebb 128 karakter hosszúságú lehet.

Tulajdonság adatai

isSearchTokenizer

A tokenizer használatát jelző érték. Állítsa igaz értékre, ha keresési jogkivonat-képzőként használják, állítsa hamis értékre, ha indexelő jogkivonat-képzőként használják. Az alapértelmezett érték hamis.

isSearchTokenizer?: boolean

Tulajdonság értéke

boolean

language

A használni kívánt nyelv. Az alapértelmezett érték az angol.

language?: MicrosoftTokenizerLanguage

Tulajdonság értéke

maxTokenLength

A jogkivonat maximális hossza. A maximális hossznál hosszabb jogkivonatok fel vannak osztva. A használható jogkivonatok maximális hossza 300 karakter. A 300 karakternél hosszabb jogkivonatok először 300 hosszúságú jogkivonatokra lesznek felosztva, majd az egyes jogkivonatok felosztása a jogkivonatok maximális hossza alapján történik. Az alapértelmezett érték 255.

maxTokenLength?: number

Tulajdonság értéke

number

odatatype

A tokenizer típusát meghatározó URI-töredék.

odatatype: "#Microsoft.Azure.Search.MicrosoftLanguageTokenizer"

Tulajdonság értéke

"#Microsoft.Azure.Search.MicrosoftLanguageTokenizer"

Örökölt tulajdonság részletei

name

A tokenizer neve. Csak betűket, számjegyeket, szóközöket, kötőjeleket vagy aláhúzásjeleket tartalmazhat, csak alfanumerikus karakterekkel kezdődhet és végződhet, és legfeljebb 128 karakter hosszúságú lehet.

name: string

Tulajdonság értéke

string

LexicalTokenizer.name-től örökölt