ClassicTokenizer interface
Nyelvtanalapú tokenizer, amely alkalmas a legtöbb európai nyelvű dokumentum feldolgozására. Ez a tokenizer az Apache Lucene használatával van implementálva.
- Extends
Tulajdonságok
| max |
A jogkivonat maximális hossza. Az alapértelmezett érték 255. A maximális hossznál hosszabb jogkivonatok fel vannak osztva. A maximálisan használható tokenhossz 300 karakter. |
| odatatype | A tokenizer típusát meghatározó URI-töredék. |
Örökölt tulajdonságok
| name | A tokenizer neve. Csak betűket, számjegyeket, szóközöket, kötőjeleket vagy aláhúzásjeleket tartalmazhat, csak alfanumerikus karakterekkel kezdődhet és végződhet, és legfeljebb 128 karakter hosszúságú lehet. |
Tulajdonság adatai
maxTokenLength
A jogkivonat maximális hossza. Az alapértelmezett érték 255. A maximális hossznál hosszabb jogkivonatok fel vannak osztva. A maximálisan használható tokenhossz 300 karakter.
maxTokenLength?: number
Tulajdonság értéke
number
odatatype
A tokenizer típusát meghatározó URI-töredék.
odatatype: "#Microsoft.Azure.Search.ClassicTokenizer"
Tulajdonság értéke
"#Microsoft.Azure.Search.ClassicTokenizer"