Indexes - Create
Yeni bir arama dizini oluşturur.
POST {endpoint}/indexes?api-version=2026-04-01
URI Parametreleri
| Name | İçinde | Gerekli | Tür | Description |
|---|---|---|---|---|
|
endpoint
|
path | True |
string (uri) |
Arama hizmetinin uç nokta URL'si. |
|
api-version
|
query | True |
string minLength: 1 |
Bu işlem için kullanılacak API sürümü. |
İstek Başlığı
| Name | Gerekli | Tür | Description |
|---|---|---|---|
| Accept |
Kabul Et başlığı. |
||
| x-ms-client-request-id |
string (uuid) |
İstek için opak, genel olarak benzersiz, istemci tarafından oluşturulan bir dize tanımlayıcısı. |
İstek Gövdesi
| Name | Gerekli | Tür | Description |
|---|---|---|---|
| fields | True |
Dizinin alanları. |
|
| name | True |
string |
Dizinin adı. |
| @odata.etag |
string |
Dizinin ETag'i. |
|
| analyzers | LexicalAnalyzer[]: |
Dizin için çözümleyiciler. |
|
| charFilters | CharFilter[]: |
Dizin için karakter filtreleri. |
|
| corsOptions |
Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçenekleri. |
||
| defaultScoringProfile |
string |
Sorguda belirtilmemişse kullanılacak puanlama profilinin adı. Bu özellik ayarlanmazsa ve sorguda puanlama profili belirtilmezse, varsayılan puanlama (tf-idf) kullanılır. |
|
| description |
string |
Dizinin açıklaması. |
|
| encryptionKey |
Azure Key Vault'ta oluşturduğunuz bir şifreleme anahtarının açıklaması. Bu anahtar, kimsenin, hatta Microsoft'un bile verilerinizi şifreleyemeyeceğine tam güvence vermek istediğinizde, verileriniz için ek bir şifreleme seviyesi sağlamak için kullanılır. Verilerinizi şifreledikten sonra her zaman şifrelenmiş olarak kalır. Arama hizmeti, bu özelliği null olarak ayarlama girişimlerini yoksayar. Şifreleme anahtarınızı döndürmek istiyorsanız bu özelliği gerektiği gibi değiştirebilirsiniz; Verileriniz etkilenmez. Müşteri tarafından yönetilen anahtarlarla şifreleme, ücretsiz arama hizmetlerinde kullanılamaz ve yalnızca 1 Ocak 2019 veya sonrasında oluşturulan ücretli hizmetler için kullanılabilir. |
||
| normalizers | LexicalNormalizer[]: |
Dizin için normalleştiriciler. |
|
| scoringProfiles |
Dizin için puanlama profilleri. |
||
| semantic |
Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar. |
||
| similarity | SimilarityAlgorithm: |
Arama sorgusuyla eşleşen belgeleri puanlama ve derecelendirme sırasında kullanılacak benzerlik algoritmasının türü. Benzerlik algoritması yalnızca dizin oluşturma zamanında tanımlanabilir ve mevcut dizinlerde değiştirilemez. Null ise ClassicSimilarity algoritması kullanılır. |
|
| suggesters |
Dizin için öneride bulunanlar. |
||
| tokenFilters |
TokenFilter[]:
|
Belirteç, dizin için filtreler. |
|
| tokenizers | LexicalTokenizer[]: |
Dizin için belirteç oluşturucular. |
|
| vectorSearch |
Vektör araması ile ilgili yapılandırma seçeneklerini içerir. |
Yanıtlar
| Name | Tür | Description |
|---|---|---|
| 201 Created |
İstek başarılı oldu ve sonuç olarak yeni bir kaynak oluşturuldu. |
|
| Other Status Codes |
Beklenmeyen bir hata yanıtı. |
Güvenlik
api-key
Tür:
apiKey
İçinde:
header
OAuth2Auth
Tür:
oauth2
Akış:
implicit
Yetkilendirme URL’si:
https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Kapsamlar
| Name | Description |
|---|---|
| https://search.azure.com/.default |
Örnekler
SearchServiceCreateIndex
Örnek isteği
POST https://exampleservice.search.windows.net/indexes?api-version=2026-04-01
{
"name": "temp-example-index",
"description": "description",
"fields": [
{
"name": "id",
"type": "Edm.String",
"key": true,
"sortable": true
},
{
"name": "vector1",
"type": "Collection(Edm.Single)",
"retrievable": true,
"searchable": true,
"dimensions": 20,
"vectorSearchProfile": "config1"
},
{
"name": "vector1b",
"type": "Collection(Edm.Single)",
"retrievable": true,
"searchable": true,
"dimensions": 10,
"vectorSearchProfile": "config2"
},
{
"name": "vector2",
"type": "Collection(Edm.Single)",
"retrievable": true,
"searchable": true,
"dimensions": 5,
"vectorSearchProfile": "config3"
},
{
"name": "vector3",
"type": "Collection(Edm.Single)",
"retrievable": true,
"searchable": true,
"dimensions": 5,
"vectorSearchProfile": "config3"
},
{
"name": "vector22",
"type": "Collection(Edm.Single)",
"retrievable": true,
"searchable": true,
"dimensions": 10,
"vectorSearchProfile": "config2"
},
{
"name": "vector4",
"type": "Collection(Edm.Single)",
"retrievable": true,
"searchable": true,
"dimensions": 32,
"vectorSearchProfile": "config4"
},
{
"name": "name",
"type": "Edm.String",
"retrievable": true,
"searchable": true,
"filterable": true,
"sortable": true,
"facetable": true,
"analyzer": "en.lucene"
},
{
"name": "description",
"type": "Edm.String",
"retrievable": true,
"searchable": true,
"filterable": true,
"sortable": true,
"facetable": true,
"analyzer": "standard.lucene"
},
{
"name": "category",
"type": "Edm.String",
"retrievable": true,
"searchable": true,
"filterable": true,
"sortable": true,
"facetable": true,
"analyzer": "en.lucene"
},
{
"name": "ownerId",
"type": "Edm.String",
"retrievable": true,
"searchable": true,
"filterable": true,
"sortable": true,
"facetable": true,
"analyzer": "en.lucene"
},
{
"name": "price",
"type": "Edm.Double",
"retrievable": true,
"filterable": true,
"sortable": true,
"facetable": true
}
],
"scoringProfiles": [
{
"name": "stringFieldBoost",
"text": {
"weights": {
"name": 3,
"description": 1,
"category": 2,
"ownerId": 1
}
},
"functions": [
{
"tag": {
"tagsParameter": "categoryTag"
},
"type": "tag",
"fieldName": "category",
"boost": 2
}
]
}
],
"defaultScoringProfile": "stringFieldBoost",
"corsOptions": {
"allowedOrigins": [
"https://www.example.com/foo"
],
"maxAgeInSeconds": 10
},
"suggesters": [
{
"name": "sg",
"searchMode": "analyzingInfixMatching",
"sourceFields": [
"category",
"ownerId"
]
}
],
"analyzers": [
{
"tokenizer": "standard_v2",
"tokenFilters": [
"common_grams"
],
"charFilters": [
"html_strip"
],
"@odata.type": "#Microsoft.Azure.Search.CustomAnalyzer",
"name": "tagsAnalyzer"
}
],
"tokenizers": [
{
"maxTokenLength": 100,
"@odata.type": "#Microsoft.Azure.Search.StandardTokenizerV2",
"name": "my_tokenizer"
}
],
"tokenFilters": [
{
"preserveOriginal": false,
"@odata.type": "#Microsoft.Azure.Search.AsciiFoldingTokenFilter",
"name": "my_tokenFilter"
}
],
"charFilters": [
{
"mappings": [
".=>,",
"_=>-"
],
"@odata.type": "#Microsoft.Azure.Search.MappingCharFilter",
"name": "my_mapping"
}
],
"normalizers": [
{
"tokenFilters": [
"my_tokenFilter"
],
"charFilters": [
"my_mapping"
],
"@odata.type": "#Microsoft.Azure.Search.CustomNormalizer",
"name": "my_normalizer"
}
],
"similarity": {
"k1": 10,
"b": 0.1,
"@odata.type": "#Microsoft.Azure.Search.BM25Similarity"
},
"semantic": {
"defaultConfiguration": "testconfig",
"configurations": [
{
"name": "testconfig",
"prioritizedFields": {
"titleField": {
"fieldName": "category"
},
"prioritizedContentFields": [
{
"fieldName": "description"
}
],
"prioritizedKeywordsFields": [
{
"fieldName": "ownerId"
}
]
},
"rankingOrder": "BoostedRerankerScore"
}
]
},
"vectorSearch": {
"profiles": [
{
"name": "config1",
"algorithm": "cosine",
"vectorizer": "openai",
"compression": "mySQ8"
},
{
"name": "config2",
"algorithm": "euclidean",
"vectorizer": "custom-web-api",
"compression": "mySQ8"
},
{
"name": "config3",
"algorithm": "dotProduct",
"vectorizer": "custom-web-api",
"compression": "myBQC"
},
{
"name": "config4",
"algorithm": "dotProduct",
"vectorizer": "custom-web-api",
"compression": "myBQWithoutOriginals"
}
],
"algorithms": [
{
"hnswParameters": {
"metric": "cosine"
},
"name": "cosine",
"kind": "hnsw"
},
{
"hnswParameters": {
"metric": "euclidean"
},
"name": "euclidean",
"kind": "hnsw"
},
{
"hnswParameters": {
"metric": "dotProduct"
},
"name": "dotProduct",
"kind": "hnsw"
}
],
"vectorizers": [
{
"azureOpenAIParameters": {
"resourceUri": "https://test-sample.openai.azure.com/",
"deploymentId": "model",
"apiKey": "api-key",
"modelName": "text-embedding-3-large"
},
"name": "openai",
"kind": "azureOpenAI"
},
{
"customWebApiParameters": {
"uri": "https://my-custom-endpoint.org/",
"httpHeaders": {
"header1": "value1",
"header2": "value2"
},
"httpMethod": "POST",
"timeout": "PT1M",
"authResourceId": "api://f89d1c93-58a7-4b07-9a5b-5f89048b927b",
"authIdentity": {
"@odata.type": "#Microsoft.Azure.Search.DataNoneIdentity"
}
},
"name": "custom-web-api",
"kind": "customWebApi"
},
{
"amlParameters": {
"uri": "https://my-custom-endpoint.org/",
"resourceId": "aml resource id",
"timeout": "PT1M",
"region": "aml region",
"modelName": "OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32"
},
"name": "aml",
"kind": "aml"
},
{
"amlParameters": {
"uri": "https://my-custom-endpoint.org/",
"resourceId": "aml resource id",
"timeout": "PT1M",
"region": "aml region",
"modelName": "Cohere-embed-v4"
},
"name": "aml-cohere",
"kind": "aml"
}
],
"compressions": [
{
"scalarQuantizationParameters": {
"quantizedDataType": "int8"
},
"name": "mySQ8",
"kind": "scalarQuantization",
"rescoringOptions": {
"enableRescoring": true,
"defaultOversampling": 10,
"rescoreStorageMethod": "preserveOriginals"
},
"truncationDimension": 2
},
{
"name": "myBQC",
"kind": "binaryQuantization",
"rescoringOptions": {
"enableRescoring": true,
"defaultOversampling": 10,
"rescoreStorageMethod": "preserveOriginals"
},
"truncationDimension": 2
},
{
"name": "myBQWithoutOriginals",
"kind": "binaryQuantization",
"rescoringOptions": {
"enableRescoring": true,
"defaultOversampling": 10,
"rescoreStorageMethod": "discardOriginals"
},
"truncationDimension": 2
}
]
},
"@odata.etag": "0x1234568AE7E58A1"
}
Örnek yanıt
{
"@odata.etag": "0x1234568AE7E58A1",
"name": "temp-example-index",
"description": "description",
"defaultScoringProfile": "stringFieldBoost",
"fields": [
{
"name": "id",
"type": "Edm.String",
"searchable": true,
"filterable": true,
"retrievable": true,
"stored": true,
"sortable": true,
"facetable": true,
"key": true,
"synonymMaps": []
},
{
"name": "vector1",
"type": "Collection(Edm.Single)",
"searchable": true,
"filterable": false,
"retrievable": true,
"stored": true,
"sortable": false,
"facetable": false,
"key": false,
"dimensions": 20,
"vectorSearchProfile": "config1",
"synonymMaps": []
},
{
"name": "vector1b",
"type": "Collection(Edm.Single)",
"searchable": true,
"filterable": false,
"retrievable": true,
"stored": true,
"sortable": false,
"facetable": false,
"key": false,
"dimensions": 10,
"vectorSearchProfile": "config2",
"synonymMaps": []
},
{
"name": "vector2",
"type": "Collection(Edm.Single)",
"searchable": true,
"filterable": false,
"retrievable": true,
"stored": true,
"sortable": false,
"facetable": false,
"key": false,
"dimensions": 5,
"vectorSearchProfile": "config3",
"synonymMaps": []
},
{
"name": "vector3",
"type": "Collection(Edm.Single)",
"searchable": true,
"filterable": false,
"retrievable": true,
"stored": true,
"sortable": false,
"facetable": false,
"key": false,
"dimensions": 5,
"vectorSearchProfile": "config3",
"synonymMaps": []
},
{
"name": "vector22",
"type": "Collection(Edm.Single)",
"searchable": true,
"filterable": false,
"retrievable": true,
"stored": true,
"sortable": false,
"facetable": false,
"key": false,
"dimensions": 10,
"vectorSearchProfile": "config2",
"synonymMaps": []
},
{
"name": "vector4",
"type": "Collection(Edm.Single)",
"searchable": true,
"filterable": false,
"retrievable": true,
"stored": true,
"sortable": false,
"facetable": false,
"key": false,
"dimensions": 32,
"vectorSearchProfile": "config4",
"synonymMaps": []
},
{
"name": "name",
"type": "Edm.String",
"searchable": true,
"filterable": true,
"retrievable": true,
"stored": true,
"sortable": true,
"facetable": true,
"key": false,
"analyzer": "en.lucene",
"synonymMaps": []
},
{
"name": "description",
"type": "Edm.String",
"searchable": true,
"filterable": true,
"retrievable": true,
"stored": true,
"sortable": true,
"facetable": true,
"key": false,
"analyzer": "standard.lucene",
"synonymMaps": []
},
{
"name": "category",
"type": "Edm.String",
"searchable": true,
"filterable": true,
"retrievable": true,
"stored": true,
"sortable": true,
"facetable": true,
"key": false,
"analyzer": "en.lucene",
"synonymMaps": []
},
{
"name": "ownerId",
"type": "Edm.String",
"searchable": true,
"filterable": true,
"retrievable": true,
"stored": true,
"sortable": true,
"facetable": true,
"key": false,
"analyzer": "en.lucene",
"synonymMaps": []
},
{
"name": "price",
"type": "Edm.Double",
"searchable": false,
"filterable": true,
"retrievable": true,
"stored": true,
"sortable": true,
"facetable": true,
"key": false,
"synonymMaps": []
}
],
"scoringProfiles": [
{
"name": "stringFieldBoost",
"functionAggregation": "sum",
"text": {
"weights": {
"name": 3,
"description": 1,
"category": 2,
"ownerId": 1
}
},
"functions": [
{
"fieldName": "category",
"interpolation": "linear",
"type": "tag",
"boost": 2,
"tag": {
"tagsParameter": "categoryTag"
}
}
]
}
],
"corsOptions": {
"allowedOrigins": [
"https://www.example.com/foo"
],
"maxAgeInSeconds": 10
},
"suggesters": [
{
"name": "sg",
"searchMode": "analyzingInfixMatching",
"sourceFields": [
"category",
"ownerId"
]
}
],
"analyzers": [
{
"@odata.type": "#Microsoft.Azure.Search.CustomAnalyzer",
"name": "tagsAnalyzer",
"tokenizer": "standard_v2",
"tokenFilters": [
"common_grams"
],
"charFilters": [
"html_strip"
]
}
],
"normalizers": [
{
"@odata.type": "#Microsoft.Azure.Search.CustomNormalizer",
"name": "my_normalizer",
"tokenFilters": [
"my_tokenFilter"
],
"charFilters": [
"my_mapping"
]
}
],
"tokenizers": [
{
"@odata.type": "#Microsoft.Azure.Search.StandardTokenizerV2",
"name": "my_tokenizer",
"maxTokenLength": 100
}
],
"tokenFilters": [
{
"@odata.type": "#Microsoft.Azure.Search.AsciiFoldingTokenFilter",
"name": "my_tokenFilter",
"preserveOriginal": false
}
],
"charFilters": [
{
"@odata.type": "#Microsoft.Azure.Search.MappingCharFilter",
"name": "my_mapping",
"mappings": [
".=>,",
"_=>-"
]
}
],
"similarity": {
"@odata.type": "#Microsoft.Azure.Search.BM25Similarity",
"k1": 10,
"b": 0.1
},
"semantic": {
"defaultConfiguration": "testconfig",
"configurations": [
{
"name": "testconfig",
"rankingOrder": "BoostedRerankerScore",
"prioritizedFields": {
"titleField": {
"fieldName": "category"
},
"prioritizedContentFields": [
{
"fieldName": "description"
}
],
"prioritizedKeywordsFields": [
{
"fieldName": "ownerId"
}
]
}
}
]
},
"vectorSearch": {
"algorithms": [
{
"name": "cosine",
"kind": "hnsw",
"hnswParameters": {
"metric": "cosine",
"m": 4,
"efConstruction": 400,
"efSearch": 500
}
},
{
"name": "euclidean",
"kind": "hnsw",
"hnswParameters": {
"metric": "euclidean",
"m": 4,
"efConstruction": 400,
"efSearch": 500
}
},
{
"name": "dotProduct",
"kind": "hnsw",
"hnswParameters": {
"metric": "dotProduct",
"m": 4,
"efConstruction": 400,
"efSearch": 500
}
}
],
"profiles": [
{
"name": "config1",
"algorithm": "cosine",
"vectorizer": "openai",
"compression": "mySQ8"
},
{
"name": "config2",
"algorithm": "euclidean",
"vectorizer": "custom-web-api",
"compression": "mySQ8"
},
{
"name": "config3",
"algorithm": "dotProduct",
"vectorizer": "custom-web-api",
"compression": "myBQC"
},
{
"name": "config4",
"algorithm": "dotProduct",
"vectorizer": "custom-web-api",
"compression": "myBQWithoutOriginals"
}
],
"vectorizers": [
{
"name": "openai",
"kind": "azureOpenAI",
"azureOpenAIParameters": {
"resourceUri": "https://test-sample.openai.azure.com",
"deploymentId": "model",
"apiKey": "api-key",
"modelName": "text-embedding-3-large"
}
},
{
"name": "custom-web-api",
"kind": "customWebApi",
"customWebApiParameters": {
"httpMethod": "POST",
"uri": "https://my-custom-endpoint.org/",
"timeout": "PT1M",
"authResourceId": "api://f89d1c93-58a7-4b07-9a5b-5f89048b927b",
"httpHeaders": {
"header1": "value1",
"header2": "value2"
},
"authIdentity": {
"@odata.type": "#Microsoft.Azure.Search.DataNoneIdentity"
}
}
},
{
"name": "aml",
"kind": "aml",
"amlParameters": {
"resourceId": "aml resource id",
"region": "aml region",
"uri": "https://my-custom-endpoint.org/",
"timeout": "PT1M",
"modelName": "OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32"
}
},
{
"name": "aml-cohere",
"kind": "aml",
"amlParameters": {
"resourceId": "aml resource id",
"region": "aml region",
"uri": "https://my-custom-endpoint.org/",
"timeout": "PT1M",
"modelName": "Cohere-embed-v4"
}
}
],
"compressions": [
{
"name": "mySQ8",
"kind": "scalarQuantization",
"truncationDimension": 2,
"scalarQuantizationParameters": {
"quantizedDataType": "int8"
},
"rescoringOptions": {
"enableRescoring": true,
"defaultOversampling": 10,
"rescoreStorageMethod": "preserveOriginals"
}
},
{
"name": "myBQC",
"kind": "binaryQuantization",
"truncationDimension": 2,
"rescoringOptions": {
"enableRescoring": true,
"defaultOversampling": 10,
"rescoreStorageMethod": "preserveOriginals"
}
},
{
"name": "myBQWithoutOriginals",
"kind": "binaryQuantization",
"truncationDimension": 2,
"rescoringOptions": {
"enableRescoring": true,
"defaultOversampling": 10,
"rescoreStorageMethod": "discardOriginals"
}
}
]
}
}
Tanımlar
| Name | Description |
|---|---|
| Accept |
Kabul Et başlığı. |
|
AIFoundry |
Azure Yapay Zeka Atölyesi Kataloğu'ndan yerleştirilecek gömüleme modelinin adı. |
| AMLParameters |
AML vektörleştiricisine bağlanma özelliklerini belirtir. |
| AMLVectorizer |
Azure Yapay Zeka Atölyesi Model Kataloğu üzerinden bir sorgu dizesinin vektör gömülmesini oluşturmak için dağıtılan bir Azure Machine Learning uç noktası belirtir. |
|
Ascii |
İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Azure |
Çağrılacak Azure Open AI model adı. |
|
Azure |
Bir sorgu dizesini vektörleştirmek için kullanılan Azure OpenAI kaynağını belirtir. |
|
Azure |
Azure OpenAI kaynağına bağlanmak için parametreleri belirtir. |
|
Binary |
Dizin oluşturma ve sorgulama sırasında kullanılan ikili niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir. |
|
BM25Similarity |
Okapi BM25 benzerlik algoritmasını temel alan derecelendirme işlevi. BM25, uzunluk normalleştirmesi ('b' parametresi tarafından denetlenen) ve terim sıklığı doygunluğu ('k1' parametresiyle denetlenen) içeren TF-IDF benzeri bir algoritmadır. |
|
Char |
Arama motoru tarafından desteklenen tüm karakter filtrelerinin adlarını tanımlar. |
|
Cjk |
Standart belirteç oluşturucudan oluşturulan CJK terimlerinin büyük simgelerini oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Cjk |
CjkBigramTokenFilter tarafından yoksayılabilen betikler. |
|
Classic |
TF-IDF'nin Lucene TFIDFSimilarity uygulamasını kullanan eski benzerlik algoritması. bu TF-IDF varyasyonu, statik belge uzunluğu normalleştirmesini ve arama yapılan sorgularla yalnızca kısmen eşleşen belgeleri cezalandıran faktörleri koordine eder. |
|
Classic |
Çoğu Avrupa dili belgesini işlemek için uygun olan dil bilgisi tabanlı belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Common |
Dizin oluştururken sık karşılaşılan terimler için bigrams oluşturun. Tek terimler de dizine eklenir ve ikili kelime birimleri üzerine yerleştirilir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Cors |
Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçeneklerini tanımlar. |
|
Custom |
Metni dizine alınabilen/aranabilir belirteçlere dönüştürme işlemi üzerinde denetim sahibi olmanıza olanak tanır. Önceden tanımlanmış tek bir belirteç oluşturucu ve bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır. Belirteç oluşturucu, metinleri belirteçlere bölmek ve belirteç oluşturucu tarafından yayılan belirteçleri değiştirmek için filtrelerden sorumludur. |
|
Custom |
Filtrelenebilir, sıralanabilir ve modellenebilir alanlar için normalleştirmeyi yapılandırmanıza olanak tanır ve bu alanlar varsayılan olarak katı eşleştirmeyle çalışır. Bu, depolanan belirteci değiştiren en az bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır. |
|
Dictionary |
Birçok Almanca dilinde bulunan bileşik sözcükleri ayrıştırıyor. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Distance |
Coğrafi konumdan uzaklığı temel alarak puanları artıran bir işlev tanımlar. |
|
Distance |
Uzaklık puanlama işlevine parametre değerleri sağlar. |
|
Edge |
Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Edge |
Bir n-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir. |
|
Edge |
Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Edge |
Bir kenardan gelen girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Elision |
Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Error |
Kaynak yönetimi hatası ek bilgileri. |
|
Error |
Hata ayrıntısı. |
|
Error |
Başarısız işlemlerin hata ayrıntılarını döndürmek için tüm Azure Resource Manager API'leri için genel hata yanıtı. (Bu, OData hata yanıt biçimini de izler.). |
|
Exhaustive |
Sorgulama sırasında kullanılan kapsamlı KNN algoritmasına özgü yapılandırma seçeneklerini içerir ve bu seçenek vektör dizininin tamamında deneme yanılma araması gerçekleştirir. |
|
Exhaustive |
Kapsamlı KNN algoritmasına özgü parametreleri içerir. |
|
Freshness |
Bir tarih-saat alanının değerine göre puanları artıran bir işlev tanımlar. |
|
Freshness |
Bir güncellik puanlama işlevine parametre değerleri sağlar. |
|
Hnsw |
Dizin oluşturma ve sorgulama sırasında kullanılan HNSW yaklaşık en yakın komşular algoritmasına özgü yapılandırma seçeneklerini içerir. HNSW algoritması, arama hızı ve doğruluğu arasında ayarlanabilir bir denge sunar. |
|
Hnsw |
HNSW algoritmasına özgü parametreleri içerir. |
|
Keep |
Belirteçleri yalnızca belirtilen sözcük listesinde yer alan metinle tutan bir belirteç filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Keyword |
Terimleri anahtar sözcük olarak işaretler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Keyword |
Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Keyword |
Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Length |
Çok uzun veya çok kısa sözcükleri kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Lexical |
Arama motoru tarafından desteklenen tüm metin çözümleyicilerinin adlarını tanımlar. |
|
Lexical |
Arama motoru tarafından desteklenen tüm metin normalleştiricilerinin adlarını tanımlar. |
|
Lexical |
Arama motoru tarafından desteklenen tüm tokenizer'ların adlarını tanımlar. |
|
Limit |
Dizin oluşturma sırasında belirteç sayısını sınırlar. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Lucene |
Standart Apache Lucene çözümleyicisi; Standart belirteç oluşturucu, küçük harfli filtre ve durdurma filtresinden oluşur. |
|
Lucene |
Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Lucene |
Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Magnitude |
Sayısal alanın büyüklüğüne göre puanları artıran bir işlev tanımlar. |
|
Magnitude |
Bir büyük puanlama işlevine parametre değerleri sağlar. |
|
Mapping |
Eşlemeler seçeneğiyle tanımlanan eşlemeleri uygulayan karakter filtresi. Eşleştirme açgözlüdür (verilen bir noktada en uzun desen eşleştirmesi kazanır). Değiştirmenin boş dize olması için izin verilir. Bu karakter filtresi Apache Lucene kullanılarak uygulanır. |
|
Microsoft |
Dile özgü kuralları kullanarak metni böler ve sözcükleri temel formlarına küçültür. |
|
Microsoft |
Dile özgü kuralları kullanarak metni böler. |
|
Microsoft |
Tokenizer'den gelen Microsoft dilinin desteklediği dilleri listeler. |
|
Microsoft |
Microsoft dil tokenizer'ı tarafından desteklenen dilleri listeler. |
|
NGram |
Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
NGram |
Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
NGram |
Girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Path |
Yol benzeri hiyerarşiler için belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Pattern |
Normal ifade deseni aracılığıyla metni esnek bir şekilde terimlere ayırır. Bu çözümleyici Apache Lucene kullanılarak uygulanır. |
|
Pattern |
Bir veya daha fazla desendeki her yakalama grubu için bir tane olmak üzere birden çok belirteç yaymak için Java regexes kullanır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Pattern |
Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu karakter filtresi Apache Lucene kullanılarak uygulanır. |
|
Pattern |
Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Pattern |
Farklı belirteçler oluşturmak için regex desen eşleştirmesi kullanan belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Phonetic |
PhoneticTokenFilter ile kullanılacak fonetik kodlayıcı türünü tanımlar. |
|
Phonetic |
Fonetik eşleşmeler için belirteçler oluşturun. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Ranking |
Belgelerin sıralama düzeni için kullanılacak puanı temsil eder. |
|
Rescoring |
Yeniden puanlama seçeneklerini içerir. |
|
Scalar |
Dizin oluşturma ve sorgulama sırasında kullanılan skaler niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir. |
|
Scalar |
Skaler Niceleme'ye özgü parametreleri içerir. |
|
Scoring |
Bir puanlama profilindeki tüm puanlama işlevlerinin sonuçlarını birleştirmek için kullanılan toplama işlevini tanımlar. |
|
Scoring |
Bir dizi belgede puan artırmayı enterpolasyon yapmak için kullanılan işlevi tanımlar. |
|
Scoring |
Arama sorgularında puanlama işlemini etkileyen bir arama dizininin parametrelerini tanımlar. |
|
Search |
Bir alanın adını, veri türünü ve arama davranışını açıklayan dizin tanımındaki bir alanı temsil eder. |
|
Search |
Arama dizinindeki bir alanın veri türünü tanımlar. |
|
Search |
Bir dizinin alanlarını ve arama davranışını açıklayan bir arama dizini tanımını temsil eder. |
|
Search |
Veri kaynağının kimlik özelliğini temizler. |
|
Search |
Kullanılacak veri kaynağının kimliğini belirtir. |
|
Search |
Azure Key Vault'ta müşteri tarafından yönetilen bir şifreleme anahtarı. Oluşturduğunuz ve yönettiğiniz anahtarlar, dizinler ve eş anlamlı eşlemeler gibi bekleyen verileri şifrelemek veya şifresini çözmek için kullanılabilir. |
|
Search |
Öneri API'sinin dizindeki bir alan grubuna nasıl uygulanacağını tanımlar. |
|
Semantic |
Anlamsal özellikler bağlamında kullanılacak belirli bir yapılandırmayı tanımlar. |
|
Semantic |
Anlamsal yapılandırmanın bir parçası olarak kullanılan alan. |
|
Semantic |
Anlam derecelendirmesi, açıklamalı alt yazılar, vurgular ve yanıtlar için kullanılacak başlık, içerik ve anahtar sözcük alanlarını açıklar. |
|
Semantic |
Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar. |
|
Shingle |
Belirteç birleşimlerini tek bir belirteç olarak oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Snowball |
Snowball tarafından oluşturulan kök ayırıcı kullanarak sözcüklerin köklerini oluşturan bir filtre. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Snowball |
Snowball belirteç filtresi için kullanılacak dil. |
|
Stemmer |
Özel sözlük tabanlı kök oluşturma ile diğer kök filtreleme filtrelerini geçersiz kılma olanağı sağlar. Sözlük köküne sahip terimler anahtar sözcük olarak işaretlenir, böylece zincirdeki kök ayırıcılarla kaynaklanmaz. Herhangi bir köklendirme filtresinin önüne yerleştirilmelidir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/StemmerOverrideFilter.html |
|
Stemmer |
Dile özgü gövde filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#TokenFilters |
|
Stemmer |
Stemmer belirteç filtresi için kullanılacak dil. |
|
Stop |
Metni harf olmayanlara böler; Küçük harf ve stopword belirteci filtrelerini uygular. Bu çözümleyici Apache Lucene kullanılarak uygulanır. |
|
Stopwords |
Dile özgü durdurma sözcüklerinin önceden tanımlanmış bir listesini tanımlar. |
|
Stopwords |
Belirteç akışından duraklama sözcüklerini kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopFilter.html |
|
Synonym |
Belirteç akışındaki tek veya çok sözcüklü eş anlamlılarla eşleşir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Tag |
Belirli bir etiket listesiyle eşleşen dize değerleriyle belge puanlarını artıran bir işlev tanımlar. |
|
Tag |
Etiket puanlama işlevine parametre değerleri sağlar. |
|
Text |
Eşleşmelerin arama sorgularında puanlamanın artırılması gereken dizin alanlarında ağırlıkları tanımlar. |
|
Token |
Belirteç filtresinin üzerinde çalışabileceği karakter sınıflarını temsil eder. |
|
Token |
Arama motoru tarafından desteklenen tüm belirteç filtrelerinin adlarını tanımlar. |
|
Truncate |
Terimleri belirli bir uzunlukta kısaltın. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Uax |
URL'ler ve e-postalar tek bir belirteç olacak şekilde işlenir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır. |
|
Unique |
Önceki belirteçle aynı metindeki belirteçleri filtreler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
|
Vector |
Vektör alanı içeriklerini yorumlamak için kodlama biçimi. |
|
Vector |
Vektör araması ile ilgili yapılandırma seçeneklerini içerir. |
|
Vector |
Dizin oluşturma ve sorgulama için kullanılan algoritma. |
|
Vector |
Vektör karşılaştırmaları için kullanılacak benzerlik metriği. Ekleme modelinin eğitildiği benzerlik metriğinin seçilmesi önerilir. |
|
Vector |
Dizin oluşturma ve sorgulama için kullanılan sıkıştırma yöntemi. |
|
Vector |
Sıkıştırılmış vektör değerlerinin nicelleştirilmiş veri türü. |
|
Vector |
Vektör araması ile kullanılacak yapılandırmaların bir bileşimini tanımlar. |
|
Vector |
Sorgu sırasında kullanılacak vektörleştirme yöntemi. |
|
Web |
Bir sorgu dizesinin vektör eklemesini oluşturmak için kullanıcı tanımlı bir vektörleştirici belirtir. Bir beceri kümesinin özel Web API arabirimi kullanılarak dış vektörleştiricinin tümleştirilmesi sağlanır. |
|
Web |
Kullanıcı tanımlı vektörleştiriciye bağlanma özelliklerini belirtir. |
|
Word |
Sözcükleri alt sözcüklere böler ve alt sözcük gruplarında isteğe bağlı dönüştürmeler gerçekleştirir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. |
Accept
Kabul Et başlığı.
| Değer | Description |
|---|---|
| application/json;odata.metadata=minimal |
AIFoundryModelCatalogName
Azure Yapay Zeka Atölyesi Kataloğu'ndan yerleştirilecek gömüleme modelinin adı.
| Değer | Description |
|---|---|
| OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32 |
OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32 |
| OpenAI-CLIP-Image-Text-Embeddings-ViT-Large-Patch14-336 |
OpenAI-CLIP-Image-Text-Embeddings-ViT-Large-Patch14-336 |
| Facebook-DinoV2-Image-Embeddings-ViT-Base |
Facebook-DinoV2-Image-Embeddings-ViT-Base |
| Facebook-DinoV2-Image-Embeddings-ViT-Giant |
Facebook DinoV2 Görüntü Gömülüleri -ViT-Giant |
| Cohere-embed-v3-english |
Cohere-embed-v3-english |
| Cohere-embed-v3-multilingual |
Cohere-embed-v3-multilingual |
| Cohere-embed-v4 |
Hem metinden hem de görüntülerden gömmeler oluşturmak için Cohere gömme v4 modeli. |
AMLParameters
AML vektörleştiricisine bağlanma özelliklerini belirtir.
| Name | Tür | Description |
|---|---|---|
| key |
string |
(Anahtar kimlik doğrulaması için gereklidir) AML hizmetinin anahtarı. |
| modelName |
Sağlanan uç noktada dağıtılan Azure Yapay Zeka Atölyesi Kataloğu'ndan gömülü modelin adı. |
|
| region |
string |
(Belirteç kimlik doğrulaması için isteğe bağlı). AML hizmetinin dağıtılacağı bölge. |
| resourceId |
string |
(Belirteç kimlik doğrulaması için gereklidir). AML servisinin Azure Resource Manager resource ID'si. Formatında subscriptions/{guid}/resourceGroups/{resource-group-name}/Microsoft olmalı. MachineLearningServices/workspaces/{workspace-name}/services/{service_name}. |
| timeout |
string (duration) |
(İsteğe bağlı) Belirtildiğinde, API çağrısı yapan http istemcisinin zaman aşımını gösterir. |
| uri |
string (uri) |
(Kimlik doğrulaması veya anahtar kimlik doğrulaması olmaması için gereklidir) JSON yükünün gönderileceği AML hizmetinin puanlama URI'si. Yalnızca https URI düzenine izin verilir. |
AMLVectorizer
Azure Yapay Zeka Atölyesi Model Kataloğu üzerinden bir sorgu dizesinin vektör gömülmesini oluşturmak için dağıtılan bir Azure Machine Learning uç noktası belirtir.
| Name | Tür | Description |
|---|---|---|
| amlParameters |
AML vektörleştiricisinin özelliklerini belirtir. |
|
| kind |
string:
aml |
VectorSearchVectorizer türü. |
| name |
string |
Bu özel vektörleştirme yöntemiyle ilişkilendirilecek ad. |
AsciiFoldingTokenFilter
İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| preserveOriginal |
boolean |
False |
Özgün belirtecin tutulup tutulmayacağını belirten bir değer. Varsayılan değer false'tur. |
AzureOpenAIModelName
Çağrılacak Azure Open AI model adı.
| Değer | Description |
|---|---|
| text-embedding-ada-002 |
TextEmbeddingAda002 modeli. |
| text-embedding-3-large |
TextEmbedding3Large modeli. |
| text-embedding-3-small |
TextEmbedding3Small modeli. |
| gpt-5-mini |
Gpt5Mini modeli. |
| gpt-5-nano |
Gpt5Nano modeli. |
| gpt-5.4-mini |
Gpt54Mini modeli. |
| gpt-5.4-nano |
Gpt54Nano modeli. |
AzureOpenAIVectorizer
Bir sorgu dizesini vektörleştirmek için kullanılan Azure OpenAI kaynağını belirtir.
| Name | Tür | Description |
|---|---|---|
| azureOpenAIParameters |
Azure OpenAI katıştırma vektörleştirmesine özgü parametreleri içerir. |
|
| kind |
string:
azure |
VectorSearchVectorizer türü. |
| name |
string |
Bu özel vektörleştirme yöntemiyle ilişkilendirilecek ad. |
AzureOpenAIVectorizerParameters
Azure OpenAI kaynağına bağlanmak için parametreleri belirtir.
| Name | Tür | Description |
|---|---|---|
| apiKey |
string |
Belirlenen Azure OpenAI kaynağının API anahtarı. |
| authIdentity | SearchIndexerDataIdentity: |
Giden bağlantılar için kullanılan kullanıcı tarafından atanan yönetilen kimlik. |
| deploymentId |
string |
Belirlenen kaynakta Azure OpenAI modeli dağıtımının kimliği. |
| modelName |
Sağlanan deploymentId yolunda dağıtılan ekleme modelinin adı. |
|
| resourceUri |
string (uri) |
Azure OpenAI kaynağının kaynak URI'si. |
BinaryQuantizationCompression
Dizin oluşturma ve sorgulama sırasında kullanılan ikili niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir.
| Name | Tür | Description |
|---|---|---|
| kind |
string:
binary |
VektörAramaSıkıştırma Türü. |
| name |
string |
Bu özel yapılandırmayla ilişkilendirilecek ad. |
| rescoringOptions |
Yeniden puanlama seçeneklerini içerir. |
|
| truncationDimension |
integer (int32) |
Vektörlerin kesilmesi için boyut sayısı. Vektörlerin kesilmesi, vektörlerin boyutunu ve arama sırasında aktarılması gereken veri miktarını azaltır. Bu, depolama maliyetinden tasarruf edebilir ve geri çekme pahasına arama performansını artırabilir. Yalnızca OpenAI metin ekleme-3-büyük (küçük) gibi Matryoshka Temsili Öğrenmesi (MRL) ile eğitilen eklemeler için kullanılmalıdır. Varsayılan değer null'tır, yani kesme yoktur. |
BM25SimilarityAlgorithm
Okapi BM25 benzerlik algoritmasını temel alan derecelendirme işlevi. BM25, uzunluk normalleştirmesi ('b' parametresi tarafından denetlenen) ve terim sıklığı doygunluğu ('k1' parametresiyle denetlenen) içeren TF-IDF benzeri bir algoritmadır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| b |
number (double) |
Bu özellik, bir belgenin uzunluğunun ilgi puanını nasıl etkilediğini denetler. Varsayılan olarak 0,75 değeri kullanılır. 0,0 değeri uzunluk normalleştirmesi uygulanmadığı, 1,0 değeri ise puanın belgenin uzunluğuna göre tamamen normalleştirildiği anlamına gelir. |
| k1 |
number (double) |
Bu özellik, her eşleşen terimlerin terim sıklığı ile belge sorgusu çiftinin son ilgi puanı arasındaki ölçeklendirme işlevini denetler. Varsayılan olarak, 1,2 değeri kullanılır. 0,0 değeri, puanın terim sıklığındaki artışla ölçeklendirilmediği anlamına gelir. |
CharFilterName
Arama motoru tarafından desteklenen tüm karakter filtrelerinin adlarını tanımlar.
| Değer | Description |
|---|---|
| html_strip |
HTML yapılarını ayırmaya çalışan bir karakter filtresi. Bkz. https://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/charfilter/HTMLStripCharFilter.html |
CjkBigramTokenFilter
Standart belirteç oluşturucudan oluşturulan CJK terimlerinin büyük simgelerini oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| ignoreScripts |
Yoksaymak için betikler. |
||
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| outputUnigrams |
boolean |
False |
Hem tek birimlerin hem de büyük harflerin (doğruysa) veya yalnızca büyük harflerin (yanlışsa) çıkışını alıp almayacağını belirten bir değer. Varsayılan değer false'tur. |
CjkBigramTokenFilterScripts
CjkBigramTokenFilter tarafından yoksayılabilen betikler.
| Değer | Description |
|---|---|
| han |
CJK terimlerinin bigramlarını oluştururken Han betiğini yoksayın. |
| hiragana |
CJK terimlerinin bigramlarını oluştururken Hiragana komut dosyasını dikkate almayın. |
| katakana |
CJK terimlerinin bigramlarını oluştururken Katakana komut dosyasını dikkate almayın. |
| hangul |
CJK terimlerinin bigramlarını oluştururken Hangul komut dosyasını göz ardı edin. |
ClassicSimilarityAlgorithm
TF-IDF'nin Lucene TFIDFSimilarity uygulamasını kullanan eski benzerlik algoritması. bu TF-IDF varyasyonu, statik belge uzunluğu normalleştirmesini ve arama yapılan sorgularla yalnızca kısmen eşleşen belgeleri cezalandıran faktörleri koordine eder.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
ClassicTokenizer
Çoğu Avrupa dili belgesini işlemek için uygun olan dil bilgisi tabanlı belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxTokenLength |
integer (int32) maximum: 300 |
255 |
En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
CommonGramTokenFilter
Dizin oluştururken sık karşılaşılan terimler için bigrams oluşturun. Tek terimler de dizine eklenir ve ikili kelime birimleri üzerine yerleştirilir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| commonWords |
string[] |
Ortak sözcükler kümesi. |
|
| ignoreCase |
boolean |
False |
Ortak sözcükleri eşleştirmenin büyük/küçük harfe duyarsız olup olmayacağını gösteren bir değer. Varsayılan değer false'tur. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| queryMode |
boolean |
False |
Belirteç filtresinin sorgu modunda olup olmadığını gösteren değer. Sorgu modundayken belirteç filtresi büyük harfler oluşturur ve ardından ortak sözcükleri ve tek terimleri ve ardından ortak bir sözcüğü kaldırır. Varsayılan değer false'tur. |
CorsOptions
Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçeneklerini tanımlar.
| Name | Tür | Description |
|---|---|---|
| allowedOrigins |
string[] |
JavaScript koduna dizininize erişim izni verilecek kaynakların listesi. {protocol}://{fully-qualified-domain-name}[:{port#}] biçimindeki ana bilgisayarların bir listesini veya tüm çıkış noktalarına izin vermek için tek bir '*' içerebilir (önerilmez). |
| maxAgeInSeconds |
integer (int64) |
Tarayıcıların CORS ön kontrol yanıtlarını önbelleğe alması gereken süre. Varsayılan olarak 5 dakikadır. |
CustomAnalyzer
Metni dizine alınabilen/aranabilir belirteçlere dönüştürme işlemi üzerinde denetim sahibi olmanıza olanak tanır. Önceden tanımlanmış tek bir belirteç oluşturucu ve bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır. Belirteç oluşturucu, metinleri belirteçlere bölmek ve belirteç oluşturucu tarafından yayılan belirteçleri değiştirmek için filtrelerden sorumludur.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| charFilters |
Giriş metnini belirteç oluşturucu tarafından işlenmeden önce hazırlamak için kullanılan karakter filtrelerinin listesi. Örneğin, belirli karakterleri veya simgeleri değiştirebilirler. Filtreler, listelendikleri sırayla çalıştırılır. |
|
| name |
string |
Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
| tokenFilters |
Bir belirteç oluşturucu tarafından oluşturulan belirteçleri filtrelemek veya değiştirmek için kullanılan belirteç filtrelerinin listesi. Örneğin, tüm karakterleri küçük harfe dönüştüren küçük harfli bir filtre belirtebilirsiniz. Filtreler, listelendikleri sırayla çalıştırılır. |
|
| tokenizer |
Sürekli metni, bir cümleyi sözcüklere bölme gibi bir belirteç dizisine bölmek için kullanılacak belirteç oluşturucunun adı. |
CustomNormalizer
Filtrelenebilir, sıralanabilir ve modellenebilir alanlar için normalleştirmeyi yapılandırmanıza olanak tanır ve bu alanlar varsayılan olarak katı eşleştirmeyle çalışır. Bu, depolanan belirteci değiştiren en az bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| charFilters |
Giriş metnini işlenmeden önce hazırlamak için kullanılan karakter filtreleri listesi. Örneğin, belirli karakterleri veya simgeleri değiştirebilirler. Filtreler, listelendikleri sırayla çalıştırılır. |
|
| name |
string |
Karakter filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
| tokenFilters |
Giriş belirtecini filtrelemek veya değiştirmek için kullanılan belirteç filtrelerinin listesi. Örneğin, tüm karakterleri küçük harfe dönüştüren küçük harfli bir filtre belirtebilirsiniz. Filtreler, listelendikleri sırayla çalıştırılır. |
DictionaryDecompounderTokenFilter
Birçok Almanca dilinde bulunan bileşik sözcükleri ayrıştırıyor. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxSubwordSize |
integer (int32) maximum: 300 |
15 |
En büyük alt kelime boyutu. Yalnızca bundan kısa alt sözler çıkarılır. Varsayılan değer 15'tir. Maksimum değer 300'dür. |
| minSubwordSize |
integer (int32) maximum: 300 |
2 |
En düşük alt kelime boyutu. Yalnızca bundan daha uzun alt ifadeler çıkarılır. Varsayılan değer 2'dir. Maksimum değer 300'dür. |
| minWordSize |
integer (int32) maximum: 300 |
5 |
En küçük sözcük boyutu. Yalnızca bundan daha uzun sözcükler işlenir. Varsayılan değer 5'tir. Maksimum değer 300'dür. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| onlyLongestMatch |
boolean |
False |
Çıkışa yalnızca en uzun eşleşen alt sözcüğün eklenip eklenmeyeceğini gösteren değer. Varsayılan değer false'tur. |
| wordList |
string[] |
Eşleşecek sözcüklerin listesi. |
DistanceScoringFunction
Coğrafi konumdan uzaklığı temel alarak puanları artıran bir işlev tanımlar.
| Name | Tür | Description |
|---|---|---|
| boost |
number (double) |
Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır. |
| distance |
Uzaklık puanlama işlevi için parametre değerleri. |
|
| fieldName |
string |
Puanlama işlevine giriş olarak kullanılan alanın adı. |
| interpolation |
Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır. |
|
| type |
string:
distance |
ScoringFunction türü. |
DistanceScoringParameters
Uzaklık puanlama işlevine parametre değerleri sağlar.
| Name | Tür | Description |
|---|---|---|
| boostingDistance |
number (double) |
Takviye aralığının sona erdiği referans konumundan kilometre cinsinden mesafe. |
| referencePointParameter |
string |
Başvuru konumunu belirtmek için arama sorgularında geçirilen parametrenin adı. |
EdgeNGramTokenFilter
Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxGram |
integer (int32) |
2 |
En fazla n gram uzunluk. Varsayılan değer 2'dir. |
| minGram |
integer (int32) |
1 |
En az n gram uzunluk. Varsayılan değer 1'dir. maxGram değerinden küçük olmalıdır. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| side | front |
N-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir. Varsayılan değer "ön"dür. |
EdgeNGramTokenFilterSide
Bir n-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir.
| Değer | Description |
|---|---|
| front |
n-gramın girişin önünden oluşturulması gerektiğini belirtir. |
| back |
n-gramın girişin arkasından oluşturulması gerektiğini belirtir. |
EdgeNGramTokenFilterV2
Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxGram |
integer (int32) maximum: 300 |
2 |
En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür. |
| minGram |
integer (int32) maximum: 300 |
1 |
En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| side | front |
N-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir. Varsayılan değer "ön"dür. |
EdgeNGramTokenizer
Bir kenardan gelen girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxGram |
integer (int32) maximum: 300 |
2 |
En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür. |
| minGram |
integer (int32) maximum: 300 |
1 |
En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| tokenChars |
Belirteçlerde tutulacak karakter sınıfları. |
ElisionTokenFilter
Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| articles |
string[] |
Kaldırılacak makale kümesi. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
ErrorAdditionalInfo
Kaynak yönetimi hatası ek bilgileri.
| Name | Tür | Description |
|---|---|---|
| info |
Ek bilgiler. |
|
| type |
string |
Ek bilgi türü. |
ErrorDetail
Hata ayrıntısı.
| Name | Tür | Description |
|---|---|---|
| additionalInfo |
Hata ek bilgileri. |
|
| code |
string |
Hata kodu. |
| details |
Hata ayrıntıları. |
|
| message |
string |
Hata iletisi. |
| target |
string |
Hata hedefi |
ErrorResponse
Başarısız işlemlerin hata ayrıntılarını döndürmek için tüm Azure Resource Manager API'leri için genel hata yanıtı. (Bu, OData hata yanıt biçimini de izler.).
| Name | Tür | Description |
|---|---|---|
| error |
Hata nesnesi. |
ExhaustiveKnnAlgorithmConfiguration
Sorgulama sırasında kullanılan kapsamlı KNN algoritmasına özgü yapılandırma seçeneklerini içerir ve bu seçenek vektör dizininin tamamında deneme yanılma araması gerçekleştirir.
| Name | Tür | Description |
|---|---|---|
| exhaustiveKnnParameters |
Kapsamlı KNN algoritmasına özgü parametreleri içerir. |
|
| kind |
string:
exhaustive |
Vektör TürüAramaAlgoritmaYapılandırma. |
| name |
string |
Bu özel yapılandırmayla ilişkilendirilecek ad. |
ExhaustiveKnnParameters
Kapsamlı KNN algoritmasına özgü parametreleri içerir.
| Name | Tür | Description |
|---|---|---|
| metric |
Vektör karşılaştırmaları için kullanılacak benzerlik metriği. |
FreshnessScoringFunction
Bir tarih-saat alanının değerine göre puanları artıran bir işlev tanımlar.
| Name | Tür | Description |
|---|---|---|
| boost |
number (double) |
Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır. |
| fieldName |
string |
Puanlama işlevine giriş olarak kullanılan alanın adı. |
| freshness |
Yenilik puanlama işlevi için parametre değerleri. |
|
| interpolation |
Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır. |
|
| type |
string:
freshness |
ScoringFunction türü. |
FreshnessScoringParameters
Bir güncellik puanlama işlevine parametre değerleri sağlar.
| Name | Tür | Description |
|---|---|---|
| boostingDuration |
string (duration) |
Belirli bir belge için yükseltmenin durdurulacağı sona erme süresi. |
HnswAlgorithmConfiguration
Dizin oluşturma ve sorgulama sırasında kullanılan HNSW yaklaşık en yakın komşular algoritmasına özgü yapılandırma seçeneklerini içerir. HNSW algoritması, arama hızı ve doğruluğu arasında ayarlanabilir bir denge sunar.
| Name | Tür | Description |
|---|---|---|
| hnswParameters |
HNSW algoritmasına özgü parametreleri içerir. |
|
| kind |
string:
hnsw |
Vektör TürüAramaAlgoritmaYapılandırma. |
| name |
string |
Bu özel yapılandırmayla ilişkilendirilecek ad. |
HnswParameters
HNSW algoritmasına özgü parametreleri içerir.
| Name | Tür | Default value | Description |
|---|---|---|---|
| efConstruction |
integer (int32) minimum: 100maximum: 1000 |
400 |
Dizin süresi boyunca kullanılan en yakın komşuları içeren dinamik listenin boyutu. Bu parametrenin artırılması, dizin oluşturma süresinin artması pahasına dizin kalitesini iyileştirebilir. Belli bir noktada, bu parametrenin arttırılması azalan getirilere yol açar. |
| efSearch |
integer (int32) minimum: 100maximum: 1000 |
500 |
Arama sırasında kullanılan en yakın komşuları içeren dinamik listenin boyutu. Bu parametreyi artırmak, daha yavaş arama pahasına arama sonuçlarını iyileştirebilir. Belli bir noktada, bu parametrenin arttırılması azalan getirilere yol açar. |
| m |
integer (int32) minimum: 4maximum: 10 |
4 |
İnşaat sırasında her yeni eleman için oluşturulan çift yönlü bağlantıların sayısı. Bu parametre değerinin artırılması, artan bellek tüketimi ve daha uzun dizin oluşturma süresi pahasına yüksek iç boyutluluğa sahip veri kümeleri için geri çağırmayı iyileştirebilir ve alma sürelerini azaltabilir. |
| metric |
Vektör karşılaştırmaları için kullanılacak benzerlik metriği. |
KeepTokenFilter
Belirteçleri yalnızca belirtilen sözcük listesinde yer alan metinle tutan bir belirteç filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| keepWords |
string[] |
Tutulacak sözcüklerin listesi. |
|
| keepWordsCase |
boolean |
False |
Önce tüm sözcüklerin küçük harfle yazılıp azaltılmayacağını gösteren bir değer. Varsayılan değer false'tur. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
KeywordMarkerTokenFilter
Terimleri anahtar sözcük olarak işaretler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| ignoreCase |
boolean |
False |
Büyük/küçük harf yoksayılıp yoksayılmayacağını belirten bir değer. True ise, önce tüm sözcükler küçük harfe dönüştürülür. Varsayılan değer false'tur. |
| keywords |
string[] |
Anahtar sözcük olarak işaretlenecek sözcüklerin listesi. |
|
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
KeywordTokenizer
Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| bufferSize |
integer (int32) |
256 |
Bayt cinsinden okuma arabelleği boyutu. Varsayılan değer 256'dır. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
KeywordTokenizerV2
Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxTokenLength |
integer (int32) maximum: 300 |
256 |
En fazla belirteç uzunluğu. Varsayılan değer 256'dır. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
LengthTokenFilter
Çok uzun veya çok kısa sözcükleri kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| max |
integer (int32) maximum: 300 |
300 |
Karakter cinsinden uzunluk üst sınırı. Varsayılan ve maksimum değer 300'dür. |
| min |
integer (int32) maximum: 300 |
0 |
Karakter cinsinden en küçük uzunluk. Varsayılan değer 0'dır. Maksimum değer 300'dür. En büyük değerinden küçük olmalıdır. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
LexicalAnalyzerName
Arama motoru tarafından desteklenen tüm metin çözümleyicilerinin adlarını tanımlar.
| Değer | Description |
|---|---|
| ar.microsoft |
Arapça için Microsoft analizörü. |
| ar.lucene |
Arapça için Lucene analizörü. |
| hy.lucene |
Ermenice için Lucene analizörü. |
| bn.microsoft |
Bangla için Microsoft analizörü. |
| eu.lucene |
Bask için Lucene analizörü. |
| bg.microsoft |
Bulgarca için Microsoft analizörü. |
| bg.lucene |
Bulgarca için Lucene analizörü. |
| ca.microsoft |
Katalan için Microsoft analizörü. |
| ca.lucene |
Katalanca için Lucene analizörü. |
| zh-Hans.microsoft |
Çince için Microsoft analizörü (Basitleştirilmiş). |
| zh-Hans.lucene |
Çince için Lucene analizörü (Basitleştirilmiş). |
| zh-Hant.microsoft |
Çince için Microsoft analizörü (Geleneksel). |
| zh-Hant.lucene |
Çince (Geleneksel) için Lucene analizörü. |
| hr.microsoft |
Hırvatça için Microsoft analizörü. |
| cs.microsoft |
Çekçe için Microsoft analizörü. |
| cs.lucene |
Çekçe için Lucene analizörü. |
| da.microsoft |
Dança için Microsoft analizörü. |
| da.lucene |
Danca için Lucene analizörü. |
| nl.microsoft |
Hollanda için Microsoft analizörü. |
| nl.lucene |
Hollandaca için Lucene analizörü. |
| en.microsoft |
İngilizce için Microsoft analizörü. |
| en.lucene |
İngilizce için Lucene analizörü. |
| et.microsoft |
Estonca için Microsoft analizörü. |
| fi.microsoft |
Microsoft analizörü for Finnce. |
| fi.lucene |
Fince için Lucene analizörü. |
| fr.microsoft |
Fransızca için Microsoft analizörü. |
| fr.lucene |
Fransızca için Lucene analizörü. |
| gl.lucene |
Galiçyaca için Lucene analizörü. |
| de.microsoft |
Almanca için Microsoft analizörü. |
| de.lucene |
Almanca için Lucene analizörü. |
| el.microsoft |
Yunanca için Microsoft analizörü. |
| el.lucene |
Yunanca için Lucene analizörü. |
| gu.microsoft |
Gujarati için Microsoft analizörü. |
| he.microsoft |
İbranice için Microsoft analizörü. |
| hi.microsoft |
Hintçe için Microsoft analizörü. |
| hi.lucene |
Hintçe için Lucene analizörü. |
| hu.microsoft |
Macarca için Microsoft analizörü. |
| hu.lucene |
Macarca için Lucene analizörü. |
| is.microsoft |
İzlanda için Microsoft analizörü. |
| id.microsoft |
Endonezce (Bahasa) için Microsoft analizörü. |
| id.lucene |
Endonezya için Lucene analizörü. |
| ga.lucene |
İrlandalılar için Lucene analizörü. |
| it.microsoft |
İtalyanca için Microsoft analizörü. |
| it.lucene |
İtalyanca için Lucene analizörü. |
| ja.microsoft |
Japonca için Microsoft analizörü. |
| ja.lucene |
Japonca için Lucene analizörü. |
| kn.microsoft |
Kannada için Microsoft analizörü. |
| ko.microsoft |
Korece için Microsoft analizörü. |
| ko.lucene |
Korece için Lucene analizörü. |
| lv.microsoft |
Letonca için Microsoft analizörü. |
| lv.lucene |
Letonca için Lucene analizörü. |
| lt.microsoft |
Litvanca için Microsoft analizörü. |
| ml.microsoft |
Malayalam için Microsoft analizörü. |
| ms.microsoft |
Malay (Latince) için Microsoft analizörü. |
| mr.microsoft |
Marathi için Microsoft analizörü. |
| nb.microsoft |
Microsoft analyzer for Norwegian (Bokmål). |
| no.lucene |
Norveççe için Lucene analizörü. |
| fa.lucene |
Farsça için Lucene analizörü. |
| pl.microsoft |
Polonya için Microsoft analizörü. |
| pl.lucene |
Lehçe için Lucene analizörü. |
| pt-BR.microsoft |
Portekizce için Microsoft analizörü (Brezilya). |
| pt-BR.lucene |
Portekizce (Brezilya) için Lucene analizörü. |
| pt-PT.microsoft |
Portekizce (Portekiz) için Microsoft analizörü. |
| pt-PT.lucene |
Portekizce (Portekiz) için Lucene analizörü. |
| pa.microsoft |
Pencapça için Microsoft analizörü. |
| ro.microsoft |
Rumence için Microsoft analizörü. |
| ro.lucene |
Romence için Lucene analizörü. |
| ru.microsoft |
Rusça için Microsoft analizörü. |
| ru.lucene |
Rusça için Lucene analizörü. |
| sr-cyrillic.microsoft |
Sırbça için Microsoft analizörü (Kiril). |
| sr-latin.microsoft |
Microsoft analizörü Sırpça (Latince) için. |
| sk.microsoft |
Slovakça için Microsoft analizörü. |
| sl.microsoft |
Slovence için Microsoft analizörü. |
| es.microsoft |
İspanyolca için Microsoft analizörü. |
| es.lucene |
İspanyolca için Lucene analizörü. |
| sv.microsoft |
İsveççe için Microsoft analizörü. |
| sv.lucene |
İsveççe için Lucene analizörü. |
| ta.microsoft |
Tamil için Microsoft analizörü. |
| te.microsoft |
Telugu için Microsoft analizörü. |
| th.microsoft |
Tayca için Microsoft analizörü. |
| th.lucene |
Tay dili için Lucene analizörü. |
| tr.microsoft |
Microsoft analizörü için Türkçe. |
| tr.lucene |
Türkçe için Lucene analizörü. |
| uk.microsoft |
Ukraynaca için Microsoft analizörü. |
| ur.microsoft |
Microsoft analizörü Urduca için. |
| vi.microsoft |
Vietnamca için Microsoft analizörü. |
| standard.lucene |
Standart Lucene analizörü. |
| standardasciifolding.lucene |
Standart ASCII Katlanır Lucene analizörü. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#Analyzers |
| keyword |
Bir alanın içeriğinin tamamını tek bir belirteç olarak ele alır. Bu, posta kodları, kimlikler ve bazı ürün adları gibi veriler için kullanışlıdır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/KeywordAnalyzer.html |
| pattern |
Normal ifade deseni aracılığıyla metni esnek bir şekilde terimlere ayırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/PatternAnalyzer.html |
| simple |
Metni harf olmayanlara böler ve küçük harfe dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/SimpleAnalyzer.html |
| stop |
Metni harf olmayanlara böler; Küçük harf ve stopword belirteci filtrelerini uygular. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopAnalyzer.html |
| whitespace |
Boşluk tokenizer'ı kullanan bir çözümleyici. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/WhitespaceAnalyzer.html |
LexicalNormalizerName
Arama motoru tarafından desteklenen tüm metin normalleştiricilerinin adlarını tanımlar.
LexicalTokenizerName
Arama motoru tarafından desteklenen tüm tokenizer'ların adlarını tanımlar.
LimitTokenFilter
Dizin oluşturma sırasında belirteç sayısını sınırlar. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| consumeAllTokens |
boolean |
False |
maxTokenCount değerine ulaşılsa bile girişten gelen tüm belirteçlerin tüketilip tüketilmeyeceğini gösteren değer. Varsayılan değer false'tur. |
| maxTokenCount |
integer (int32) |
1 |
Üretilmesi gereken en fazla belirteç sayısı. Varsayılan değer 1'dir. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
LuceneStandardAnalyzer
Standart Apache Lucene çözümleyicisi; Standart belirteç oluşturucu, küçük harfli filtre ve durdurma filtresinden oluşur.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxTokenLength |
integer (int32) maximum: 300 |
255 |
En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. |
| name |
string |
Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| stopwords |
string[] |
Stopwords listesi. |
LuceneStandardTokenizer
Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxTokenLength |
integer (int32) |
255 |
En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
LuceneStandardTokenizerV2
Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxTokenLength |
integer (int32) maximum: 300 |
255 |
En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
MagnitudeScoringFunction
Sayısal alanın büyüklüğüne göre puanları artıran bir işlev tanımlar.
| Name | Tür | Description |
|---|---|---|
| boost |
number (double) |
Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır. |
| fieldName |
string |
Puanlama işlevine giriş olarak kullanılan alanın adı. |
| interpolation |
Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır. |
|
| magnitude |
Büyük puanlama işlevinin parametre değerleri. |
|
| type |
string:
magnitude |
ScoringFunction türü. |
MagnitudeScoringParameters
Bir büyük puanlama işlevine parametre değerleri sağlar.
| Name | Tür | Description |
|---|---|---|
| boostingRangeEnd |
number (double) |
Yükseltmenin sona erdiği alan değeri. |
| boostingRangeStart |
number (double) |
Yükseltmenin başladığı alan değeri. |
| constantBoostBeyondRange |
boolean |
Aralık bitiş değerinin ötesindeki alan değerleri için sabit bir artırma uygulanıp uygulanmayacağını gösteren bir değer; Varsayılan değer false'tur. |
MappingCharFilter
Eşlemeler seçeneğiyle tanımlanan eşlemeleri uygulayan karakter filtresi. Eşleştirme açgözlüdür (verilen bir noktada en uzun desen eşleştirmesi kazanır). Değiştirmenin boş dize olması için izin verilir. Bu karakter filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| mappings |
string[] |
Şu biçimdeki eşlemelerin listesi: "a=>b" ("a" karakterinin tüm oluşumları "b" karakteriyle değiştirilir). |
| name |
string |
Karakter filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
MicrosoftLanguageStemmingTokenizer
Dile özgü kuralları kullanarak metni böler ve sözcükleri temel formlarına küçültür.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| isSearchTokenizer |
boolean |
False |
Belirteç oluşturucunun nasıl kullanıldığını gösteren değer. Arama belirteci olarak kullanılırsa true olarak, dizin belirteç oluşturucu olarak kullanılıyorsa false olarak ayarlayın. Varsayılan değer false'tur. |
| language |
Kullanılacak dil. Varsayılan değer İngilizce'dir. |
||
| maxTokenLength |
integer (int32) maximum: 300 |
255 |
En fazla belirteç uzunluğu. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. 300 karakterden uzun belirteçler önce 300 uzunluğundaki belirteçlere bölünür ve ardından bu belirteçlerin her biri ayarlanan maksimum belirteç uzunluğuna göre bölünür. Varsayılan değer 255'tir. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
MicrosoftLanguageTokenizer
Dile özgü kuralları kullanarak metni böler.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| isSearchTokenizer |
boolean |
False |
Belirteç oluşturucunun nasıl kullanıldığını gösteren değer. Arama belirteci olarak kullanılırsa true olarak, dizin belirteç oluşturucu olarak kullanılıyorsa false olarak ayarlayın. Varsayılan değer false'tur. |
| language |
Kullanılacak dil. Varsayılan değer İngilizce'dir. |
||
| maxTokenLength |
integer (int32) maximum: 300 |
255 |
En fazla belirteç uzunluğu. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. 300 karakterden uzun belirteçler önce 300 uzunluğundaki belirteçlere bölünür ve ardından bu belirteçlerin her biri ayarlanan maksimum belirteç uzunluğuna göre bölünür. Varsayılan değer 255'tir. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
MicrosoftStemmingTokenizerLanguage
Tokenizer'den gelen Microsoft dilinin desteklediği dilleri listeler.
| Değer | Description |
|---|---|
| arabic |
Arapça için Microsoft kök tokenizer'ını seçer. |
| bangla |
Bangla için Microsoft kök tokenizer'ını seçer. |
| bulgarian |
Bulgarca için Microsoft kök tokenizer'ını seçer. |
| catalan |
Katalan için Microsoft köklü tokenizer'ı seçer. |
| croatian |
Hırvatça için Microsoft köklü tokenizer'ı seçer. |
| czech |
Çekçe için Microsoft kök tokenizer'ını seçer. |
| danish |
Danish için Microsoft kök tokenizer'ını seçer. |
| dutch |
Hollandaca için Microsoft kök tokenizer'ını seçer. |
| english |
İngilizce için Microsoft kök tokenizer'ını seçer. |
| estonian |
Estonya için Microsoft köklü tokenizer'i seçer. |
| finnish |
Fince için Microsoft kök tokenizer'ını seçer. |
| french |
Fransızca için Microsoft kök tokenizer'ını seçer. |
| german |
Almanca için Microsoft kök tokenizer'ını seçer. |
| greek |
Yunanca için Microsoft kök tokenizer'ını seçer. |
| gujarati |
Gujarati için Microsoft köklü tokenizer'ı seçer. |
| hebrew |
İbranice için Microsoft kök tokenizer'ını seçer. |
| hindi |
Hintçe için Microsoft kök tokenizer'ini seçer. |
| hungarian |
Macarca'ya yönelik Microsoft kök tokenizer'ını seçer. |
| icelandic |
İzlanda için Microsoft kök tokenizer'ını seçer. |
| indonesian |
Endonezya için Microsoft kök tokenizer'ını seçer. |
| italian |
İtalyanca için Microsoft kök tokenizer'ını seçer. |
| kannada |
Kannada için Microsoft köklü tokenizer'ı seçer. |
| latvian |
Letonca için Microsoft köklü tokenizer'ı seçer. |
| lithuanian |
Litvanca için Microsoft kök tokenizer'ını seçer. |
| malay |
Malay için Microsoft kök tokenizer'ını seçer. |
| malayalam |
Malayalam için Microsoft köken tokenizer'ını seçer. |
| marathi |
Marathi için Microsoft kök tokenizer'ını seçer. |
| norwegianBokmaal |
Norwegian (Bokmål) için Microsoft stemming tokenizer'i seçer. |
| polish |
Polonya için Microsoft kök tokenizer'ını seçer. |
| portuguese |
Portekizce için Microsoft kök tokenizer'ını seçer. |
| portugueseBrazilian |
Portekiz (Brezilya) için Microsoft köken tokenizer'ını seçer. |
| punjabi |
Pencapça için Microsoft kök tokenizer'ını seçer. |
| romanian |
Romanca için Microsoft kök tokenizer'ını seçer. |
| russian |
Rusça için Microsoft kök tokenizer'ını seçer. |
| serbianCyrillic |
Sırpça (Kiril) için Microsoft köklü tokenizer'ı seçer. |
| serbianLatin |
Sırbça (Latince) için Microsoft kök tokenizer'ını seçer. |
| slovak |
Slovak için Microsoft kök tokenizer'ını seçer. |
| slovenian |
Slovenian için Microsoft köklü tokenizer'ı seçer. |
| spanish |
İspanyolca için Microsoft kök tokenizer'ını seçer. |
| swedish |
İsveççe için Microsoft köklü tokenizer'ı seçer. |
| tamil |
Tamilce için Microsoft'un köklü tokenizerini seçer. |
| telugu |
Telugu için Microsoft'un kök tokenizer'ını seçer. |
| turkish |
Turkish için Microsoft kök tokenizer'ını seçer. |
| ukrainian |
Ukraynaca için Microsoft kök tokenizer'ını seçer. |
| urdu |
Urduca için Microsoft köklü tokenizer'ı seçer. |
MicrosoftTokenizerLanguage
Microsoft dil tokenizer'ı tarafından desteklenen dilleri listeler.
| Değer | Description |
|---|---|
| bangla |
Bangla için Microsoft tokenizer'ını seçer. |
| bulgarian |
Bulgarca için Microsoft tokenizer'ını seçer. |
| catalan |
Katalanca için Microsoft tokenizer'ını seçer. |
| chineseSimplified |
Çince için Microsoft tokenizer'ını seçer (Basitleştirilmiş). |
| chineseTraditional |
Çince (Geleneksel) için Microsoft tokenizer'ını seçer. |
| croatian |
Hırvatça için Microsoft tokenizer'ını seçer. |
| czech |
Çekçe için Microsoft tokenizer'ını seçer. |
| danish |
Dança için Microsoft tokenizer'ını seçer. |
| dutch |
Hollanda için Microsoft tokenizer'ını seçer. |
| english |
İngilizce için Microsoft tokenizer'ını seçer. |
| french |
Fransızca için Microsoft tokenizer'ını seçer. |
| german |
Almanca için Microsoft tokenizer'ını seçer. |
| greek |
Yunanca için Microsoft tokenizer'ını seçer. |
| gujarati |
Gujarati için Microsoft tokenizer'ını seçer. |
| hindi |
Hintçe için Microsoft tokenizer'ını seçer. |
| icelandic |
İzlanda için Microsoft tokenizer'ını seçer. |
| indonesian |
Endonezya için Microsoft tokenizer'ını seçer. |
| italian |
İtalyanca için Microsoft tokenizer'ını seçer. |
| japanese |
Japonca için Microsoft tokenizer'ını seçer. |
| kannada |
Kannada için Microsoft tokenizer'ını seçer. |
| korean |
Korece için Microsoft tokenizer'ını seçer. |
| malay |
Malay için Microsoft tokenizer'ını seçer. |
| malayalam |
Malayalam için Microsoft tokenizer'ını seçer. |
| marathi |
Marathi için Microsoft tokenizer'ını seçer. |
| norwegianBokmaal |
Norveççe için Microsoft tokenizer'ı seçer (BokmÃ¥l). |
| polish |
Polonya için Microsoft tokenizer'ını seçer. |
| portuguese |
Portekizce için Microsoft tokenizer'ını seçer. |
| portugueseBrazilian |
Portekizce (Brezilya) için Microsoft tokenizer'ını seçer. |
| punjabi |
Pencapça için Microsoft tokenizer'ını seçer. |
| romanian |
Romanca için Microsoft tokenizer'ını seçer. |
| russian |
Rusça için Microsoft tokenizer'ını seçer. |
| serbianCyrillic |
Sırp (Kiril) için Microsoft tokenizer'ını seçer. |
| serbianLatin |
Sırpça (Latince) için Microsoft tokenizer'ını seçer. |
| slovenian |
Slovence için Microsoft tokenizer'ını seçer. |
| spanish |
İspanyolca için Microsoft tokenizer'ını seçer. |
| swedish |
İsveççe için Microsoft tokenizer'ını seçer. |
| tamil |
Tamilce için Microsoft tokenizer'ını seçer. |
| telugu |
Telugu için Microsoft tokenizer'ını seçer. |
| thai |
Taylandca için Microsoft tokenizer'ını seçer. |
| ukrainian |
Ukraynaca için Microsoft tokenizer'ını seçer. |
| urdu |
Urduca için Microsoft tokenizer'ını seçer. |
| vietnamese |
Vietnamca için Microsoft tokenizer'ını seçer. |
NGramTokenFilter
Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxGram |
integer (int32) |
2 |
En fazla n gram uzunluk. Varsayılan değer 2'dir. |
| minGram |
integer (int32) |
1 |
En az n gram uzunluk. Varsayılan değer 1'dir. maxGram değerinden küçük olmalıdır. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
NGramTokenFilterV2
Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxGram |
integer (int32) maximum: 300 |
2 |
En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür. |
| minGram |
integer (int32) maximum: 300 |
1 |
En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
NGramTokenizer
Girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxGram |
integer (int32) maximum: 300 |
2 |
En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür. |
| minGram |
integer (int32) maximum: 300 |
1 |
En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| tokenChars |
Belirteçlerde tutulacak karakter sınıfları. |
PathHierarchyTokenizerV2
Yol benzeri hiyerarşiler için belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| delimiter |
string maxLength: 1 |
/ |
Kullanılacak sınırlayıcı karakteri. Varsayılan değer "/" şeklindedir. |
| maxTokenLength |
integer (int32) maximum: 300 |
300 |
En fazla belirteç uzunluğu. Varsayılan ve maksimum değer 300'dür. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| replacement |
string maxLength: 1 |
/ |
Ayarlanırsa sınırlayıcı karakterinin yerini alan bir değer. Varsayılan değer "/" şeklindedir. |
| reverse |
boolean |
False |
Belirteçlerin ters sırada oluşturulup oluşturulmayacağını gösteren bir değer. Varsayılan değer false'tur. |
| skip |
integer (int32) |
0 |
Atlana ilk belirteçlerin sayısı. Varsayılan değer 0'dır. |
PatternAnalyzer
Normal ifade deseni aracılığıyla metni esnek bir şekilde terimlere ayırır. Bu çözümleyici Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| flags |
string |
RegexFlags değerlerinden oluşan '|' ayrılmış bir dizi olarak tanımlanan düzenli ifade bayrakları. |
|
| lowercase |
boolean |
True |
Terimlerin küçük harfle yazılıp yazılmayacağını belirten bir değer. Varsayılan değer doğrudur |
| name |
string |
Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| pattern |
string |
\W+ |
Belirteç ayırıcılarıyla eşleşmesi için bir normal ifade deseni. Varsayılan, sözcük olmayan bir veya daha fazla karakterle eşleşen bir ifadedir. |
| stopwords |
string[] |
Stopwords listesi. |
PatternCaptureTokenFilter
Bir veya daha fazla desendeki her yakalama grubu için bir tane olmak üzere birden çok belirteç yaymak için Java regexes kullanır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| patterns |
string[] |
Her belirteçle eşleşecek desenlerin listesi. |
|
| preserveOriginal |
boolean |
True |
Desenlerden biri eşleşse bile özgün belirtecin döndürülip döndürülmeyeceğini belirten bir değer. Varsayılan değer doğrudur |
PatternReplaceCharFilter
Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu karakter filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| name |
string |
Karakter filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
| pattern |
string |
Normal ifade deseni. |
| replacement |
string |
Değiştirme metni. |
PatternReplaceTokenFilter
Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
| pattern |
string |
Normal ifade deseni. |
| replacement |
string |
Değiştirme metni. |
PatternTokenizer
Farklı belirteçler oluşturmak için regex desen eşleştirmesi kullanan belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| flags |
string |
RegexFlags değerlerinden oluşan '|' ayrılmış bir dizi olarak tanımlanan düzenli ifade bayrakları. |
|
| group |
integer (int32) |
-1 |
Belirteçlere ayıklamak için normal ifade desenindeki eşleşen grubun sıfır tabanlı sırası. Eşleşen gruplardan bağımsız olarak girdiyi belirteçlere bölmek için tüm deseni kullanmak istiyorsanız -1 kullanın. Varsayılan değer -1'dir. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| pattern |
string |
\W+ |
Belirteç ayırıcılarıyla eşleşmesi için bir normal ifade deseni. Varsayılan, sözcük olmayan bir veya daha fazla karakterle eşleşen bir ifadedir. |
PhoneticEncoder
PhoneticTokenFilter ile kullanılacak fonetik kodlayıcı türünü tanımlar.
| Değer | Description |
|---|---|
| metaphone |
Bir belirteci Metafon değerine kodlar. |
| doubleMetaphone |
Bir belirteci çift metafon değerine kodlar. |
| soundex |
Bir belirteci Soundex değerine kodlar. |
| refinedSoundex |
Bir belirteci Rafine Soundex değerine kodlar. |
| caverphone1 |
Bir belirteci Caverphone 1.0 değerine kodlar. |
| caverphone2 |
Bir belirteci Caverphone 2.0 değerine kodlar. |
| cologne |
Bir belirteci Köln Fonetik değerine kodlar. |
| nysiis |
Bir belirteci bir NYSIIS değerine kodlar. |
| koelnerPhonetik |
Kölner Phonetik algoritmasını kullanarak bir belirteci kodlar. |
| haasePhonetik |
Kölner Phonetik algoritmasının Haase iyileştirmesini kullanarak bir belirteci kodlar. |
| beiderMorse |
Belirteci Beider-Morse bir değere kodlar. |
PhoneticTokenFilter
Fonetik eşleşmeler için belirteçler oluşturun. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| encoder | metaphone |
Kullanılacak fonetik kodlayıcı. Varsayılan değer "metaphone" şeklindedir. |
|
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| replace |
boolean |
True |
Kodlanmış belirteçlerin özgün belirteçlerin yerini alıp almayacağını gösteren değer. False ise kodlanmış belirteçler eş anlamlı olarak eklenir. Varsayılan değer doğrudur |
RankingOrder
Belgelerin sıralama düzeni için kullanılacak puanı temsil eder.
| Değer | Description |
|---|---|
| BoostedRerankerScore |
Sıralama düzenini BoostedRerankerScore olarak ayarlar |
| RerankerScore |
Sıralama düzenini ReRankerScore olarak ayarlar |
RescoringOptions
Yeniden puanlama seçeneklerini içerir.
| Name | Tür | Default value | Description |
|---|---|---|---|
| defaultOversampling |
number (double) |
Varsayılan fazla örnekleme faktörü. Yüksek hızda örnekleme, nicelemeden kaynaklanan çözünürlük kaybını dengelemek için daha büyük bir potansiyel belge kümesini alır. Bu, tam duyarlıklı vektörlerde yeniden puanlanacak sonuç kümesini artırır. En düşük değer 1'dir, yani fazla örnekleme (1x). Bu parametre yalnızca 'enableRescoring' true olduğunda ayarlanabilir. Daha yüksek değerler gecikme süresiyle geri çağırmayı iyileştirir. |
|
| enableRescoring |
boolean |
True |
Doğru olarak ayarlanırsa, sıkıştırılmış vektörler üzerinde yapılan ilk aramadan sonra, benzerlik puanları tam duyarlıklı vektörler kullanılarak yeniden hesaplanır. Bu, gecikme süresine karşı geri çağırmayı iyileştirir. |
| rescoreStorageMethod |
enum:
|
preserveOriginals |
Orijinal vektörler için depolama yöntemini kontrol eder. Bu ayar sabittir. |
ScalarQuantizationCompression
Dizin oluşturma ve sorgulama sırasında kullanılan skaler niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir.
| Name | Tür | Description |
|---|---|---|
| kind |
string:
scalar |
VektörAramaSıkıştırma Türü. |
| name |
string |
Bu özel yapılandırmayla ilişkilendirilecek ad. |
| rescoringOptions |
Yeniden puanlama seçeneklerini içerir. |
|
| scalarQuantizationParameters |
Skaler Niceleme'ye özgü parametreleri içerir. |
|
| truncationDimension |
integer (int32) |
Vektörlerin kesilmesi için boyut sayısı. Vektörlerin kesilmesi, vektörlerin boyutunu ve arama sırasında aktarılması gereken veri miktarını azaltır. Bu, depolama maliyetinden tasarruf edebilir ve geri çekme pahasına arama performansını artırabilir. Yalnızca OpenAI metin ekleme-3-büyük (küçük) gibi Matryoshka Temsili Öğrenmesi (MRL) ile eğitilen eklemeler için kullanılmalıdır. Varsayılan değer null'tır, yani kesme yoktur. |
ScalarQuantizationParameters
Skaler Niceleme'ye özgü parametreleri içerir.
| Name | Tür | Description |
|---|---|---|
| quantizedDataType |
Sıkıştırılmış vektör değerlerinin nicelleştirilmiş veri türü. |
ScoringFunctionAggregation
Bir puanlama profilindeki tüm puanlama işlevlerinin sonuçlarını birleştirmek için kullanılan toplama işlevini tanımlar.
| Değer | Description |
|---|---|
| sum |
Puanları, tüm puanlama işlevi sonuçlarının toplamına göre artırın. |
| average |
Puanları, tüm puanlama işlevi sonuçlarının ortalaması kadar artırın. |
| minimum |
Puanları, tüm puanlama işlevi sonuçlarının minimumu kadar artırın. |
| maximum |
Puanları, tüm puanlama işlevi sonuçlarının maksimumu kadar artırın. |
| firstMatching |
Puanlama profilinde ilk geçerli puanlama işlevini kullanarak puanları artırın. |
| product |
Tüm puanlama işlevi sonuçlarının çarpımına göre puanları artırın. |
ScoringFunctionInterpolation
Bir dizi belgede puan artırmayı enterpolasyon yapmak için kullanılan işlevi tanımlar.
| Değer | Description |
|---|---|
| linear |
Puanları doğrusal olarak azalan bir miktarda artırır. Bu, puanlama işlevleri için varsayılan enterpolasyondur. |
| constant |
Puanları sabit bir faktörle artırır. |
| quadratic |
Puanları ikinci dereceden azalan bir miktarda artırır. Takviyeler, daha yüksek puanlar için yavaş ve puanlar azaldıkça daha hızlı azalır. Bu enterpolasyon seçeneğine, etiket puanlama işlevlerinde izin verilmez. |
| logarithmic |
Puanları logaritmik olarak azalan bir miktarda artırır. Artışlar, daha yüksek puanlar için hızlı bir şekilde azalır ve puanlar azaldıkça daha yavaş azalır. Bu enterpolasyon seçeneğine, etiket puanlama işlevlerinde izin verilmez. |
ScoringProfile
Arama sorgularında puanlama işlemini etkileyen bir arama dizininin parametrelerini tanımlar.
| Name | Tür | Description |
|---|---|---|
| functionAggregation |
Tek tek puanlama işlevlerinin sonuçlarının nasıl birleştirilmesi gerektiğini gösteren bir değer. Varsayılan olarak "Toplam" kullanılır. Puanlama işlevi yoksa yoksayılır. |
|
| functions | ScoringFunction[]: |
Belgelerin puanlanmasını etkileyen işlevlerin toplamı. |
| name |
string |
Puanlama profilinin adı. |
| text |
Belirli dizin alanlarındaki metin eşleşmelerine dayalı olarak puanlamayı artıran parametreler. |
SearchField
Bir alanın adını, veri türünü ve arama davranışını açıklayan dizin tanımındaki bir alanı temsil eder.
| Name | Tür | Description |
|---|---|---|
| analyzer |
Alan için kullanılacak çözümleyicinin adı. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir ve searchAnalyzer veya indexAnalyzer ile birlikte ayarlanamaz. Çözümleyici seçildikten sonra alan için değiştirilemez. Karmaşık alanlar için null olmalıdır. |
|
| dimensions |
integer (int32) minimum: 2maximum: 4096 |
Vektör alanının boyutsallığı. |
| facetable |
boolean |
Model sorgularında alana başvurulmasının etkinleştirilip etkinleştirilmeymeyeceğini gösteren değer. Genellikle kategoriye göre isabet sayısını içeren arama sonuçlarının bir sunumunda kullanılır (örneğin, dijital kameraları arayın ve markaya göre, megapiksellere, fiyata vb. göre isabetleri görün). Bu özellik karmaşık alanlar için null olmalıdır. Edm.GeographyPoint veya Collection(Edm.GeographyPoint) türünde alanlar modellenemez. Varsayılan değer, diğer tüm basit alanlar için geçerlidir. |
| fields |
Bu Edm.ComplexType veya Collection(Edm.ComplexType) türünde bir alansa, alt alanların listesi. Basit alanlar için null veya boş olmalıdır. |
|
| filterable |
boolean |
$filter sorgularda alana başvurulmasının etkinleştirilip etkinleştirilmeymeyeceğini gösteren değer. filterable, dizelerin işlenme biçiminde aranabilirden farklıdır. Filtrelenebilir Edm.String veya Collection(Edm.String) türündeki alanlarda sözcük kesme işlemi yapılmaz, bu nedenle karşılaştırmalar yalnızca tam eşleşmeler içindir. Örneğin, f alanını "güneşli gün" olarak ayarlarsanız, $filter=f eq 'güneşli' eşleşme bulamaz, ancak $filter=f eq 'güneşli gün'. Bu özellik karmaşık alanlar için null olmalıdır. Varsayılan değer basit alanlar için doğru, karmaşık alanlar için null değeridir. |
| indexAnalyzer |
Alan için dizin oluşturma zamanında kullanılan çözümleyicinin adı. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir. SearchAnalyzer ile birlikte ayarlanmalıdır ve çözümleyici seçeneğiyle birlikte ayarlanamaz. Bu özellik bir dil çözümleyicisinin adına ayarlanamaz; dil çözümleyicisine ihtiyacınız varsa çözümleyici özelliğini kullanın. Çözümleyici seçildikten sonra alan için değiştirilemez. Karmaşık alanlar için null olmalıdır. |
|
| key |
boolean |
Alanın dizindeki belgeleri benzersiz olarak tanımlayıp tanımlamadığını gösteren değer. Her dizinde tam olarak bir üst düzey alan anahtar alanı olarak seçilmeli ve Edm.String türünde olmalıdır. Önemli alanlar, belgeleri doğrudan aramak ve belirli belgeleri güncelleştirmek veya silmek için kullanılabilir. Varsayılan değer, basit alanlar için false ve karmaşık alanlar için null değeridir. |
| name |
string |
Dizin veya üst alanın alan koleksiyonu içinde benzersiz olması gereken alanın adı. |
| normalizer |
Alan için kullanılacak normalleştiricinin adı. Bu seçenek yalnızca filtrelenebilir, sıralanabilir veya facetable özelliği etkinleştirilmiş alanlarla kullanılabilir. Normalleştirici seçildikten sonra, alan için değiştirilemez. Karmaşık alanlar için null olmalıdır. |
|
| retrievable |
boolean |
Alanın bir arama sonucunda döndürülebilir olup olmadığını gösteren değer. Bir alanı (örneğin, kenar boşluğu) filtre, sıralama veya puanlama mekanizması olarak kullanmak ancak alanın son kullanıcıya görünür olmasını istemiyorsanız bu seçeneği devre dışı bırakabilirsiniz. Bu özellik anahtar alanlar için true olmalı ve karmaşık alanlar için null olmalıdır. Bu özellik mevcut alanlarda değiştirilebilir. Bu özelliğin etkinleştirilmesi dizin depolama gereksinimlerinde herhangi bir artışa neden olmaz. Varsayılan değer basit alanlar için true, vektör alanları için false ve karmaşık alanlar için null değeridir. |
| searchAnalyzer |
Alan için arama zamanında kullanılan çözümleyicinin adı. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir. indexAnalyzer ile birlikte ayarlanmalıdır ve çözümleyici seçeneğiyle birlikte ayarlanamaz. Bu özellik bir dil çözümleyicisinin adına ayarlanamaz; dil çözümleyicisine ihtiyacınız varsa çözümleyici özelliğini kullanın. Bu çözümleyici mevcut bir alanda güncelleştirilebilir. Karmaşık alanlar için null olmalıdır. |
|
| searchable |
boolean |
Alanın tam metin aranabilir olup olmadığını gösteren değer. Bu, dizin oluşturma sırasında sözcük kesme gibi bir analizden geçeceği anlamına gelir. Aranabilir bir alanı "güneşli gün" gibi bir değere ayarlarsanız, dahili olarak "güneşli" ve "gün" belirteçlerine bölünür. Bu, bu terimler için tam metin aramaları sağlar. Edm.String veya Collection(Edm.String) türündeki alanlar varsayılan olarak aranabilir. Bu özellik, diğer dize olmayan veri türlerinin basit alanları için false olmalı ve karmaşık alanlar için null olmalıdır. Not: Aranabilir alanlar, tam metin aramaları için alan değerinin ek belirteçli sürümlerini barındırmak için dizininizde fazladan alan kullanır. Dizininizde yer kazanmak istiyorsanız ve aramalara bir alanın eklenmesi gerekmiyorsa, aranabilir değerini false olarak ayarlayın. |
| sortable |
boolean |
$orderby ifadelerinde alana başvurulmasının etkinleştirilip etkinleştirilmeymeyeceğini gösteren değer. Varsayılan olarak, arama altyapısı sonuçları puana göre sıralar, ancak birçok deneyimde kullanıcılar belgelerdeki alanlara göre sıralamak isteyecektir. Basit bir alan yalnızca tek değerliyse sıralanabilir (üst belge kapsamında tek bir değere sahiptir). Basit koleksiyon alanları çok değerli olduğundan sıralanabilir olamaz. Karmaşık koleksiyonların basit alt alanları da çok değerlidir ve bu nedenle sıralanamaz. Bu, ister doğrudan bir üst alan ister bir atalar alanı olsun, karmaşık koleksiyon budur. Karmaşık alanlar sıralanabilir olamaz ve bu tür alanlar için sıralanabilir özelliğin null olması gerekir. Sıralanabilir için varsayılan değer, tek değerli basit alanlar için doğru, çok değerli basit alanlar için false ve karmaşık alanlar için null değeridir. |
| stored |
boolean |
Alanın bir arama sonucunda döndürülmek üzere diskte ayrı olarak kalıcı olup olmayacağını gösteren sabit bir değer. Depolama ek yükünden tasarruf etmek için arama yanıtında alan içeriğini döndürmeyi planlamıyorsanız bu seçeneği devre dışı bırakabilirsiniz. Bu yalnızca dizin oluşturma sırasında ve yalnızca vektör alanları için ayarlanabilir. Bu özellik mevcut alanlar için değiştirilemez veya yeni alanlar için false olarak ayarlanamaz. Bu özellik false olarak ayarlanırsa, 'retrievable' özelliği de false olarak ayarlanmalıdır. Bu özellik anahtar alanlar, yeni alanlar ve vektör olmayan alanlar için true veya unset olmalı ve karmaşık alanlar için null olmalıdır. Bu özelliğin devre dışı bırakılması dizin depolama gereksinimlerini azaltır. Vektör alanları için varsayılan değer doğrudur. |
| synonymMaps |
string[] |
Bu alanla ilişkilendirilecek eş anlamlılar haritalarının isimlerinin listesi. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir. Şu anda alan başına yalnızca bir eş anlamlı eşleme desteklenir. Bir alana eş anlamlı eşlem atamak, bu alanı hedefleyen sorgu terimlerinin eş anlamlı eşlemedeki kurallar kullanılarak sorgu zamanında genişletilmesini sağlar. Bu öznitelik mevcut alanlarda değiştirilebilir. Karmaşık alanlar için null veya boş bir koleksiyon olmalıdır. |
| type |
Alanın veri türü. |
|
| vectorEncoding |
Alan içeriğini yorumlamak için kodlama biçimi. |
|
| vectorSearchProfile |
string |
Vektör alanında arama yaparken kullanılacak algoritmayı ve vektörleştiriciyi belirten vektör arama profilinin adı. |
SearchFieldDataType
Arama dizinindeki bir alanın veri türünü tanımlar.
| Değer | Description |
|---|---|
| Edm.String |
Bir alanın dize içerdiğini gösterir. |
| Edm.Int32 |
Bir alanın 32 bit imzalı bir tamsayı içerdiğini gösterir. |
| Edm.Int64 |
Bir alanın 64 bit imzalı bir tamsayı içerdiğini gösterir. |
| Edm.Double |
Bir alanın IEEE çift duyarlıklı kayan nokta numarası içerdiğini gösterir. |
| Edm.Boolean |
Bir alanın Boole değeri (true veya false) içerdiğini gösterir. |
| Edm.DateTimeOffset |
Bir alanın saat dilimi bilgileri de dahil olmak üzere bir tarih/saat değeri içerdiğini gösterir. |
| Edm.GeographyPoint |
Bir alanın boylam ve enlem açısından coğrafi konum içerdiğini gösterir. |
| Edm.ComplexType |
Bir alanın, başka türlerde alt alanları olan bir veya daha fazla karmaşık nesne içerdiğini gösterir. |
| Edm.Single |
Bir alanın tek duyarlıklı kayan nokta numarası içerdiğini gösterir. Bu yalnızca Collection(Edm.Single) ile kullanıldığında geçerlidir. |
| Edm.Half |
Bir alanın yarım duyarlıklı kayan nokta numarası içerdiğini gösterir. Bu yalnızca Collection(Edm.Half) ile kullanıldığında geçerlidir. |
| Edm.Int16 |
Bir alanın 16 bit imzalı bir tamsayı içerdiğini gösterir. Bu yalnızca Collection(Edm.Int16) ile kullanıldığında geçerlidir. |
| Edm.SByte |
Bir alanın 8 bit imzalı bir tamsayı içerdiğini gösterir. Bu yalnızca Collection(Edm.SByte) ile kullanıldığında geçerlidir. |
| Edm.Byte |
Bir alanın 8 bit işaretsiz tamsayı içerdiğini gösterir. Bu yalnızca Collection(Edm.Byte) ile kullanıldığında geçerlidir. |
SearchIndex
Bir dizinin alanlarını ve arama davranışını açıklayan bir arama dizini tanımını temsil eder.
| Name | Tür | Description |
|---|---|---|
| @odata.etag |
string |
Dizinin ETag'i. |
| analyzers | LexicalAnalyzer[]: |
Dizin için çözümleyiciler. |
| charFilters | CharFilter[]: |
Dizin için karakter filtreleri. |
| corsOptions |
Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçenekleri. |
|
| defaultScoringProfile |
string |
Sorguda belirtilmemişse kullanılacak puanlama profilinin adı. Bu özellik ayarlanmazsa ve sorguda puanlama profili belirtilmezse, varsayılan puanlama (tf-idf) kullanılır. |
| description |
string |
Dizinin açıklaması. |
| encryptionKey |
Azure Key Vault'ta oluşturduğunuz bir şifreleme anahtarının açıklaması. Bu anahtar, kimsenin, hatta Microsoft'un bile verilerinizi şifreleyemeyeceğine tam güvence vermek istediğinizde, verileriniz için ek bir şifreleme seviyesi sağlamak için kullanılır. Verilerinizi şifreledikten sonra her zaman şifrelenmiş olarak kalır. Arama hizmeti, bu özelliği null olarak ayarlama girişimlerini yoksayar. Şifreleme anahtarınızı döndürmek istiyorsanız bu özelliği gerektiği gibi değiştirebilirsiniz; Verileriniz etkilenmez. Müşteri tarafından yönetilen anahtarlarla şifreleme, ücretsiz arama hizmetlerinde kullanılamaz ve yalnızca 1 Ocak 2019 veya sonrasında oluşturulan ücretli hizmetler için kullanılabilir. |
|
| fields |
Dizinin alanları. |
|
| name |
string |
Dizinin adı. |
| normalizers | LexicalNormalizer[]: |
Dizin için normalleştiriciler. |
| scoringProfiles |
Dizin için puanlama profilleri. |
|
| semantic |
Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar. |
|
| similarity | SimilarityAlgorithm: |
Arama sorgusuyla eşleşen belgeleri puanlama ve derecelendirme sırasında kullanılacak benzerlik algoritmasının türü. Benzerlik algoritması yalnızca dizin oluşturma zamanında tanımlanabilir ve mevcut dizinlerde değiştirilemez. Null ise ClassicSimilarity algoritması kullanılır. |
| suggesters |
Dizin için öneride bulunanlar. |
|
| tokenFilters |
TokenFilter[]:
|
Belirteç, dizin için filtreler. |
| tokenizers | LexicalTokenizer[]: |
Dizin için belirteç oluşturucular. |
| vectorSearch |
Vektör araması ile ilgili yapılandırma seçeneklerini içerir. |
SearchIndexerDataNoneIdentity
Veri kaynağının kimlik özelliğini temizler.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Kimlik türünü belirten bir URI parçası. |
SearchIndexerDataUserAssignedIdentity
Kullanılacak veri kaynağının kimliğini belirtir.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Kimlik türünü belirten bir URI parçası. |
| userAssignedIdentity |
string |
Kullanıcı tarafından atanan yönetilen kimliğin tam Azure kaynak kimliği genellikle arama hizmetine atanması gereken "/subscriptions/12345678-1234-1234-1234-123467890ab/resourceGroups/rg/providers/Microsoft.ManagedIdentity/userAssignedIdentities/myId" biçimindedir. |
SearchResourceEncryptionKey
Azure Key Vault'ta müşteri tarafından yönetilen bir şifreleme anahtarı. Oluşturduğunuz ve yönettiğiniz anahtarlar, dizinler ve eş anlamlı eşlemeler gibi bekleyen verileri şifrelemek veya şifresini çözmek için kullanılabilir.
| Name | Tür | Description |
|---|---|---|
| accessCredentials.applicationId |
string |
Bekleyen verilerinizi şifrelerken kullanılacak Azure Key Vault'a gerekli erişim izinleri verilmiş bir AAD Uygulama Kimliği. Uygulama Kimliği, AAD Uygulamanızın Nesne Kimliği ile karıştırılmamalıdır. |
| accessCredentials.applicationSecret |
string |
Belirtilen AAD uygulamasının kimlik doğrulama anahtarı. |
| identity | SearchIndexerDataIdentity: |
Bu şifreleme anahtarı için kullanılacak açık bir yönetilen kimlik. Belirtilmezse ve erişim kimlik bilgileri özelliği null ise, sistem tarafından atanan yönetilen kimlik kullanılır. Kaynağa güncelleştirildiğinde, açık kimlik belirtilmezse değişmeden kalır. "Hiçbiri" belirtilirse, bu özelliğin değeri temizlenir. |
| keyVaultKeyName |
string |
Bekleyen verilerinizi şifrelemek için kullanılacak Azure Key Vault anahtarınızın adı. |
| keyVaultKeyVersion |
string |
Bekleyen verilerinizi şifrelemek için kullanılacak Azure Key Vault anahtarınızın sürümü. |
| keyVaultUri |
string |
Bekleyen verilerinizi şifrelemek için kullanılacak anahtarı içeren, DNS adı olarak da adlandırılan Azure Key Vault URI'sidir. Örnek bir URI |
SearchSuggester
Öneri API'sinin dizindeki bir alan grubuna nasıl uygulanacağını tanımlar.
| Name | Tür | Description |
|---|---|---|
| name |
string |
Önerenin adı. |
| searchMode |
enum:
analyzing |
Önerenin yeteneklerini gösteren bir değer. |
| sourceFields |
string[] |
Önerinin uygulandığı alan adlarının listesi. Her alan aranabilir olmalıdır. |
SemanticConfiguration
Anlamsal özellikler bağlamında kullanılacak belirli bir yapılandırmayı tanımlar.
| Name | Tür | Description |
|---|---|---|
| name |
string |
Anlamsal yapılandırmanın adı. |
| prioritizedFields |
Anlam derecelendirmesi, açıklamalı alt yazılar, vurgular ve yanıtlar için kullanılacak başlık, içerik ve anahtar sözcük alanlarını açıklar. Üç alt özellikten en az birinin (titleField, prioritizedKeywordsFields ve prioritizedContentFields) ayarlanması gerekir. |
|
| rankingOrder |
Arama sonuçlarının sıralama düzeni için kullanılacak puan türünü belirtir. |
SemanticField
Anlamsal yapılandırmanın bir parçası olarak kullanılan alan.
| Name | Tür | Description |
|---|---|---|
| fieldName |
string |
Dosya adı |
SemanticPrioritizedFields
Anlam derecelendirmesi, açıklamalı alt yazılar, vurgular ve yanıtlar için kullanılacak başlık, içerik ve anahtar sözcük alanlarını açıklar.
| Name | Tür | Description |
|---|---|---|
| prioritizedContentFields |
Anlamsal sıralama, başlıklar, vurgular ve yanıtlar için kullanılacak içerik alanlarını tanımlar. En iyi sonucu elde etmek için, seçilen alanların doğal dil biçiminde metin içermesi gerekir. Dizideki alanların sırası, önceliklerini temsil eder. İçerik uzunsa daha düşük önceliğe sahip alanlar kesilebilir. |
|
| prioritizedKeywordsFields |
Anlamsal sıralama, başlıklar, vurgular ve yanıtlar için kullanılacak anahtar kelime alanlarını tanımlar. En iyi sonucu elde etmek için, seçilen alanlar bir anahtar kelime listesi içermelidir. Dizideki alanların sırası, önceliklerini temsil eder. İçerik uzunsa daha düşük önceliğe sahip alanlar kesilebilir. |
|
| titleField |
Anlamsal sıralama, başlıklar, vurgular ve yanıtlar için kullanılacak başlık alanını tanımlar. Dizininizde bir başlık alanınız yoksa, bu alanı boş bırakın. |
SemanticSearch
Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar.
| Name | Tür | Description |
|---|---|---|
| configurations |
Dizin için anlamsal yapılandırmalar. |
|
| defaultConfiguration |
string |
Dizininizde varsayılan bir anlamsal yapılandırmanın adını ayarlamanıza olanak tanır ve her seferinde sorgu parametresi olarak geçirmeyi isteğe bağlı hale getirir. |
ShingleTokenFilter
Belirteç birleşimlerini tek bir belirteç olarak oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| filterToken |
string |
_ |
Belirtecin olmadığı her konum için eklenecek dize. Varsayılan, bir alt çizgidir ("_"). |
| maxShingleSize |
integer (int32) minimum: 2 |
2 |
Maksimum zona boyutu. Varsayılan ve en düşük değer 2'dir. |
| minShingleSize |
integer (int32) minimum: 2 |
2 |
En düşük zona boyutu. Varsayılan ve en düşük değer 2'dir. maxShingleSize değerinden küçük olmalıdır. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| outputUnigrams |
boolean |
True |
Çıkış akışının hem giriş belirteçlerini (tek birimleri) hem de zonaları içerip içermeyeceğini gösteren bir değer. Varsayılan değer doğrudur |
| outputUnigramsIfNoShingles |
boolean |
False |
Kullanılabilir zona olmadığı zamanlarda tek birimlerin çıkışını alıp almayacağını belirten bir değer. OutputUnigrams false olarak ayarlandığında bu özellik önceliklidir. Varsayılan değer false'tur. |
| tokenSeparator |
string |
Bir shingle oluşturmak için bitişik belirteçleri birleştirirken kullanılacak dize. Varsayılan değer tek bir boşluk (" ") şeklindedir. |
SnowballTokenFilter
Snowball tarafından oluşturulan kök ayırıcı kullanarak sözcüklerin köklerini oluşturan bir filtre. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| language |
Kullanılacak dil. |
|
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
SnowballTokenFilterLanguage
Snowball belirteç filtresi için kullanılacak dil.
| Değer | Description |
|---|---|
| armenian |
Ermenice için Lucene Snowball köklendirme tokenizer'ını seçer. |
| basque |
Bask için Lucene Snowball köklendirme tokenizer'ını seçer. |
| catalan |
Katalanca için Lucene Snowball köklendirme tokenizer'ını seçer. |
| danish |
Danca için Lucene Snowball köklendirme tokenizer'ını seçer. |
| dutch |
Felemenkçe için Lucene Snowball köklendirme tokenizer'ını seçer. |
| english |
İngilizce için Lucene Snowball köklendirme belirteç oluşturucusunu seçer. |
| finnish |
Fince için Lucene Snowball köklendirme tokenizer'ını seçer. |
| french |
Fransızca için Lucene Snowball köklendirme tokenizer'ını seçer. |
| german |
Almanca için Lucene Snowball köklendirme tokenizer'ını seçer. |
| german2 |
Alman varyant algoritmasını kullanan Lucene Snowball kök belirteç oluşturucusunu seçer. |
| hungarian |
Macarca için Lucene Snowball köklendirme tokenizer'ını seçer. |
| italian |
İtalyanca için Lucene Snowball köklendirme tokenizer'ını seçer. |
| kp |
Hollandaca için Kraaij-Pohlmann köklendirme algoritmasını kullanan Lucene Snowball köklendirme belirteçleyicisini seçer. |
| lovins |
Lovins köklendirme algoritmasını kullanan İngilizce için Lucene Snowball köklendirme belirteçleyicisini seçer. |
| norwegian |
Norveççe için Lucene Snowball köklendirme tokenizer'ını seçer. |
| porter |
Porter köklendirme algoritmasını kullanan İngilizce için Lucene Snowball köklendirme belirteçleyicisini seçer. |
| portuguese |
Portekizce için Lucene Snowball köklendirme belirteç oluşturucusunu seçer. |
| romanian |
Romence için Lucene Snowball köklendirme tokenizer'ını seçer. |
| russian |
Rusça için Lucene Snowball köklendirme tokenizer'ını seçer. |
| spanish |
İspanyolca için Lucene Snowball köklendirme tokenizer'ını seçer. |
| swedish |
İsveççe için Lucene Snowball köklendirme tokenizer'ını seçer. |
| turkish |
Türkçe için Lucene Snowball köklendirme tokenizer'ını seçer. |
StemmerOverrideTokenFilter
Özel sözlük tabanlı kök oluşturma ile diğer kök filtreleme filtrelerini geçersiz kılma olanağı sağlar. Sözlük köküne sahip terimler anahtar sözcük olarak işaretlenir, böylece zincirdeki kök ayırıcılarla kaynaklanmaz. Herhangi bir köklendirme filtresinin önüne yerleştirilmelidir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/StemmerOverrideFilter.html
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
| rules |
string[] |
Şu biçimdeki kök oluşturma kurallarının listesi: "word => stem", örneğin: "ran => run". |
StemmerTokenFilter
Dile özgü gövde filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#TokenFilters
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| language |
Kullanılacak dil. |
|
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
StemmerTokenFilterLanguage
Stemmer belirteç filtresi için kullanılacak dil.
| Değer | Description |
|---|---|
| arabic |
Arapça için Lucene köklendirme belirteç oluşturucusunu seçer. |
| armenian |
Ermenice için Lucene kök tokenizer'ı seçer. |
| basque |
Bask için Lucene köklendirme tokenizer'ını seçer. |
| brazilian |
Portekizce (Brezilya) için Lucene köklendirme tokenizer'ını seçer. |
| bulgarian |
Bulgarca için Lucene köklendirme tokenizer'ını seçer. |
| catalan |
Katalanca için Lucene köklendirme tokenizer'ını seçer. |
| czech |
Çekçe için Lucene köklendirme tokenizer'ını seçer. |
| danish |
Danca için Lucene köklendirme tokenizer'ını seçer. |
| dutch |
Felemenkçe için Lucene köklendirme tokenizer'ını seçer. |
| dutchKp |
Hollandaca için Kraaij-Pohlmann köklendirme algoritmasını kullanan Lucene köklendirme belirteçleyicisini seçer. |
| english |
İngilizce için Lucene köklendirme tokenizer'ını seçer. |
| lightEnglish |
İngilizce için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| minimalEnglish |
Minimum köklendirme yapan İngilizce için Lucene köklendirme belirteçleyicisini seçer. |
| possessiveEnglish |
Sözcüklerden sondaki iyelik eklerini kaldıran İngilizce için Lucene köklendirme belirteçleyicisini seçer. |
| porter2 |
Porter2 köklendirme algoritmasını kullanan İngilizce için Lucene köklendirme belirteçleyicisini seçer. |
| lovins |
Lovins köklendirme algoritmasını kullanan İngilizce için Lucene köklendirme belirteçleyicisini seçer. |
| finnish |
Fince için Lucene köklendirme tokenizer'ını seçer. |
| lightFinnish |
Fince için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| french |
Fransızca için Lucene köklendirme tokenizer'ını seçer. |
| lightFrench |
Fransızca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| minimalFrench |
Fransızca için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| galician |
Galiçya dili için Lucene kök tokenizer'ı seçer. |
| minimalGalician |
Galiçya dili için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| german |
Almanca için Lucene köklendirme tokenizer'ını seçer. |
| german2 |
Alman varyant algoritmasını kullanan Lucene kök tokenizer'ı seçer. |
| lightGerman |
Almanca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| minimalGerman |
Almanca için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| greek |
Yunanca için Lucene köklendirme tokenizer'ını seçer. |
| hindi |
Hintçe için Lucene köklendirme belirteç oluşturucusunu seçer. |
| hungarian |
Macarca için Lucene köklendirme tokenizer'ını seçer. |
| lightHungarian |
Macarca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| indonesian |
Endonezce için Lucene köklendirme tokenizer'ını seçer. |
| irish |
İrlandaca için Lucene köklendirme tokenizer'ını seçer. |
| italian |
İtalyanca için Lucene köklendirme tokenizer'ını seçer. |
| lightItalian |
İtalyanca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| sorani |
Sorani için Lucene köklendirme tokenizer'ını seçer. |
| latvian |
Letonca için Lucene köklendirme tokenizer'ını seçer. |
| norwegian |
Norwegian (BokmÃ¥l) için Lucene stemming tokenizer seçer. |
| lightNorwegian |
Norveççe için Lucene köklü tokenizer'ı seçer (BokmÅl), hafif kök yapma yapar. |
| minimalNorwegian |
Norveççe için (BokmÃ¥l) için minimal stemming yapan Lucene stemming tokenizer'ı seçer. |
| lightNynorsk |
Hafif köklendirme yapan Norveççe (Nynorsk) için Lucene köklendirme belirteçleyicisini seçer. |
| minimalNynorsk |
Minimum köklendirme yapan Norveççe (Nynorsk) için Lucene köklendirme tokenizer'ını seçer. |
| portuguese |
Portekizce için Lucene köklendirme tokenizer'ını seçer. |
| lightPortuguese |
Portekizce için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| minimalPortuguese |
Portekizce için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| portugueseRslp |
RSLP köklendirme algoritmasını kullanan Portekizce için Lucene köklendirme belirteçleyicisini seçer. |
| romanian |
Romence için Lucene köklendirme tokenizer'ını seçer. |
| russian |
Rusça için Lucene köklendirme tokenizer'ını seçer. |
| lightRussian |
Rusça için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| spanish |
İspanyolca için Lucene köklendirme tokenizer'ını seçer. |
| lightSpanish |
İspanyolca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| swedish |
İsveççe için Lucene köklendirme tokenizer'ını seçer. |
| lightSwedish |
İsveççe için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer. |
| turkish |
Türkçe için Lucene köklendirme tokenizer'ını seçer. |
StopAnalyzer
Metni harf olmayanlara böler; Küçük harf ve stopword belirteci filtrelerini uygular. Bu çözümleyici Apache Lucene kullanılarak uygulanır.
| Name | Tür | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
| name |
string |
Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
| stopwords |
string[] |
Stopwords listesi. |
StopwordsList
Dile özgü durdurma sözcüklerinin önceden tanımlanmış bir listesini tanımlar.
| Değer | Description |
|---|---|
| arabic |
Arapça için durdurma sözcüğü listesini seçer. |
| armenian |
Ermenice için durdurma sözcüğü listesini seçer. |
| basque |
Bask için durdurma sözcüğü listesini seçer. |
| brazilian |
Portekizce (Brezilya) için stopword listesini seçer. |
| bulgarian |
Bulgarca için durdurma sözcüğü listesini seçer. |
| catalan |
Katalanca için durdurma sözcüğü listesini seçer. |
| czech |
Çekçe için durdurma sözcüğü listesini seçer. |
| danish |
Danca için durdurma sözcüğü listesini seçer. |
| dutch |
Felemenkçe için durdurma sözcüğü listesini seçer. |
| english |
İngilizce için durdurma sözcüğü listesini seçer. |
| finnish |
Fince için durdurma sözcüğü listesini seçer. |
| french |
Fransızca için durdurma sözcüğü listesini seçer. |
| galician |
Galiçyaca için durdurma sözcüğü listesini seçer. |
| german |
Almanca için durdurma sözcüğü listesini seçer. |
| greek |
Yunanca için durdurma sözcüğü listesini seçer. |
| hindi |
Hintçe için durdurma sözcüğü listesini seçer. |
| hungarian |
Macarca için durdurma sözcüğü listesini seçer. |
| indonesian |
Endonezce için durdurma sözcüğü listesini seçer. |
| irish |
İrlandaca için durdurma sözcüğü listesini seçer. |
| italian |
İtalyanca için durdurma sözcüğü listesini seçer. |
| latvian |
Letonca için durdurma sözcüğü listesini seçer. |
| norwegian |
Norveççe için durdurma sözcüğü listesini seçer. |
| persian |
Farsça için durdurma sözcüğü listesini seçer. |
| portuguese |
Portekizce için durdurma sözcüğü listesini seçer. |
| romanian |
Romence için durdurma sözcüğü listesini seçer. |
| russian |
Rusça için durdurma sözcüğü listesini seçer. |
| sorani |
Sorani için durdurma sözcüğü listesini seçer. |
| spanish |
İspanyolca için durdurma sözcüğü listesini seçer. |
| swedish |
İsveççe için durdurma sözcüğü listesini seçer. |
| thai |
Tay dili için durdurma sözcüğü listesini seçer. |
| turkish |
Türkçe için durdurma sözcüğü listesini seçer. |
StopwordsTokenFilter
Belirteç akışından duraklama sözcüklerini kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopFilter.html
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| ignoreCase |
boolean |
False |
Büyük/küçük harf yoksayılıp yoksayılmayacağını belirten bir değer. True ise, önce tüm sözcükler küçük harfe dönüştürülür. Varsayılan değer false'tur. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| removeTrailing |
boolean |
True |
Bir durdurma sözcüğüyse son arama teriminin yoksayılıp yoksayılmayacağını belirten değer. Varsayılan değer doğrudur |
| stopwords |
string[] |
Stopwords listesi. Bu özellik ve stopwords listesi özelliği ayarlanamaz. |
|
| stopwordsList | english |
Kullanılacak önceden tanımlanmış bir stopword listesi. Bu özellik ve stopwords özelliği ayarlanamaz. Varsayılan değer İngilizce'dir. |
SynonymTokenFilter
Belirteç akışındaki tek veya çok sözcüklü eş anlamlılarla eşleşir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| expand |
boolean |
True |
Eş anlamlılar listesindeki tüm sözcüklerin (eğer => gösterimi kullanılmazsa) birbiriyle eşlenip eşlenmediğini gösteren bir değer. True ise, eş anlamlılar listesindeki tüm sözcükler (eğer => gösterimi kullanılmazsa) birbiriyle eşlenir. Aşağıdaki liste: inanılmaz, inanılmaz, muhteşem, şaşırtıcı eşdeğerdir: inanılmaz, inanılmaz, muhteşem, şaşırtıcı => inanılmaz, inanılmaz, muhteşem, şaşırtıcı. False ise, şu liste: inanılmaz, inanılmaz, muhteşem, şaşırtıcı şunun eşdeğeri olacaktır: inanılmaz, inanılmaz, muhteşem, şaşırtıcı => inanılmaz. Varsayılan değer doğrudur |
| ignoreCase |
boolean |
False |
Eşleştirme için büyük/küçük harfe katlanmış girişin yapılıp yapılmayacağını gösteren değer. Varsayılan değer false'tur. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| synonyms |
string[] |
İki biçimden birini izleyen eş anlamlıların listesi: 1. inanılmaz, inanılmaz, muhteşem => şaşırtıcı - => simgesinin sol tarafındaki tüm terimler sağ tarafındaki tüm terimlerle değiştirilecek; 2. inanılmaz, inanılmaz, muhteşem, şaşırtıcı - eşdeğer sözcüklerin virgülle ayrılmış listesi. Bu listenin yorumlandığı şekli değiştirmek için genişletme seçeneğini ayarlayın. |
TagScoringFunction
Belirli bir etiket listesiyle eşleşen dize değerleriyle belge puanlarını artıran bir işlev tanımlar.
| Name | Tür | Description |
|---|---|---|
| boost |
number (double) |
Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır. |
| fieldName |
string |
Puanlama işlevine giriş olarak kullanılan alanın adı. |
| interpolation |
Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır. |
|
| tag |
Etiket puanlama işlevi için parametre değerleri. |
|
| type |
string:
tag |
ScoringFunction türü. |
TagScoringParameters
Etiket puanlama işlevine parametre değerleri sağlar.
| Name | Tür | Description |
|---|---|---|
| tagsParameter |
string |
Hedef alanla karşılaştırılacak etiketlerin listesini belirtmek için arama sorgularında geçirilen parametrenin adı. |
TextWeights
Eşleşmelerin arama sorgularında puanlamanın artırılması gereken dizin alanlarında ağırlıkları tanımlar.
| Name | Tür | Description |
|---|---|---|
| weights |
object |
Belge puanlamasını artırmak için alan başına ağırlıklar sözlüğü. Anahtarlar alan adlarıdır ve değerler her alanın ağırlıklarıdır. |
TokenCharacterKind
Belirteç filtresinin üzerinde çalışabileceği karakter sınıflarını temsil eder.
| Değer | Description |
|---|---|
| letter |
Harfleri jeton halinde tutar. |
| digit |
Rakamları jetonlarda tutar. |
| whitespace |
Boşlukları belirteçlerde tutar. |
| punctuation |
Noktalama işaretlerini belirteçlerde tutar. |
| symbol |
Sembolleri jetonlarda tutar. |
TokenFilterName
Arama motoru tarafından desteklenen tüm belirteç filtrelerinin adlarını tanımlar.
TruncateTokenFilter
Terimleri belirli bir uzunlukta kısaltın. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| length |
integer (int32) maximum: 300 |
300 |
Koşulların kesileceği uzunluk. Varsayılan ve maksimum değer 300'dür. |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
UaxUrlEmailTokenizer
URL'ler ve e-postalar tek bir belirteç olacak şekilde işlenir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| maxTokenLength |
integer (int32) maximum: 300 |
255 |
En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. |
| name |
string |
Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
UniqueTokenFilter
Önceki belirteçle aynı metindeki belirteçleri filtreler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| onlyOnSamePosition |
boolean |
False |
Yinelenenlerin yalnızca aynı konumda kaldırılıp kaldırılmayacağını gösteren bir değer. Varsayılan değer false'tur. |
VectorEncodingFormat
Vektör alanı içeriklerini yorumlamak için kodlama biçimi.
| Değer | Description |
|---|---|
| packedBit |
Daha geniş bir veri türüne paketlenmiş bitleri temsil eden kodlama biçimi. |
VectorSearch
Vektör araması ile ilgili yapılandırma seçeneklerini içerir.
| Name | Tür | Description |
|---|---|---|
| algorithms | VectorSearchAlgorithmConfiguration[]: |
Dizin oluşturma veya sorgulama sırasında kullanılan algoritmaya özgü yapılandırma seçeneklerini içerir. |
| compressions | VectorSearchCompression[]: |
Dizin oluşturma veya sorgulama sırasında kullanılan sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir. |
| profiles |
Vektör araması ile kullanılacak yapılandırma birleşimlerini tanımlar. |
|
| vectorizers | VectorSearchVectorizer[]: |
Metin vektör sorgularını vektörleştirmeye ilişkin yapılandırma seçeneklerini içerir. |
VectorSearchAlgorithmKind
Dizin oluşturma ve sorgulama için kullanılan algoritma.
| Değer | Description |
|---|---|
| hnsw |
HNSW (Hiyerarşik Gezinilebilir Küçük Dünya), yaklaşık en yakın komşular algoritması türü. |
| exhaustiveKnn |
Deneme yanılma araması yapacak kapsamlı KNN algoritması. |
VectorSearchAlgorithmMetric
Vektör karşılaştırmaları için kullanılacak benzerlik metriği. Ekleme modelinin eğitildiği benzerlik metriğinin seçilmesi önerilir.
| Değer | Description |
|---|---|
| cosine |
Benzerliklerini ölçmek için vektörler arasındaki açıyı ölçer ve büyüklüğünü göz ardı eder. Açı ne kadar küçük olursa benzerlik de o kadar yakın olur. |
| euclidean |
Çok boyutlu bir alanda vektörler arasındaki düz çizgi mesafesini hesaplar. Mesafe ne kadar küçük olursa benzerlik de o kadar yakın olur. |
| dotProduct |
Hizalamayı ve büyüklük benzerliğini ölçmek için elemana göre ürünlerin toplamını hesaplar. Ne kadar büyük ve daha pozitif olursa benzerlik o kadar yakın olur. |
| hamming |
Yalnızca bit dolu ikili veri türleri için geçerlidir. İkili vektörlerdeki farklı konumları sayarak eşitsizliği belirler. Ne kadar az fark olursa benzerlik o kadar yakın olur. |
VectorSearchCompressionKind
Dizin oluşturma ve sorgulama için kullanılan sıkıştırma yöntemi.
| Değer | Description |
|---|---|
| scalarQuantization |
Skaler Niceleme, bir sıkıştırma yöntemi türüdür. Skaler nicelemede, özgün vektör değerleri daha dar bir türe sıkıştırılır ve azaltılmış bir nicelenmiş değer kümesi kullanılarak vektörün her bileşenini ayrık hale getirerek ve temsil ederek genel veri boyutunu küçültür. |
| binaryQuantization |
İkili Niceleme, bir sıkıştırma yöntemi türüdür. İkili nicelemede özgün vektör değerleri, ikili değerler kullanılarak bir vektördeki her bileşeni ayrıklaştırıp temsil ederek daha dar ikili türe sıkıştırılır ve böylece genel veri boyutu küçültülebilir. |
VectorSearchCompressionTarget
Sıkıştırılmış vektör değerlerinin nicelleştirilmiş veri türü.
| Değer | Description |
|---|---|
| int8 |
8 bit işaretli tamsayı. |
VectorSearchProfile
Vektör araması ile kullanılacak yapılandırmaların bir bileşimini tanımlar.
| Name | Tür | Description |
|---|---|---|
| algorithm |
string |
Algoritmayı ve isteğe bağlı parametreleri belirten vektör arama algoritması yapılandırmasının adı. |
| compression |
string |
Sıkıştırma yöntemini ve isteğe bağlı parametreleri belirten sıkıştırma yöntemi yapılandırmasının adı. |
| name |
string |
Bu belirli vektör arama profiliyle ilişkilendirilecek ad. |
| vectorizer |
string |
Vektör aramasıyla kullanılmak üzere yapılandırılan vektörleştirmenin adı. |
VectorSearchVectorizerKind
Sorgu sırasında kullanılacak vektörleştirme yöntemi.
| Değer | Description |
|---|---|
| azureOpenAI |
Sorgu zamanında bir Azure OpenAI kaynağı kullanarak eklemeler oluşturun. |
| customWebApi |
Sorgu zamanında özel bir web uç noktası kullanarak eklemeler oluşturun. |
| aiServicesVision |
Azure AI Services Vision Vectorize API'sini kullanarak sorgu zamanında bir görüntü veya metin girişi için eklemeler oluşturun. |
| aml |
Sorgu zamanında Azure Yapay Zeka Atölyesi Model Kataloğu aracılığıyla dağıtılan bir Azure Machine Learning uç noktası kullanarak eklemeler oluşturun. |
WebApiVectorizer
Bir sorgu dizesinin vektör eklemesini oluşturmak için kullanıcı tanımlı bir vektörleştirici belirtir. Bir beceri kümesinin özel Web API arabirimi kullanılarak dış vektörleştiricinin tümleştirilmesi sağlanır.
| Name | Tür | Description |
|---|---|---|
| customWebApiParameters |
Kullanıcı tanımlı vektörleştiricinin özelliklerini belirtir. |
|
| kind |
string:
custom |
VectorSearchVectorizer türü. |
| name |
string |
Bu özel vektörleştirme yöntemiyle ilişkilendirilecek ad. |
WebApiVectorizerParameters
Kullanıcı tanımlı vektörleştiriciye bağlanma özelliklerini belirtir.
| Name | Tür | Description |
|---|---|---|
| authIdentity | SearchIndexerDataIdentity: |
Giden bağlantılar için kullanılan kullanıcı tarafından atanan yönetilen kimlik. Bir authResourceId sağlanırsa ve belirtilmezse, sistem tarafından atanan yönetilen kimlik kullanılır. Dizin oluşturucu güncelleştirmelerinde kimlik belirtilmezse değer değişmeden kalır. "Yok" olarak ayarlanırsa, bu özelliğin değeri temizlenir. |
| authResourceId |
string |
Dönüşümleri sağlayan bir Azure fonksiyonunda veya başka bir uygulamada harici koda bağlanan özel uç noktalar için geçerlidir. Bu değer, Azure Active Directory'ye kaydedildiğinde işlev veya uygulama için oluşturulan uygulama kimliği olmalıdır. Belirtildiğinde, vektörleştirme, arama hizmetinin yönetilen kimliğini (sistem veya kullanıcı tarafından atanan) ve işlevin veya uygulamanın erişim belirtecini kullanarak işleve veya uygulamaya bağlanır ve bu değeri erişim belirtecinin kapsamını oluşturmak için kaynak kimliği olarak kullanır. |
| httpHeaders |
object |
HTTP isteğinde bulunmak için gereken üst bilgiler. |
| httpMethod |
string |
HTTP isteğinin yöntemi. |
| timeout |
string (duration) |
İstek için istenen zaman aşımı. Varsayılan değer 30 saniyedir. |
| uri |
string (uri) |
Vektörleştiriciyi sağlayan Web API'sinin URI'si. |
WordDelimiterTokenFilter
Sözcükleri alt sözcüklere böler ve alt sözcük gruplarında isteğe bağlı dönüştürmeler gerçekleştirir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.
| Name | Tür | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Türetilmiş türler için ayrımcı. |
|
| catenateAll |
boolean |
False |
Tüm alt parçaların katılmış olup olmayacağını gösteren bir değer. Örneğin, bu true olarak ayarlanırsa, "Azure-Search-1" "AzureSearch1" olur. Varsayılan değer false'tur. |
| catenateNumbers |
boolean |
False |
Sayı parçalarının en fazla çalıştırılıp çalıştırılmayacağını gösteren bir değer. Örneğin, bu true olarak ayarlanırsa, "1-2" "12" olur. Varsayılan değer false'tur. |
| catenateWords |
boolean |
False |
Sözcük bölümlerinin en fazla çalıştırılıp çalıştırılmayacağını gösteren değer. Örneğin, bu true olarak ayarlanırsa, "Azure-Search" "AzureSearch" olur. Varsayılan değer false'tur. |
| generateNumberParts |
boolean |
True |
Sayı alt sözcüğü oluşturulup oluşturulmayacağını gösteren değer. Varsayılan değer doğrudur |
| generateWordParts |
boolean |
True |
Parça sözcükleri oluşturulup oluşturulmayacağını gösteren bir değer. Ayarlanırsa, sözcük parçalarının oluşturulmasına neden olur; Örneğin, "AzureSearch" "Azure" "Search" olur. Varsayılan değer doğrudur |
| name |
string |
Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır. |
|
| preserveOriginal |
boolean |
False |
Özgün sözcüklerin korunup korunmayacağını ve alt sözcük listesine eklenip eklenmeyeceğini gösteren değer. Varsayılan değer false'tur. |
| protectedWords |
string[] |
Sınırlandırılmaktan korunmak için belirteçlerin listesi. |
|
| splitOnCaseChange |
boolean |
True |
caseChange üzerinde sözcüklerin bölünip bölünmeyeceğini belirten bir değer. Örneğin, bu true olarak ayarlanırsa, "AzureSearch" "Azure" "Search" olur. Varsayılan değer doğrudur |
| splitOnNumerics |
boolean |
True |
Sayılara bölünip bölünmeyeceğini gösteren bir değer. Örneğin, bu true olarak ayarlanırsa, "Azure1Search" "Azure" "1" "Search" olur. Varsayılan değer doğrudur |
| stemEnglishPossessive |
boolean |
True |
Her alt kelime için sondaki "'leri" kaldırılıp kaldırılmayacağını belirten bir değer. Varsayılan değer doğrudur |