Indexes - Create

Yeni bir arama dizini oluşturur.

POST {endpoint}/indexes?api-version=2026-04-01

URI Parametreleri

Name İçinde Gerekli Tür Description
endpoint
path True

string (uri)

Arama hizmetinin uç nokta URL'si.

api-version
query True

string

minLength: 1

Bu işlem için kullanılacak API sürümü.

İstek Başlığı

Name Gerekli Tür Description
Accept

Accept

Kabul Et başlığı.

x-ms-client-request-id

string (uuid)

İstek için opak, genel olarak benzersiz, istemci tarafından oluşturulan bir dize tanımlayıcısı.

İstek Gövdesi

Name Gerekli Tür Description
fields True

SearchField[]

Dizinin alanları.

name True

string

Dizinin adı.

@odata.etag

string

Dizinin ETag'i.

analyzers LexicalAnalyzer[]:

Dizin için çözümleyiciler.

charFilters CharFilter[]:

Dizin için karakter filtreleri.

corsOptions

CorsOptions

Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçenekleri.

defaultScoringProfile

string

Sorguda belirtilmemişse kullanılacak puanlama profilinin adı. Bu özellik ayarlanmazsa ve sorguda puanlama profili belirtilmezse, varsayılan puanlama (tf-idf) kullanılır.

description

string

Dizinin açıklaması.

encryptionKey

SearchResourceEncryptionKey

Azure Key Vault'ta oluşturduğunuz bir şifreleme anahtarının açıklaması. Bu anahtar, kimsenin, hatta Microsoft'un bile verilerinizi şifreleyemeyeceğine tam güvence vermek istediğinizde, verileriniz için ek bir şifreleme seviyesi sağlamak için kullanılır. Verilerinizi şifreledikten sonra her zaman şifrelenmiş olarak kalır. Arama hizmeti, bu özelliği null olarak ayarlama girişimlerini yoksayar. Şifreleme anahtarınızı döndürmek istiyorsanız bu özelliği gerektiği gibi değiştirebilirsiniz; Verileriniz etkilenmez. Müşteri tarafından yönetilen anahtarlarla şifreleme, ücretsiz arama hizmetlerinde kullanılamaz ve yalnızca 1 Ocak 2019 veya sonrasında oluşturulan ücretli hizmetler için kullanılabilir.

normalizers LexicalNormalizer[]:

CustomNormalizer[]

Dizin için normalleştiriciler.

scoringProfiles

ScoringProfile[]

Dizin için puanlama profilleri.

semantic

SemanticSearch

Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar.

similarity SimilarityAlgorithm:

Arama sorgusuyla eşleşen belgeleri puanlama ve derecelendirme sırasında kullanılacak benzerlik algoritmasının türü. Benzerlik algoritması yalnızca dizin oluşturma zamanında tanımlanabilir ve mevcut dizinlerde değiştirilemez. Null ise ClassicSimilarity algoritması kullanılır.

suggesters

SearchSuggester[]

Dizin için öneride bulunanlar.

tokenFilters TokenFilter[]:

Belirteç, dizin için filtreler.

tokenizers LexicalTokenizer[]:

Dizin için belirteç oluşturucular.

vectorSearch

VectorSearch

Vektör araması ile ilgili yapılandırma seçeneklerini içerir.

Yanıtlar

Name Tür Description
201 Created

SearchIndex

İstek başarılı oldu ve sonuç olarak yeni bir kaynak oluşturuldu.

Other Status Codes

ErrorResponse

Beklenmeyen bir hata yanıtı.

Güvenlik

api-key

Tür: apiKey
İçinde: header

OAuth2Auth

Tür: oauth2
Akış: implicit
Yetkilendirme URL’si: https://login.microsoftonline.com/common/oauth2/v2.0/authorize

Kapsamlar

Name Description
https://search.azure.com/.default

Örnekler

SearchServiceCreateIndex

Örnek isteği

POST https://exampleservice.search.windows.net/indexes?api-version=2026-04-01


{
  "name": "temp-example-index",
  "description": "description",
  "fields": [
    {
      "name": "id",
      "type": "Edm.String",
      "key": true,
      "sortable": true
    },
    {
      "name": "vector1",
      "type": "Collection(Edm.Single)",
      "retrievable": true,
      "searchable": true,
      "dimensions": 20,
      "vectorSearchProfile": "config1"
    },
    {
      "name": "vector1b",
      "type": "Collection(Edm.Single)",
      "retrievable": true,
      "searchable": true,
      "dimensions": 10,
      "vectorSearchProfile": "config2"
    },
    {
      "name": "vector2",
      "type": "Collection(Edm.Single)",
      "retrievable": true,
      "searchable": true,
      "dimensions": 5,
      "vectorSearchProfile": "config3"
    },
    {
      "name": "vector3",
      "type": "Collection(Edm.Single)",
      "retrievable": true,
      "searchable": true,
      "dimensions": 5,
      "vectorSearchProfile": "config3"
    },
    {
      "name": "vector22",
      "type": "Collection(Edm.Single)",
      "retrievable": true,
      "searchable": true,
      "dimensions": 10,
      "vectorSearchProfile": "config2"
    },
    {
      "name": "vector4",
      "type": "Collection(Edm.Single)",
      "retrievable": true,
      "searchable": true,
      "dimensions": 32,
      "vectorSearchProfile": "config4"
    },
    {
      "name": "name",
      "type": "Edm.String",
      "retrievable": true,
      "searchable": true,
      "filterable": true,
      "sortable": true,
      "facetable": true,
      "analyzer": "en.lucene"
    },
    {
      "name": "description",
      "type": "Edm.String",
      "retrievable": true,
      "searchable": true,
      "filterable": true,
      "sortable": true,
      "facetable": true,
      "analyzer": "standard.lucene"
    },
    {
      "name": "category",
      "type": "Edm.String",
      "retrievable": true,
      "searchable": true,
      "filterable": true,
      "sortable": true,
      "facetable": true,
      "analyzer": "en.lucene"
    },
    {
      "name": "ownerId",
      "type": "Edm.String",
      "retrievable": true,
      "searchable": true,
      "filterable": true,
      "sortable": true,
      "facetable": true,
      "analyzer": "en.lucene"
    },
    {
      "name": "price",
      "type": "Edm.Double",
      "retrievable": true,
      "filterable": true,
      "sortable": true,
      "facetable": true
    }
  ],
  "scoringProfiles": [
    {
      "name": "stringFieldBoost",
      "text": {
        "weights": {
          "name": 3,
          "description": 1,
          "category": 2,
          "ownerId": 1
        }
      },
      "functions": [
        {
          "tag": {
            "tagsParameter": "categoryTag"
          },
          "type": "tag",
          "fieldName": "category",
          "boost": 2
        }
      ]
    }
  ],
  "defaultScoringProfile": "stringFieldBoost",
  "corsOptions": {
    "allowedOrigins": [
      "https://www.example.com/foo"
    ],
    "maxAgeInSeconds": 10
  },
  "suggesters": [
    {
      "name": "sg",
      "searchMode": "analyzingInfixMatching",
      "sourceFields": [
        "category",
        "ownerId"
      ]
    }
  ],
  "analyzers": [
    {
      "tokenizer": "standard_v2",
      "tokenFilters": [
        "common_grams"
      ],
      "charFilters": [
        "html_strip"
      ],
      "@odata.type": "#Microsoft.Azure.Search.CustomAnalyzer",
      "name": "tagsAnalyzer"
    }
  ],
  "tokenizers": [
    {
      "maxTokenLength": 100,
      "@odata.type": "#Microsoft.Azure.Search.StandardTokenizerV2",
      "name": "my_tokenizer"
    }
  ],
  "tokenFilters": [
    {
      "preserveOriginal": false,
      "@odata.type": "#Microsoft.Azure.Search.AsciiFoldingTokenFilter",
      "name": "my_tokenFilter"
    }
  ],
  "charFilters": [
    {
      "mappings": [
        ".=>,",
        "_=>-"
      ],
      "@odata.type": "#Microsoft.Azure.Search.MappingCharFilter",
      "name": "my_mapping"
    }
  ],
  "normalizers": [
    {
      "tokenFilters": [
        "my_tokenFilter"
      ],
      "charFilters": [
        "my_mapping"
      ],
      "@odata.type": "#Microsoft.Azure.Search.CustomNormalizer",
      "name": "my_normalizer"
    }
  ],
  "similarity": {
    "k1": 10,
    "b": 0.1,
    "@odata.type": "#Microsoft.Azure.Search.BM25Similarity"
  },
  "semantic": {
    "defaultConfiguration": "testconfig",
    "configurations": [
      {
        "name": "testconfig",
        "prioritizedFields": {
          "titleField": {
            "fieldName": "category"
          },
          "prioritizedContentFields": [
            {
              "fieldName": "description"
            }
          ],
          "prioritizedKeywordsFields": [
            {
              "fieldName": "ownerId"
            }
          ]
        },
        "rankingOrder": "BoostedRerankerScore"
      }
    ]
  },
  "vectorSearch": {
    "profiles": [
      {
        "name": "config1",
        "algorithm": "cosine",
        "vectorizer": "openai",
        "compression": "mySQ8"
      },
      {
        "name": "config2",
        "algorithm": "euclidean",
        "vectorizer": "custom-web-api",
        "compression": "mySQ8"
      },
      {
        "name": "config3",
        "algorithm": "dotProduct",
        "vectorizer": "custom-web-api",
        "compression": "myBQC"
      },
      {
        "name": "config4",
        "algorithm": "dotProduct",
        "vectorizer": "custom-web-api",
        "compression": "myBQWithoutOriginals"
      }
    ],
    "algorithms": [
      {
        "hnswParameters": {
          "metric": "cosine"
        },
        "name": "cosine",
        "kind": "hnsw"
      },
      {
        "hnswParameters": {
          "metric": "euclidean"
        },
        "name": "euclidean",
        "kind": "hnsw"
      },
      {
        "hnswParameters": {
          "metric": "dotProduct"
        },
        "name": "dotProduct",
        "kind": "hnsw"
      }
    ],
    "vectorizers": [
      {
        "azureOpenAIParameters": {
          "resourceUri": "https://test-sample.openai.azure.com/",
          "deploymentId": "model",
          "apiKey": "api-key",
          "modelName": "text-embedding-3-large"
        },
        "name": "openai",
        "kind": "azureOpenAI"
      },
      {
        "customWebApiParameters": {
          "uri": "https://my-custom-endpoint.org/",
          "httpHeaders": {
            "header1": "value1",
            "header2": "value2"
          },
          "httpMethod": "POST",
          "timeout": "PT1M",
          "authResourceId": "api://f89d1c93-58a7-4b07-9a5b-5f89048b927b",
          "authIdentity": {
            "@odata.type": "#Microsoft.Azure.Search.DataNoneIdentity"
          }
        },
        "name": "custom-web-api",
        "kind": "customWebApi"
      },
      {
        "amlParameters": {
          "uri": "https://my-custom-endpoint.org/",
          "resourceId": "aml resource id",
          "timeout": "PT1M",
          "region": "aml region",
          "modelName": "OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32"
        },
        "name": "aml",
        "kind": "aml"
      },
      {
        "amlParameters": {
          "uri": "https://my-custom-endpoint.org/",
          "resourceId": "aml resource id",
          "timeout": "PT1M",
          "region": "aml region",
          "modelName": "Cohere-embed-v4"
        },
        "name": "aml-cohere",
        "kind": "aml"
      }
    ],
    "compressions": [
      {
        "scalarQuantizationParameters": {
          "quantizedDataType": "int8"
        },
        "name": "mySQ8",
        "kind": "scalarQuantization",
        "rescoringOptions": {
          "enableRescoring": true,
          "defaultOversampling": 10,
          "rescoreStorageMethod": "preserveOriginals"
        },
        "truncationDimension": 2
      },
      {
        "name": "myBQC",
        "kind": "binaryQuantization",
        "rescoringOptions": {
          "enableRescoring": true,
          "defaultOversampling": 10,
          "rescoreStorageMethod": "preserveOriginals"
        },
        "truncationDimension": 2
      },
      {
        "name": "myBQWithoutOriginals",
        "kind": "binaryQuantization",
        "rescoringOptions": {
          "enableRescoring": true,
          "defaultOversampling": 10,
          "rescoreStorageMethod": "discardOriginals"
        },
        "truncationDimension": 2
      }
    ]
  },
  "@odata.etag": "0x1234568AE7E58A1"
}

Örnek yanıt

{
  "@odata.etag": "0x1234568AE7E58A1",
  "name": "temp-example-index",
  "description": "description",
  "defaultScoringProfile": "stringFieldBoost",
  "fields": [
    {
      "name": "id",
      "type": "Edm.String",
      "searchable": true,
      "filterable": true,
      "retrievable": true,
      "stored": true,
      "sortable": true,
      "facetable": true,
      "key": true,
      "synonymMaps": []
    },
    {
      "name": "vector1",
      "type": "Collection(Edm.Single)",
      "searchable": true,
      "filterable": false,
      "retrievable": true,
      "stored": true,
      "sortable": false,
      "facetable": false,
      "key": false,
      "dimensions": 20,
      "vectorSearchProfile": "config1",
      "synonymMaps": []
    },
    {
      "name": "vector1b",
      "type": "Collection(Edm.Single)",
      "searchable": true,
      "filterable": false,
      "retrievable": true,
      "stored": true,
      "sortable": false,
      "facetable": false,
      "key": false,
      "dimensions": 10,
      "vectorSearchProfile": "config2",
      "synonymMaps": []
    },
    {
      "name": "vector2",
      "type": "Collection(Edm.Single)",
      "searchable": true,
      "filterable": false,
      "retrievable": true,
      "stored": true,
      "sortable": false,
      "facetable": false,
      "key": false,
      "dimensions": 5,
      "vectorSearchProfile": "config3",
      "synonymMaps": []
    },
    {
      "name": "vector3",
      "type": "Collection(Edm.Single)",
      "searchable": true,
      "filterable": false,
      "retrievable": true,
      "stored": true,
      "sortable": false,
      "facetable": false,
      "key": false,
      "dimensions": 5,
      "vectorSearchProfile": "config3",
      "synonymMaps": []
    },
    {
      "name": "vector22",
      "type": "Collection(Edm.Single)",
      "searchable": true,
      "filterable": false,
      "retrievable": true,
      "stored": true,
      "sortable": false,
      "facetable": false,
      "key": false,
      "dimensions": 10,
      "vectorSearchProfile": "config2",
      "synonymMaps": []
    },
    {
      "name": "vector4",
      "type": "Collection(Edm.Single)",
      "searchable": true,
      "filterable": false,
      "retrievable": true,
      "stored": true,
      "sortable": false,
      "facetable": false,
      "key": false,
      "dimensions": 32,
      "vectorSearchProfile": "config4",
      "synonymMaps": []
    },
    {
      "name": "name",
      "type": "Edm.String",
      "searchable": true,
      "filterable": true,
      "retrievable": true,
      "stored": true,
      "sortable": true,
      "facetable": true,
      "key": false,
      "analyzer": "en.lucene",
      "synonymMaps": []
    },
    {
      "name": "description",
      "type": "Edm.String",
      "searchable": true,
      "filterable": true,
      "retrievable": true,
      "stored": true,
      "sortable": true,
      "facetable": true,
      "key": false,
      "analyzer": "standard.lucene",
      "synonymMaps": []
    },
    {
      "name": "category",
      "type": "Edm.String",
      "searchable": true,
      "filterable": true,
      "retrievable": true,
      "stored": true,
      "sortable": true,
      "facetable": true,
      "key": false,
      "analyzer": "en.lucene",
      "synonymMaps": []
    },
    {
      "name": "ownerId",
      "type": "Edm.String",
      "searchable": true,
      "filterable": true,
      "retrievable": true,
      "stored": true,
      "sortable": true,
      "facetable": true,
      "key": false,
      "analyzer": "en.lucene",
      "synonymMaps": []
    },
    {
      "name": "price",
      "type": "Edm.Double",
      "searchable": false,
      "filterable": true,
      "retrievable": true,
      "stored": true,
      "sortable": true,
      "facetable": true,
      "key": false,
      "synonymMaps": []
    }
  ],
  "scoringProfiles": [
    {
      "name": "stringFieldBoost",
      "functionAggregation": "sum",
      "text": {
        "weights": {
          "name": 3,
          "description": 1,
          "category": 2,
          "ownerId": 1
        }
      },
      "functions": [
        {
          "fieldName": "category",
          "interpolation": "linear",
          "type": "tag",
          "boost": 2,
          "tag": {
            "tagsParameter": "categoryTag"
          }
        }
      ]
    }
  ],
  "corsOptions": {
    "allowedOrigins": [
      "https://www.example.com/foo"
    ],
    "maxAgeInSeconds": 10
  },
  "suggesters": [
    {
      "name": "sg",
      "searchMode": "analyzingInfixMatching",
      "sourceFields": [
        "category",
        "ownerId"
      ]
    }
  ],
  "analyzers": [
    {
      "@odata.type": "#Microsoft.Azure.Search.CustomAnalyzer",
      "name": "tagsAnalyzer",
      "tokenizer": "standard_v2",
      "tokenFilters": [
        "common_grams"
      ],
      "charFilters": [
        "html_strip"
      ]
    }
  ],
  "normalizers": [
    {
      "@odata.type": "#Microsoft.Azure.Search.CustomNormalizer",
      "name": "my_normalizer",
      "tokenFilters": [
        "my_tokenFilter"
      ],
      "charFilters": [
        "my_mapping"
      ]
    }
  ],
  "tokenizers": [
    {
      "@odata.type": "#Microsoft.Azure.Search.StandardTokenizerV2",
      "name": "my_tokenizer",
      "maxTokenLength": 100
    }
  ],
  "tokenFilters": [
    {
      "@odata.type": "#Microsoft.Azure.Search.AsciiFoldingTokenFilter",
      "name": "my_tokenFilter",
      "preserveOriginal": false
    }
  ],
  "charFilters": [
    {
      "@odata.type": "#Microsoft.Azure.Search.MappingCharFilter",
      "name": "my_mapping",
      "mappings": [
        ".=>,",
        "_=>-"
      ]
    }
  ],
  "similarity": {
    "@odata.type": "#Microsoft.Azure.Search.BM25Similarity",
    "k1": 10,
    "b": 0.1
  },
  "semantic": {
    "defaultConfiguration": "testconfig",
    "configurations": [
      {
        "name": "testconfig",
        "rankingOrder": "BoostedRerankerScore",
        "prioritizedFields": {
          "titleField": {
            "fieldName": "category"
          },
          "prioritizedContentFields": [
            {
              "fieldName": "description"
            }
          ],
          "prioritizedKeywordsFields": [
            {
              "fieldName": "ownerId"
            }
          ]
        }
      }
    ]
  },
  "vectorSearch": {
    "algorithms": [
      {
        "name": "cosine",
        "kind": "hnsw",
        "hnswParameters": {
          "metric": "cosine",
          "m": 4,
          "efConstruction": 400,
          "efSearch": 500
        }
      },
      {
        "name": "euclidean",
        "kind": "hnsw",
        "hnswParameters": {
          "metric": "euclidean",
          "m": 4,
          "efConstruction": 400,
          "efSearch": 500
        }
      },
      {
        "name": "dotProduct",
        "kind": "hnsw",
        "hnswParameters": {
          "metric": "dotProduct",
          "m": 4,
          "efConstruction": 400,
          "efSearch": 500
        }
      }
    ],
    "profiles": [
      {
        "name": "config1",
        "algorithm": "cosine",
        "vectorizer": "openai",
        "compression": "mySQ8"
      },
      {
        "name": "config2",
        "algorithm": "euclidean",
        "vectorizer": "custom-web-api",
        "compression": "mySQ8"
      },
      {
        "name": "config3",
        "algorithm": "dotProduct",
        "vectorizer": "custom-web-api",
        "compression": "myBQC"
      },
      {
        "name": "config4",
        "algorithm": "dotProduct",
        "vectorizer": "custom-web-api",
        "compression": "myBQWithoutOriginals"
      }
    ],
    "vectorizers": [
      {
        "name": "openai",
        "kind": "azureOpenAI",
        "azureOpenAIParameters": {
          "resourceUri": "https://test-sample.openai.azure.com",
          "deploymentId": "model",
          "apiKey": "api-key",
          "modelName": "text-embedding-3-large"
        }
      },
      {
        "name": "custom-web-api",
        "kind": "customWebApi",
        "customWebApiParameters": {
          "httpMethod": "POST",
          "uri": "https://my-custom-endpoint.org/",
          "timeout": "PT1M",
          "authResourceId": "api://f89d1c93-58a7-4b07-9a5b-5f89048b927b",
          "httpHeaders": {
            "header1": "value1",
            "header2": "value2"
          },
          "authIdentity": {
            "@odata.type": "#Microsoft.Azure.Search.DataNoneIdentity"
          }
        }
      },
      {
        "name": "aml",
        "kind": "aml",
        "amlParameters": {
          "resourceId": "aml resource id",
          "region": "aml region",
          "uri": "https://my-custom-endpoint.org/",
          "timeout": "PT1M",
          "modelName": "OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32"
        }
      },
      {
        "name": "aml-cohere",
        "kind": "aml",
        "amlParameters": {
          "resourceId": "aml resource id",
          "region": "aml region",
          "uri": "https://my-custom-endpoint.org/",
          "timeout": "PT1M",
          "modelName": "Cohere-embed-v4"
        }
      }
    ],
    "compressions": [
      {
        "name": "mySQ8",
        "kind": "scalarQuantization",
        "truncationDimension": 2,
        "scalarQuantizationParameters": {
          "quantizedDataType": "int8"
        },
        "rescoringOptions": {
          "enableRescoring": true,
          "defaultOversampling": 10,
          "rescoreStorageMethod": "preserveOriginals"
        }
      },
      {
        "name": "myBQC",
        "kind": "binaryQuantization",
        "truncationDimension": 2,
        "rescoringOptions": {
          "enableRescoring": true,
          "defaultOversampling": 10,
          "rescoreStorageMethod": "preserveOriginals"
        }
      },
      {
        "name": "myBQWithoutOriginals",
        "kind": "binaryQuantization",
        "truncationDimension": 2,
        "rescoringOptions": {
          "enableRescoring": true,
          "defaultOversampling": 10,
          "rescoreStorageMethod": "discardOriginals"
        }
      }
    ]
  }
}

Tanımlar

Name Description
Accept

Kabul Et başlığı.

AIFoundryModelCatalogName

Azure Yapay Zeka Atölyesi Kataloğu'ndan yerleştirilecek gömüleme modelinin adı.

AMLParameters

AML vektörleştiricisine bağlanma özelliklerini belirtir.

AMLVectorizer

Azure Yapay Zeka Atölyesi Model Kataloğu üzerinden bir sorgu dizesinin vektör gömülmesini oluşturmak için dağıtılan bir Azure Machine Learning uç noktası belirtir.

AsciiFoldingTokenFilter

İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

AzureOpenAIModelName

Çağrılacak Azure Open AI model adı.

AzureOpenAIVectorizer

Bir sorgu dizesini vektörleştirmek için kullanılan Azure OpenAI kaynağını belirtir.

AzureOpenAIVectorizerParameters

Azure OpenAI kaynağına bağlanmak için parametreleri belirtir.

BinaryQuantizationCompression

Dizin oluşturma ve sorgulama sırasında kullanılan ikili niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir.

BM25SimilarityAlgorithm

Okapi BM25 benzerlik algoritmasını temel alan derecelendirme işlevi. BM25, uzunluk normalleştirmesi ('b' parametresi tarafından denetlenen) ve terim sıklığı doygunluğu ('k1' parametresiyle denetlenen) içeren TF-IDF benzeri bir algoritmadır.

CharFilterName

Arama motoru tarafından desteklenen tüm karakter filtrelerinin adlarını tanımlar.

CjkBigramTokenFilter

Standart belirteç oluşturucudan oluşturulan CJK terimlerinin büyük simgelerini oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

CjkBigramTokenFilterScripts

CjkBigramTokenFilter tarafından yoksayılabilen betikler.

ClassicSimilarityAlgorithm

TF-IDF'nin Lucene TFIDFSimilarity uygulamasını kullanan eski benzerlik algoritması. bu TF-IDF varyasyonu, statik belge uzunluğu normalleştirmesini ve arama yapılan sorgularla yalnızca kısmen eşleşen belgeleri cezalandıran faktörleri koordine eder.

ClassicTokenizer

Çoğu Avrupa dili belgesini işlemek için uygun olan dil bilgisi tabanlı belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

CommonGramTokenFilter

Dizin oluştururken sık karşılaşılan terimler için bigrams oluşturun. Tek terimler de dizine eklenir ve ikili kelime birimleri üzerine yerleştirilir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

CorsOptions

Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçeneklerini tanımlar.

CustomAnalyzer

Metni dizine alınabilen/aranabilir belirteçlere dönüştürme işlemi üzerinde denetim sahibi olmanıza olanak tanır. Önceden tanımlanmış tek bir belirteç oluşturucu ve bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır. Belirteç oluşturucu, metinleri belirteçlere bölmek ve belirteç oluşturucu tarafından yayılan belirteçleri değiştirmek için filtrelerden sorumludur.

CustomNormalizer

Filtrelenebilir, sıralanabilir ve modellenebilir alanlar için normalleştirmeyi yapılandırmanıza olanak tanır ve bu alanlar varsayılan olarak katı eşleştirmeyle çalışır. Bu, depolanan belirteci değiştiren en az bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır.

DictionaryDecompounderTokenFilter

Birçok Almanca dilinde bulunan bileşik sözcükleri ayrıştırıyor. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

DistanceScoringFunction

Coğrafi konumdan uzaklığı temel alarak puanları artıran bir işlev tanımlar.

DistanceScoringParameters

Uzaklık puanlama işlevine parametre değerleri sağlar.

EdgeNGramTokenFilter

Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

EdgeNGramTokenFilterSide

Bir n-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir.

EdgeNGramTokenFilterV2

Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

EdgeNGramTokenizer

Bir kenardan gelen girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

ElisionTokenFilter

Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

ErrorAdditionalInfo

Kaynak yönetimi hatası ek bilgileri.

ErrorDetail

Hata ayrıntısı.

ErrorResponse

Başarısız işlemlerin hata ayrıntılarını döndürmek için tüm Azure Resource Manager API'leri için genel hata yanıtı. (Bu, OData hata yanıt biçimini de izler.).

ExhaustiveKnnAlgorithmConfiguration

Sorgulama sırasında kullanılan kapsamlı KNN algoritmasına özgü yapılandırma seçeneklerini içerir ve bu seçenek vektör dizininin tamamında deneme yanılma araması gerçekleştirir.

ExhaustiveKnnParameters

Kapsamlı KNN algoritmasına özgü parametreleri içerir.

FreshnessScoringFunction

Bir tarih-saat alanının değerine göre puanları artıran bir işlev tanımlar.

FreshnessScoringParameters

Bir güncellik puanlama işlevine parametre değerleri sağlar.

HnswAlgorithmConfiguration

Dizin oluşturma ve sorgulama sırasında kullanılan HNSW yaklaşık en yakın komşular algoritmasına özgü yapılandırma seçeneklerini içerir. HNSW algoritması, arama hızı ve doğruluğu arasında ayarlanabilir bir denge sunar.

HnswParameters

HNSW algoritmasına özgü parametreleri içerir.

KeepTokenFilter

Belirteçleri yalnızca belirtilen sözcük listesinde yer alan metinle tutan bir belirteç filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

KeywordMarkerTokenFilter

Terimleri anahtar sözcük olarak işaretler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

KeywordTokenizer

Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

KeywordTokenizerV2

Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

LengthTokenFilter

Çok uzun veya çok kısa sözcükleri kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

LexicalAnalyzerName

Arama motoru tarafından desteklenen tüm metin çözümleyicilerinin adlarını tanımlar.

LexicalNormalizerName

Arama motoru tarafından desteklenen tüm metin normalleştiricilerinin adlarını tanımlar.

LexicalTokenizerName

Arama motoru tarafından desteklenen tüm tokenizer'ların adlarını tanımlar.

LimitTokenFilter

Dizin oluşturma sırasında belirteç sayısını sınırlar. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

LuceneStandardAnalyzer

Standart Apache Lucene çözümleyicisi; Standart belirteç oluşturucu, küçük harfli filtre ve durdurma filtresinden oluşur.

LuceneStandardTokenizer

Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

LuceneStandardTokenizerV2

Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

MagnitudeScoringFunction

Sayısal alanın büyüklüğüne göre puanları artıran bir işlev tanımlar.

MagnitudeScoringParameters

Bir büyük puanlama işlevine parametre değerleri sağlar.

MappingCharFilter

Eşlemeler seçeneğiyle tanımlanan eşlemeleri uygulayan karakter filtresi. Eşleştirme açgözlüdür (verilen bir noktada en uzun desen eşleştirmesi kazanır). Değiştirmenin boş dize olması için izin verilir. Bu karakter filtresi Apache Lucene kullanılarak uygulanır.

MicrosoftLanguageStemmingTokenizer

Dile özgü kuralları kullanarak metni böler ve sözcükleri temel formlarına küçültür.

MicrosoftLanguageTokenizer

Dile özgü kuralları kullanarak metni böler.

MicrosoftStemmingTokenizerLanguage

Tokenizer'den gelen Microsoft dilinin desteklediği dilleri listeler.

MicrosoftTokenizerLanguage

Microsoft dil tokenizer'ı tarafından desteklenen dilleri listeler.

NGramTokenFilter

Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

NGramTokenFilterV2

Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

NGramTokenizer

Girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

PathHierarchyTokenizerV2

Yol benzeri hiyerarşiler için belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

PatternAnalyzer

Normal ifade deseni aracılığıyla metni esnek bir şekilde terimlere ayırır. Bu çözümleyici Apache Lucene kullanılarak uygulanır.

PatternCaptureTokenFilter

Bir veya daha fazla desendeki her yakalama grubu için bir tane olmak üzere birden çok belirteç yaymak için Java regexes kullanır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

PatternReplaceCharFilter

Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu karakter filtresi Apache Lucene kullanılarak uygulanır.

PatternReplaceTokenFilter

Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

PatternTokenizer

Farklı belirteçler oluşturmak için regex desen eşleştirmesi kullanan belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

PhoneticEncoder

PhoneticTokenFilter ile kullanılacak fonetik kodlayıcı türünü tanımlar.

PhoneticTokenFilter

Fonetik eşleşmeler için belirteçler oluşturun. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

RankingOrder

Belgelerin sıralama düzeni için kullanılacak puanı temsil eder.

RescoringOptions

Yeniden puanlama seçeneklerini içerir.

ScalarQuantizationCompression

Dizin oluşturma ve sorgulama sırasında kullanılan skaler niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir.

ScalarQuantizationParameters

Skaler Niceleme'ye özgü parametreleri içerir.

ScoringFunctionAggregation

Bir puanlama profilindeki tüm puanlama işlevlerinin sonuçlarını birleştirmek için kullanılan toplama işlevini tanımlar.

ScoringFunctionInterpolation

Bir dizi belgede puan artırmayı enterpolasyon yapmak için kullanılan işlevi tanımlar.

ScoringProfile

Arama sorgularında puanlama işlemini etkileyen bir arama dizininin parametrelerini tanımlar.

SearchField

Bir alanın adını, veri türünü ve arama davranışını açıklayan dizin tanımındaki bir alanı temsil eder.

SearchFieldDataType

Arama dizinindeki bir alanın veri türünü tanımlar.

SearchIndex

Bir dizinin alanlarını ve arama davranışını açıklayan bir arama dizini tanımını temsil eder.

SearchIndexerDataNoneIdentity

Veri kaynağının kimlik özelliğini temizler.

SearchIndexerDataUserAssignedIdentity

Kullanılacak veri kaynağının kimliğini belirtir.

SearchResourceEncryptionKey

Azure Key Vault'ta müşteri tarafından yönetilen bir şifreleme anahtarı. Oluşturduğunuz ve yönettiğiniz anahtarlar, dizinler ve eş anlamlı eşlemeler gibi bekleyen verileri şifrelemek veya şifresini çözmek için kullanılabilir.

SearchSuggester

Öneri API'sinin dizindeki bir alan grubuna nasıl uygulanacağını tanımlar.

SemanticConfiguration

Anlamsal özellikler bağlamında kullanılacak belirli bir yapılandırmayı tanımlar.

SemanticField

Anlamsal yapılandırmanın bir parçası olarak kullanılan alan.

SemanticPrioritizedFields

Anlam derecelendirmesi, açıklamalı alt yazılar, vurgular ve yanıtlar için kullanılacak başlık, içerik ve anahtar sözcük alanlarını açıklar.

SemanticSearch

Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar.

ShingleTokenFilter

Belirteç birleşimlerini tek bir belirteç olarak oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

SnowballTokenFilter

Snowball tarafından oluşturulan kök ayırıcı kullanarak sözcüklerin köklerini oluşturan bir filtre. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

SnowballTokenFilterLanguage

Snowball belirteç filtresi için kullanılacak dil.

StemmerOverrideTokenFilter

Özel sözlük tabanlı kök oluşturma ile diğer kök filtreleme filtrelerini geçersiz kılma olanağı sağlar. Sözlük köküne sahip terimler anahtar sözcük olarak işaretlenir, böylece zincirdeki kök ayırıcılarla kaynaklanmaz. Herhangi bir köklendirme filtresinin önüne yerleştirilmelidir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/StemmerOverrideFilter.html

StemmerTokenFilter

Dile özgü gövde filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#TokenFilters

StemmerTokenFilterLanguage

Stemmer belirteç filtresi için kullanılacak dil.

StopAnalyzer

Metni harf olmayanlara böler; Küçük harf ve stopword belirteci filtrelerini uygular. Bu çözümleyici Apache Lucene kullanılarak uygulanır.

StopwordsList

Dile özgü durdurma sözcüklerinin önceden tanımlanmış bir listesini tanımlar.

StopwordsTokenFilter

Belirteç akışından duraklama sözcüklerini kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopFilter.html

SynonymTokenFilter

Belirteç akışındaki tek veya çok sözcüklü eş anlamlılarla eşleşir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

TagScoringFunction

Belirli bir etiket listesiyle eşleşen dize değerleriyle belge puanlarını artıran bir işlev tanımlar.

TagScoringParameters

Etiket puanlama işlevine parametre değerleri sağlar.

TextWeights

Eşleşmelerin arama sorgularında puanlamanın artırılması gereken dizin alanlarında ağırlıkları tanımlar.

TokenCharacterKind

Belirteç filtresinin üzerinde çalışabileceği karakter sınıflarını temsil eder.

TokenFilterName

Arama motoru tarafından desteklenen tüm belirteç filtrelerinin adlarını tanımlar.

TruncateTokenFilter

Terimleri belirli bir uzunlukta kısaltın. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

UaxUrlEmailTokenizer

URL'ler ve e-postalar tek bir belirteç olacak şekilde işlenir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

UniqueTokenFilter

Önceki belirteçle aynı metindeki belirteçleri filtreler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

VectorEncodingFormat

Vektör alanı içeriklerini yorumlamak için kodlama biçimi.

VectorSearch

Vektör araması ile ilgili yapılandırma seçeneklerini içerir.

VectorSearchAlgorithmKind

Dizin oluşturma ve sorgulama için kullanılan algoritma.

VectorSearchAlgorithmMetric

Vektör karşılaştırmaları için kullanılacak benzerlik metriği. Ekleme modelinin eğitildiği benzerlik metriğinin seçilmesi önerilir.

VectorSearchCompressionKind

Dizin oluşturma ve sorgulama için kullanılan sıkıştırma yöntemi.

VectorSearchCompressionTarget

Sıkıştırılmış vektör değerlerinin nicelleştirilmiş veri türü.

VectorSearchProfile

Vektör araması ile kullanılacak yapılandırmaların bir bileşimini tanımlar.

VectorSearchVectorizerKind

Sorgu sırasında kullanılacak vektörleştirme yöntemi.

WebApiVectorizer

Bir sorgu dizesinin vektör eklemesini oluşturmak için kullanıcı tanımlı bir vektörleştirici belirtir. Bir beceri kümesinin özel Web API arabirimi kullanılarak dış vektörleştiricinin tümleştirilmesi sağlanır.

WebApiVectorizerParameters

Kullanıcı tanımlı vektörleştiriciye bağlanma özelliklerini belirtir.

WordDelimiterTokenFilter

Sözcükleri alt sözcüklere böler ve alt sözcük gruplarında isteğe bağlı dönüştürmeler gerçekleştirir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Accept

Kabul Et başlığı.

Değer Description
application/json;odata.metadata=minimal

AIFoundryModelCatalogName

Azure Yapay Zeka Atölyesi Kataloğu'ndan yerleştirilecek gömüleme modelinin adı.

Değer Description
OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32

OpenAI-CLIP-Image-Text-Embeddings-vit-base-patch32

OpenAI-CLIP-Image-Text-Embeddings-ViT-Large-Patch14-336

OpenAI-CLIP-Image-Text-Embeddings-ViT-Large-Patch14-336

Facebook-DinoV2-Image-Embeddings-ViT-Base

Facebook-DinoV2-Image-Embeddings-ViT-Base

Facebook-DinoV2-Image-Embeddings-ViT-Giant

Facebook DinoV2 Görüntü Gömülüleri -ViT-Giant

Cohere-embed-v3-english

Cohere-embed-v3-english

Cohere-embed-v3-multilingual

Cohere-embed-v3-multilingual

Cohere-embed-v4

Hem metinden hem de görüntülerden gömmeler oluşturmak için Cohere gömme v4 modeli.

AMLParameters

AML vektörleştiricisine bağlanma özelliklerini belirtir.

Name Tür Description
key

string

(Anahtar kimlik doğrulaması için gereklidir) AML hizmetinin anahtarı.

modelName

AIFoundryModelCatalogName

Sağlanan uç noktada dağıtılan Azure Yapay Zeka Atölyesi Kataloğu'ndan gömülü modelin adı.

region

string

(Belirteç kimlik doğrulaması için isteğe bağlı). AML hizmetinin dağıtılacağı bölge.

resourceId

string

(Belirteç kimlik doğrulaması için gereklidir). AML servisinin Azure Resource Manager resource ID'si. Formatında subscriptions/{guid}/resourceGroups/{resource-group-name}/Microsoft olmalı. MachineLearningServices/workspaces/{workspace-name}/services/{service_name}.

timeout

string (duration)

(İsteğe bağlı) Belirtildiğinde, API çağrısı yapan http istemcisinin zaman aşımını gösterir.

uri

string (uri)

(Kimlik doğrulaması veya anahtar kimlik doğrulaması olmaması için gereklidir) JSON yükünün gönderileceği AML hizmetinin puanlama URI'si. Yalnızca https URI düzenine izin verilir.

AMLVectorizer

Azure Yapay Zeka Atölyesi Model Kataloğu üzerinden bir sorgu dizesinin vektör gömülmesini oluşturmak için dağıtılan bir Azure Machine Learning uç noktası belirtir.

Name Tür Description
amlParameters

AMLParameters

AML vektörleştiricisinin özelliklerini belirtir.

kind string:

aml

VectorSearchVectorizer türü.

name

string

Bu özel vektörleştirme yöntemiyle ilişkilendirilecek ad.

AsciiFoldingTokenFilter

İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.AsciiFoldingTokenFilter

Türetilmiş türler için ayrımcı.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

preserveOriginal

boolean

False

Özgün belirtecin tutulup tutulmayacağını belirten bir değer. Varsayılan değer false'tur.

AzureOpenAIModelName

Çağrılacak Azure Open AI model adı.

Değer Description
text-embedding-ada-002

TextEmbeddingAda002 modeli.

text-embedding-3-large

TextEmbedding3Large modeli.

text-embedding-3-small

TextEmbedding3Small modeli.

gpt-5-mini

Gpt5Mini modeli.

gpt-5-nano

Gpt5Nano modeli.

gpt-5.4-mini

Gpt54Mini modeli.

gpt-5.4-nano

Gpt54Nano modeli.

AzureOpenAIVectorizer

Bir sorgu dizesini vektörleştirmek için kullanılan Azure OpenAI kaynağını belirtir.

Name Tür Description
azureOpenAIParameters

AzureOpenAIVectorizerParameters

Azure OpenAI katıştırma vektörleştirmesine özgü parametreleri içerir.

kind string:

azureOpenAI

VectorSearchVectorizer türü.

name

string

Bu özel vektörleştirme yöntemiyle ilişkilendirilecek ad.

AzureOpenAIVectorizerParameters

Azure OpenAI kaynağına bağlanmak için parametreleri belirtir.

Name Tür Description
apiKey

string

Belirlenen Azure OpenAI kaynağının API anahtarı.

authIdentity SearchIndexerDataIdentity:

Giden bağlantılar için kullanılan kullanıcı tarafından atanan yönetilen kimlik.

deploymentId

string

Belirlenen kaynakta Azure OpenAI modeli dağıtımının kimliği.

modelName

AzureOpenAIModelName

Sağlanan deploymentId yolunda dağıtılan ekleme modelinin adı.

resourceUri

string (uri)

Azure OpenAI kaynağının kaynak URI'si.

BinaryQuantizationCompression

Dizin oluşturma ve sorgulama sırasında kullanılan ikili niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir.

Name Tür Description
kind string:

binaryQuantization

VektörAramaSıkıştırma Türü.

name

string

Bu özel yapılandırmayla ilişkilendirilecek ad.

rescoringOptions

RescoringOptions

Yeniden puanlama seçeneklerini içerir.

truncationDimension

integer (int32)

Vektörlerin kesilmesi için boyut sayısı. Vektörlerin kesilmesi, vektörlerin boyutunu ve arama sırasında aktarılması gereken veri miktarını azaltır. Bu, depolama maliyetinden tasarruf edebilir ve geri çekme pahasına arama performansını artırabilir. Yalnızca OpenAI metin ekleme-3-büyük (küçük) gibi Matryoshka Temsili Öğrenmesi (MRL) ile eğitilen eklemeler için kullanılmalıdır. Varsayılan değer null'tır, yani kesme yoktur.

BM25SimilarityAlgorithm

Okapi BM25 benzerlik algoritmasını temel alan derecelendirme işlevi. BM25, uzunluk normalleştirmesi ('b' parametresi tarafından denetlenen) ve terim sıklığı doygunluğu ('k1' parametresiyle denetlenen) içeren TF-IDF benzeri bir algoritmadır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.BM25Similarity

Türetilmiş türler için ayrımcı.

b

number (double)

Bu özellik, bir belgenin uzunluğunun ilgi puanını nasıl etkilediğini denetler. Varsayılan olarak 0,75 değeri kullanılır. 0,0 değeri uzunluk normalleştirmesi uygulanmadığı, 1,0 değeri ise puanın belgenin uzunluğuna göre tamamen normalleştirildiği anlamına gelir.

k1

number (double)

Bu özellik, her eşleşen terimlerin terim sıklığı ile belge sorgusu çiftinin son ilgi puanı arasındaki ölçeklendirme işlevini denetler. Varsayılan olarak, 1,2 değeri kullanılır. 0,0 değeri, puanın terim sıklığındaki artışla ölçeklendirilmediği anlamına gelir.

CharFilterName

Arama motoru tarafından desteklenen tüm karakter filtrelerinin adlarını tanımlar.

Değer Description
html_strip

HTML yapılarını ayırmaya çalışan bir karakter filtresi. Bkz. https://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/charfilter/HTMLStripCharFilter.html

CjkBigramTokenFilter

Standart belirteç oluşturucudan oluşturulan CJK terimlerinin büyük simgelerini oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.CjkBigramTokenFilter

Türetilmiş türler için ayrımcı.

ignoreScripts

CjkBigramTokenFilterScripts[]

Yoksaymak için betikler.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

outputUnigrams

boolean

False

Hem tek birimlerin hem de büyük harflerin (doğruysa) veya yalnızca büyük harflerin (yanlışsa) çıkışını alıp almayacağını belirten bir değer. Varsayılan değer false'tur.

CjkBigramTokenFilterScripts

CjkBigramTokenFilter tarafından yoksayılabilen betikler.

Değer Description
han

CJK terimlerinin bigramlarını oluştururken Han betiğini yoksayın.

hiragana

CJK terimlerinin bigramlarını oluştururken Hiragana komut dosyasını dikkate almayın.

katakana

CJK terimlerinin bigramlarını oluştururken Katakana komut dosyasını dikkate almayın.

hangul

CJK terimlerinin bigramlarını oluştururken Hangul komut dosyasını göz ardı edin.

ClassicSimilarityAlgorithm

TF-IDF'nin Lucene TFIDFSimilarity uygulamasını kullanan eski benzerlik algoritması. bu TF-IDF varyasyonu, statik belge uzunluğu normalleştirmesini ve arama yapılan sorgularla yalnızca kısmen eşleşen belgeleri cezalandıran faktörleri koordine eder.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.ClassicSimilarity

Türetilmiş türler için ayrımcı.

ClassicTokenizer

Çoğu Avrupa dili belgesini işlemek için uygun olan dil bilgisi tabanlı belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.ClassicTokenizer

Türetilmiş türler için ayrımcı.

maxTokenLength

integer (int32)

maximum: 300
255

En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

CommonGramTokenFilter

Dizin oluştururken sık karşılaşılan terimler için bigrams oluşturun. Tek terimler de dizine eklenir ve ikili kelime birimleri üzerine yerleştirilir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.CommonGramTokenFilter

Türetilmiş türler için ayrımcı.

commonWords

string[]

Ortak sözcükler kümesi.

ignoreCase

boolean

False

Ortak sözcükleri eşleştirmenin büyük/küçük harfe duyarsız olup olmayacağını gösteren bir değer. Varsayılan değer false'tur.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

queryMode

boolean

False

Belirteç filtresinin sorgu modunda olup olmadığını gösteren değer. Sorgu modundayken belirteç filtresi büyük harfler oluşturur ve ardından ortak sözcükleri ve tek terimleri ve ardından ortak bir sözcüğü kaldırır. Varsayılan değer false'tur.

CorsOptions

Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçeneklerini tanımlar.

Name Tür Description
allowedOrigins

string[]

JavaScript koduna dizininize erişim izni verilecek kaynakların listesi. {protocol}://{fully-qualified-domain-name}[:{port#}] biçimindeki ana bilgisayarların bir listesini veya tüm çıkış noktalarına izin vermek için tek bir '*' içerebilir (önerilmez).

maxAgeInSeconds

integer (int64)

Tarayıcıların CORS ön kontrol yanıtlarını önbelleğe alması gereken süre. Varsayılan olarak 5 dakikadır.

CustomAnalyzer

Metni dizine alınabilen/aranabilir belirteçlere dönüştürme işlemi üzerinde denetim sahibi olmanıza olanak tanır. Önceden tanımlanmış tek bir belirteç oluşturucu ve bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır. Belirteç oluşturucu, metinleri belirteçlere bölmek ve belirteç oluşturucu tarafından yayılan belirteçleri değiştirmek için filtrelerden sorumludur.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.CustomAnalyzer

Türetilmiş türler için ayrımcı.

charFilters

CharFilterName[]

Giriş metnini belirteç oluşturucu tarafından işlenmeden önce hazırlamak için kullanılan karakter filtrelerinin listesi. Örneğin, belirli karakterleri veya simgeleri değiştirebilirler. Filtreler, listelendikleri sırayla çalıştırılır.

name

string

Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

tokenFilters

TokenFilterName[]

Bir belirteç oluşturucu tarafından oluşturulan belirteçleri filtrelemek veya değiştirmek için kullanılan belirteç filtrelerinin listesi. Örneğin, tüm karakterleri küçük harfe dönüştüren küçük harfli bir filtre belirtebilirsiniz. Filtreler, listelendikleri sırayla çalıştırılır.

tokenizer

LexicalTokenizerName

Sürekli metni, bir cümleyi sözcüklere bölme gibi bir belirteç dizisine bölmek için kullanılacak belirteç oluşturucunun adı.

CustomNormalizer

Filtrelenebilir, sıralanabilir ve modellenebilir alanlar için normalleştirmeyi yapılandırmanıza olanak tanır ve bu alanlar varsayılan olarak katı eşleştirmeyle çalışır. Bu, depolanan belirteci değiştiren en az bir veya daha fazla filtreden oluşan kullanıcı tanımlı bir yapılandırmadır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.CustomNormalizer

Türetilmiş türler için ayrımcı.

charFilters

CharFilterName[]

Giriş metnini işlenmeden önce hazırlamak için kullanılan karakter filtreleri listesi. Örneğin, belirli karakterleri veya simgeleri değiştirebilirler. Filtreler, listelendikleri sırayla çalıştırılır.

name

string

Karakter filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

tokenFilters

TokenFilterName[]

Giriş belirtecini filtrelemek veya değiştirmek için kullanılan belirteç filtrelerinin listesi. Örneğin, tüm karakterleri küçük harfe dönüştüren küçük harfli bir filtre belirtebilirsiniz. Filtreler, listelendikleri sırayla çalıştırılır.

DictionaryDecompounderTokenFilter

Birçok Almanca dilinde bulunan bileşik sözcükleri ayrıştırıyor. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.DictionaryDecompounderTokenFilter

Türetilmiş türler için ayrımcı.

maxSubwordSize

integer (int32)

maximum: 300
15

En büyük alt kelime boyutu. Yalnızca bundan kısa alt sözler çıkarılır. Varsayılan değer 15'tir. Maksimum değer 300'dür.

minSubwordSize

integer (int32)

maximum: 300
2

En düşük alt kelime boyutu. Yalnızca bundan daha uzun alt ifadeler çıkarılır. Varsayılan değer 2'dir. Maksimum değer 300'dür.

minWordSize

integer (int32)

maximum: 300
5

En küçük sözcük boyutu. Yalnızca bundan daha uzun sözcükler işlenir. Varsayılan değer 5'tir. Maksimum değer 300'dür.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

onlyLongestMatch

boolean

False

Çıkışa yalnızca en uzun eşleşen alt sözcüğün eklenip eklenmeyeceğini gösteren değer. Varsayılan değer false'tur.

wordList

string[]

Eşleşecek sözcüklerin listesi.

DistanceScoringFunction

Coğrafi konumdan uzaklığı temel alarak puanları artıran bir işlev tanımlar.

Name Tür Description
boost

number (double)

Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır.

distance

DistanceScoringParameters

Uzaklık puanlama işlevi için parametre değerleri.

fieldName

string

Puanlama işlevine giriş olarak kullanılan alanın adı.

interpolation

ScoringFunctionInterpolation

Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır.

type string:

distance

ScoringFunction türü.

DistanceScoringParameters

Uzaklık puanlama işlevine parametre değerleri sağlar.

Name Tür Description
boostingDistance

number (double)

Takviye aralığının sona erdiği referans konumundan kilometre cinsinden mesafe.

referencePointParameter

string

Başvuru konumunu belirtmek için arama sorgularında geçirilen parametrenin adı.

EdgeNGramTokenFilter

Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.EdgeNGramTokenFilter

Türetilmiş türler için ayrımcı.

maxGram

integer (int32)

2

En fazla n gram uzunluk. Varsayılan değer 2'dir.

minGram

integer (int32)

1

En az n gram uzunluk. Varsayılan değer 1'dir. maxGram değerinden küçük olmalıdır.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

side

EdgeNGramTokenFilterSide

front

N-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir. Varsayılan değer "ön"dür.

EdgeNGramTokenFilterSide

Bir n-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir.

Değer Description
front

n-gramın girişin önünden oluşturulması gerektiğini belirtir.

back

n-gramın girişin arkasından oluşturulması gerektiğini belirtir.

EdgeNGramTokenFilterV2

Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.EdgeNGramTokenFilterV2

Türetilmiş türler için ayrımcı.

maxGram

integer (int32)

maximum: 300
2

En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür.

minGram

integer (int32)

maximum: 300
1

En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

side

EdgeNGramTokenFilterSide

front

N-gramın girişin hangi tarafından oluşturulması gerektiğini belirtir. Varsayılan değer "ön"dür.

EdgeNGramTokenizer

Bir kenardan gelen girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.EdgeNGramTokenizer

Türetilmiş türler için ayrımcı.

maxGram

integer (int32)

maximum: 300
2

En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür.

minGram

integer (int32)

maximum: 300
1

En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

tokenChars

TokenCharacterKind[]

Belirteçlerde tutulacak karakter sınıfları.

ElisionTokenFilter

Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.ElisionTokenFilter

Türetilmiş türler için ayrımcı.

articles

string[]

Kaldırılacak makale kümesi.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

ErrorAdditionalInfo

Kaynak yönetimi hatası ek bilgileri.

Name Tür Description
info

Ek bilgiler.

type

string

Ek bilgi türü.

ErrorDetail

Hata ayrıntısı.

Name Tür Description
additionalInfo

ErrorAdditionalInfo[]

Hata ek bilgileri.

code

string

Hata kodu.

details

ErrorDetail[]

Hata ayrıntıları.

message

string

Hata iletisi.

target

string

Hata hedefi

ErrorResponse

Başarısız işlemlerin hata ayrıntılarını döndürmek için tüm Azure Resource Manager API'leri için genel hata yanıtı. (Bu, OData hata yanıt biçimini de izler.).

Name Tür Description
error

ErrorDetail

Hata nesnesi.

ExhaustiveKnnAlgorithmConfiguration

Sorgulama sırasında kullanılan kapsamlı KNN algoritmasına özgü yapılandırma seçeneklerini içerir ve bu seçenek vektör dizininin tamamında deneme yanılma araması gerçekleştirir.

Name Tür Description
exhaustiveKnnParameters

ExhaustiveKnnParameters

Kapsamlı KNN algoritmasına özgü parametreleri içerir.

kind string:

exhaustiveKnn

Vektör TürüAramaAlgoritmaYapılandırma.

name

string

Bu özel yapılandırmayla ilişkilendirilecek ad.

ExhaustiveKnnParameters

Kapsamlı KNN algoritmasına özgü parametreleri içerir.

Name Tür Description
metric

VectorSearchAlgorithmMetric

Vektör karşılaştırmaları için kullanılacak benzerlik metriği.

FreshnessScoringFunction

Bir tarih-saat alanının değerine göre puanları artıran bir işlev tanımlar.

Name Tür Description
boost

number (double)

Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır.

fieldName

string

Puanlama işlevine giriş olarak kullanılan alanın adı.

freshness

FreshnessScoringParameters

Yenilik puanlama işlevi için parametre değerleri.

interpolation

ScoringFunctionInterpolation

Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır.

type string:

freshness

ScoringFunction türü.

FreshnessScoringParameters

Bir güncellik puanlama işlevine parametre değerleri sağlar.

Name Tür Description
boostingDuration

string (duration)

Belirli bir belge için yükseltmenin durdurulacağı sona erme süresi.

HnswAlgorithmConfiguration

Dizin oluşturma ve sorgulama sırasında kullanılan HNSW yaklaşık en yakın komşular algoritmasına özgü yapılandırma seçeneklerini içerir. HNSW algoritması, arama hızı ve doğruluğu arasında ayarlanabilir bir denge sunar.

Name Tür Description
hnswParameters

HnswParameters

HNSW algoritmasına özgü parametreleri içerir.

kind string:

hnsw

Vektör TürüAramaAlgoritmaYapılandırma.

name

string

Bu özel yapılandırmayla ilişkilendirilecek ad.

HnswParameters

HNSW algoritmasına özgü parametreleri içerir.

Name Tür Default value Description
efConstruction

integer (int32)

minimum: 100
maximum: 1000
400

Dizin süresi boyunca kullanılan en yakın komşuları içeren dinamik listenin boyutu. Bu parametrenin artırılması, dizin oluşturma süresinin artması pahasına dizin kalitesini iyileştirebilir. Belli bir noktada, bu parametrenin arttırılması azalan getirilere yol açar.

efSearch

integer (int32)

minimum: 100
maximum: 1000
500

Arama sırasında kullanılan en yakın komşuları içeren dinamik listenin boyutu. Bu parametreyi artırmak, daha yavaş arama pahasına arama sonuçlarını iyileştirebilir. Belli bir noktada, bu parametrenin arttırılması azalan getirilere yol açar.

m

integer (int32)

minimum: 4
maximum: 10
4

İnşaat sırasında her yeni eleman için oluşturulan çift yönlü bağlantıların sayısı. Bu parametre değerinin artırılması, artan bellek tüketimi ve daha uzun dizin oluşturma süresi pahasına yüksek iç boyutluluğa sahip veri kümeleri için geri çağırmayı iyileştirebilir ve alma sürelerini azaltabilir.

metric

VectorSearchAlgorithmMetric

Vektör karşılaştırmaları için kullanılacak benzerlik metriği.

KeepTokenFilter

Belirteçleri yalnızca belirtilen sözcük listesinde yer alan metinle tutan bir belirteç filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.KeepTokenFilter

Türetilmiş türler için ayrımcı.

keepWords

string[]

Tutulacak sözcüklerin listesi.

keepWordsCase

boolean

False

Önce tüm sözcüklerin küçük harfle yazılıp azaltılmayacağını gösteren bir değer. Varsayılan değer false'tur.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

KeywordMarkerTokenFilter

Terimleri anahtar sözcük olarak işaretler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.KeywordMarkerTokenFilter

Türetilmiş türler için ayrımcı.

ignoreCase

boolean

False

Büyük/küçük harf yoksayılıp yoksayılmayacağını belirten bir değer. True ise, önce tüm sözcükler küçük harfe dönüştürülür. Varsayılan değer false'tur.

keywords

string[]

Anahtar sözcük olarak işaretlenecek sözcüklerin listesi.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

KeywordTokenizer

Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.KeywordTokenizer

Türetilmiş türler için ayrımcı.

bufferSize

integer (int32)

256

Bayt cinsinden okuma arabelleği boyutu. Varsayılan değer 256'dır.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

KeywordTokenizerV2

Girişin tamamını tek bir belirteç olarak yayar. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.KeywordTokenizerV2

Türetilmiş türler için ayrımcı.

maxTokenLength

integer (int32)

maximum: 300
256

En fazla belirteç uzunluğu. Varsayılan değer 256'dır. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

LengthTokenFilter

Çok uzun veya çok kısa sözcükleri kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.LengthTokenFilter

Türetilmiş türler için ayrımcı.

max

integer (int32)

maximum: 300
300

Karakter cinsinden uzunluk üst sınırı. Varsayılan ve maksimum değer 300'dür.

min

integer (int32)

maximum: 300
0

Karakter cinsinden en küçük uzunluk. Varsayılan değer 0'dır. Maksimum değer 300'dür. En büyük değerinden küçük olmalıdır.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

LexicalAnalyzerName

Arama motoru tarafından desteklenen tüm metin çözümleyicilerinin adlarını tanımlar.

Değer Description
ar.microsoft

Arapça için Microsoft analizörü.

ar.lucene

Arapça için Lucene analizörü.

hy.lucene

Ermenice için Lucene analizörü.

bn.microsoft

Bangla için Microsoft analizörü.

eu.lucene

Bask için Lucene analizörü.

bg.microsoft

Bulgarca için Microsoft analizörü.

bg.lucene

Bulgarca için Lucene analizörü.

ca.microsoft

Katalan için Microsoft analizörü.

ca.lucene

Katalanca için Lucene analizörü.

zh-Hans.microsoft

Çince için Microsoft analizörü (Basitleştirilmiş).

zh-Hans.lucene

Çince için Lucene analizörü (Basitleştirilmiş).

zh-Hant.microsoft

Çince için Microsoft analizörü (Geleneksel).

zh-Hant.lucene

Çince (Geleneksel) için Lucene analizörü.

hr.microsoft

Hırvatça için Microsoft analizörü.

cs.microsoft

Çekçe için Microsoft analizörü.

cs.lucene

Çekçe için Lucene analizörü.

da.microsoft

Dança için Microsoft analizörü.

da.lucene

Danca için Lucene analizörü.

nl.microsoft

Hollanda için Microsoft analizörü.

nl.lucene

Hollandaca için Lucene analizörü.

en.microsoft

İngilizce için Microsoft analizörü.

en.lucene

İngilizce için Lucene analizörü.

et.microsoft

Estonca için Microsoft analizörü.

fi.microsoft

Microsoft analizörü for Finnce.

fi.lucene

Fince için Lucene analizörü.

fr.microsoft

Fransızca için Microsoft analizörü.

fr.lucene

Fransızca için Lucene analizörü.

gl.lucene

Galiçyaca için Lucene analizörü.

de.microsoft

Almanca için Microsoft analizörü.

de.lucene

Almanca için Lucene analizörü.

el.microsoft

Yunanca için Microsoft analizörü.

el.lucene

Yunanca için Lucene analizörü.

gu.microsoft

Gujarati için Microsoft analizörü.

he.microsoft

İbranice için Microsoft analizörü.

hi.microsoft

Hintçe için Microsoft analizörü.

hi.lucene

Hintçe için Lucene analizörü.

hu.microsoft

Macarca için Microsoft analizörü.

hu.lucene

Macarca için Lucene analizörü.

is.microsoft

İzlanda için Microsoft analizörü.

id.microsoft

Endonezce (Bahasa) için Microsoft analizörü.

id.lucene

Endonezya için Lucene analizörü.

ga.lucene

İrlandalılar için Lucene analizörü.

it.microsoft

İtalyanca için Microsoft analizörü.

it.lucene

İtalyanca için Lucene analizörü.

ja.microsoft

Japonca için Microsoft analizörü.

ja.lucene

Japonca için Lucene analizörü.

kn.microsoft

Kannada için Microsoft analizörü.

ko.microsoft

Korece için Microsoft analizörü.

ko.lucene

Korece için Lucene analizörü.

lv.microsoft

Letonca için Microsoft analizörü.

lv.lucene

Letonca için Lucene analizörü.

lt.microsoft

Litvanca için Microsoft analizörü.

ml.microsoft

Malayalam için Microsoft analizörü.

ms.microsoft

Malay (Latince) için Microsoft analizörü.

mr.microsoft

Marathi için Microsoft analizörü.

nb.microsoft

Microsoft analyzer for Norwegian (Bokmål).

no.lucene

Norveççe için Lucene analizörü.

fa.lucene

Farsça için Lucene analizörü.

pl.microsoft

Polonya için Microsoft analizörü.

pl.lucene

Lehçe için Lucene analizörü.

pt-BR.microsoft

Portekizce için Microsoft analizörü (Brezilya).

pt-BR.lucene

Portekizce (Brezilya) için Lucene analizörü.

pt-PT.microsoft

Portekizce (Portekiz) için Microsoft analizörü.

pt-PT.lucene

Portekizce (Portekiz) için Lucene analizörü.

pa.microsoft

Pencapça için Microsoft analizörü.

ro.microsoft

Rumence için Microsoft analizörü.

ro.lucene

Romence için Lucene analizörü.

ru.microsoft

Rusça için Microsoft analizörü.

ru.lucene

Rusça için Lucene analizörü.

sr-cyrillic.microsoft

Sırbça için Microsoft analizörü (Kiril).

sr-latin.microsoft

Microsoft analizörü Sırpça (Latince) için.

sk.microsoft

Slovakça için Microsoft analizörü.

sl.microsoft

Slovence için Microsoft analizörü.

es.microsoft

İspanyolca için Microsoft analizörü.

es.lucene

İspanyolca için Lucene analizörü.

sv.microsoft

İsveççe için Microsoft analizörü.

sv.lucene

İsveççe için Lucene analizörü.

ta.microsoft

Tamil için Microsoft analizörü.

te.microsoft

Telugu için Microsoft analizörü.

th.microsoft

Tayca için Microsoft analizörü.

th.lucene

Tay dili için Lucene analizörü.

tr.microsoft

Microsoft analizörü için Türkçe.

tr.lucene

Türkçe için Lucene analizörü.

uk.microsoft

Ukraynaca için Microsoft analizörü.

ur.microsoft

Microsoft analizörü Urduca için.

vi.microsoft

Vietnamca için Microsoft analizörü.

standard.lucene

Standart Lucene analizörü.

standardasciifolding.lucene

Standart ASCII Katlanır Lucene analizörü. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#Analyzers

keyword

Bir alanın içeriğinin tamamını tek bir belirteç olarak ele alır. Bu, posta kodları, kimlikler ve bazı ürün adları gibi veriler için kullanışlıdır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/KeywordAnalyzer.html

pattern

Normal ifade deseni aracılığıyla metni esnek bir şekilde terimlere ayırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/PatternAnalyzer.html

simple

Metni harf olmayanlara böler ve küçük harfe dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/SimpleAnalyzer.html

stop

Metni harf olmayanlara böler; Küçük harf ve stopword belirteci filtrelerini uygular. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopAnalyzer.html

whitespace

Boşluk tokenizer'ı kullanan bir çözümleyici. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/WhitespaceAnalyzer.html

LexicalNormalizerName

Arama motoru tarafından desteklenen tüm metin normalleştiricilerinin adlarını tanımlar.

Değer Description
asciifolding

İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ASCIIFoldingFilter.html

elision

Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/util/ElisionFilter.html

lowercase

Belirteç metnini küçük harf olarak normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/LowerCaseFilter.html

standard

Küçük harf ve asciifolding'den oluşan standart normalleştirici. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/reverse/ReverseStringFilter.html

uppercase

Belirteç metnini büyük harf olarak normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/UpperCaseFilter.html

LexicalTokenizerName

Arama motoru tarafından desteklenen tüm tokenizer'ların adlarını tanımlar.

Değer Description
classic

Çoğu Avrupa dili belgesini işlemek için uygun olan dil bilgisi tabanlı belirteç oluşturucu. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/ClassicTokenizer.html

edgeNGram

Bir kenardan gelen girişi verilen boyutların n gramını belirteci haline getirmektedir. Bkz. https://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/EdgeNGramTokenizer.html

keyword_v2

Girişin tamamını tek bir belirteç olarak yayar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/KeywordTokenizer.html

letter

Metni harf olmayanlara böler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/LetterTokenizer.html

lowercase

Metni harf olmayanlara böler ve küçük harfe dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/LowerCaseTokenizer.html

microsoft_language_tokenizer

Dile özgü kuralları kullanarak metni böler.

microsoft_language_stemming_tokenizer

Dile özgü kuralları kullanarak metni böler ve sözcükleri temel formlarına küçültür.

nGram

Girişi verilen boyutların n gramını belirteci haline getirmektedir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/NGramTokenizer.html

path_hierarchy_v2

Yol benzeri hiyerarşiler için belirteç oluşturucu. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/path/PathHierarchyTokenizer.html

pattern

Farklı belirteçler oluşturmak için regex desen eşleştirmesi kullanan belirteç oluşturucu. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/pattern/PatternTokenizer.html

standard_v2

Standart Lucene çözümleyicisi; Standart belirteç oluşturucu, küçük harfli filtre ve durdurma filtresinden oluşur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/StandardTokenizer.html

uax_url_email

URL'ler ve e-postalar tek bir belirteç olacak şekilde işlenir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/UAX29URLEmailTokenizer.html

whitespace

Metni boşlukta böler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/WhitespaceTokenizer.html

LimitTokenFilter

Dizin oluşturma sırasında belirteç sayısını sınırlar. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.LimitTokenFilter

Türetilmiş türler için ayrımcı.

consumeAllTokens

boolean

False

maxTokenCount değerine ulaşılsa bile girişten gelen tüm belirteçlerin tüketilip tüketilmeyeceğini gösteren değer. Varsayılan değer false'tur.

maxTokenCount

integer (int32)

1

Üretilmesi gereken en fazla belirteç sayısı. Varsayılan değer 1'dir.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

LuceneStandardAnalyzer

Standart Apache Lucene çözümleyicisi; Standart belirteç oluşturucu, küçük harfli filtre ve durdurma filtresinden oluşur.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.StandardAnalyzer

Türetilmiş türler için ayrımcı.

maxTokenLength

integer (int32)

maximum: 300
255

En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir.

name

string

Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

stopwords

string[]

Stopwords listesi.

LuceneStandardTokenizer

Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.StandardTokenizer

Türetilmiş türler için ayrımcı.

maxTokenLength

integer (int32)

255

En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

LuceneStandardTokenizerV2

Unicode Metin Kesimleme kurallarından sonra metni keser. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.StandardTokenizerV2

Türetilmiş türler için ayrımcı.

maxTokenLength

integer (int32)

maximum: 300
255

En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

MagnitudeScoringFunction

Sayısal alanın büyüklüğüne göre puanları artıran bir işlev tanımlar.

Name Tür Description
boost

number (double)

Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır.

fieldName

string

Puanlama işlevine giriş olarak kullanılan alanın adı.

interpolation

ScoringFunctionInterpolation

Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır.

magnitude

MagnitudeScoringParameters

Büyük puanlama işlevinin parametre değerleri.

type string:

magnitude

ScoringFunction türü.

MagnitudeScoringParameters

Bir büyük puanlama işlevine parametre değerleri sağlar.

Name Tür Description
boostingRangeEnd

number (double)

Yükseltmenin sona erdiği alan değeri.

boostingRangeStart

number (double)

Yükseltmenin başladığı alan değeri.

constantBoostBeyondRange

boolean

Aralık bitiş değerinin ötesindeki alan değerleri için sabit bir artırma uygulanıp uygulanmayacağını gösteren bir değer; Varsayılan değer false'tur.

MappingCharFilter

Eşlemeler seçeneğiyle tanımlanan eşlemeleri uygulayan karakter filtresi. Eşleştirme açgözlüdür (verilen bir noktada en uzun desen eşleştirmesi kazanır). Değiştirmenin boş dize olması için izin verilir. Bu karakter filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.MappingCharFilter

Türetilmiş türler için ayrımcı.

mappings

string[]

Şu biçimdeki eşlemelerin listesi: "a=>b" ("a" karakterinin tüm oluşumları "b" karakteriyle değiştirilir).

name

string

Karakter filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

MicrosoftLanguageStemmingTokenizer

Dile özgü kuralları kullanarak metni böler ve sözcükleri temel formlarına küçültür.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.MicrosoftLanguageStemmingTokenizer

Türetilmiş türler için ayrımcı.

isSearchTokenizer

boolean

False

Belirteç oluşturucunun nasıl kullanıldığını gösteren değer. Arama belirteci olarak kullanılırsa true olarak, dizin belirteç oluşturucu olarak kullanılıyorsa false olarak ayarlayın. Varsayılan değer false'tur.

language

MicrosoftStemmingTokenizerLanguage

Kullanılacak dil. Varsayılan değer İngilizce'dir.

maxTokenLength

integer (int32)

maximum: 300
255

En fazla belirteç uzunluğu. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. 300 karakterden uzun belirteçler önce 300 uzunluğundaki belirteçlere bölünür ve ardından bu belirteçlerin her biri ayarlanan maksimum belirteç uzunluğuna göre bölünür. Varsayılan değer 255'tir.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

MicrosoftLanguageTokenizer

Dile özgü kuralları kullanarak metni böler.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.MicrosoftLanguageTokenizer

Türetilmiş türler için ayrımcı.

isSearchTokenizer

boolean

False

Belirteç oluşturucunun nasıl kullanıldığını gösteren değer. Arama belirteci olarak kullanılırsa true olarak, dizin belirteç oluşturucu olarak kullanılıyorsa false olarak ayarlayın. Varsayılan değer false'tur.

language

MicrosoftTokenizerLanguage

Kullanılacak dil. Varsayılan değer İngilizce'dir.

maxTokenLength

integer (int32)

maximum: 300
255

En fazla belirteç uzunluğu. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir. 300 karakterden uzun belirteçler önce 300 uzunluğundaki belirteçlere bölünür ve ardından bu belirteçlerin her biri ayarlanan maksimum belirteç uzunluğuna göre bölünür. Varsayılan değer 255'tir.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

MicrosoftStemmingTokenizerLanguage

Tokenizer'den gelen Microsoft dilinin desteklediği dilleri listeler.

Değer Description
arabic

Arapça için Microsoft kök tokenizer'ını seçer.

bangla

Bangla için Microsoft kök tokenizer'ını seçer.

bulgarian

Bulgarca için Microsoft kök tokenizer'ını seçer.

catalan

Katalan için Microsoft köklü tokenizer'ı seçer.

croatian

Hırvatça için Microsoft köklü tokenizer'ı seçer.

czech

Çekçe için Microsoft kök tokenizer'ını seçer.

danish

Danish için Microsoft kök tokenizer'ını seçer.

dutch

Hollandaca için Microsoft kök tokenizer'ını seçer.

english

İngilizce için Microsoft kök tokenizer'ını seçer.

estonian

Estonya için Microsoft köklü tokenizer'i seçer.

finnish

Fince için Microsoft kök tokenizer'ını seçer.

french

Fransızca için Microsoft kök tokenizer'ını seçer.

german

Almanca için Microsoft kök tokenizer'ını seçer.

greek

Yunanca için Microsoft kök tokenizer'ını seçer.

gujarati

Gujarati için Microsoft köklü tokenizer'ı seçer.

hebrew

İbranice için Microsoft kök tokenizer'ını seçer.

hindi

Hintçe için Microsoft kök tokenizer'ini seçer.

hungarian

Macarca'ya yönelik Microsoft kök tokenizer'ını seçer.

icelandic

İzlanda için Microsoft kök tokenizer'ını seçer.

indonesian

Endonezya için Microsoft kök tokenizer'ını seçer.

italian

İtalyanca için Microsoft kök tokenizer'ını seçer.

kannada

Kannada için Microsoft köklü tokenizer'ı seçer.

latvian

Letonca için Microsoft köklü tokenizer'ı seçer.

lithuanian

Litvanca için Microsoft kök tokenizer'ını seçer.

malay

Malay için Microsoft kök tokenizer'ını seçer.

malayalam

Malayalam için Microsoft köken tokenizer'ını seçer.

marathi

Marathi için Microsoft kök tokenizer'ını seçer.

norwegianBokmaal

Norwegian (Bokmål) için Microsoft stemming tokenizer'i seçer.

polish

Polonya için Microsoft kök tokenizer'ını seçer.

portuguese

Portekizce için Microsoft kök tokenizer'ını seçer.

portugueseBrazilian

Portekiz (Brezilya) için Microsoft köken tokenizer'ını seçer.

punjabi

Pencapça için Microsoft kök tokenizer'ını seçer.

romanian

Romanca için Microsoft kök tokenizer'ını seçer.

russian

Rusça için Microsoft kök tokenizer'ını seçer.

serbianCyrillic

Sırpça (Kiril) için Microsoft köklü tokenizer'ı seçer.

serbianLatin

Sırbça (Latince) için Microsoft kök tokenizer'ını seçer.

slovak

Slovak için Microsoft kök tokenizer'ını seçer.

slovenian

Slovenian için Microsoft köklü tokenizer'ı seçer.

spanish

İspanyolca için Microsoft kök tokenizer'ını seçer.

swedish

İsveççe için Microsoft köklü tokenizer'ı seçer.

tamil

Tamilce için Microsoft'un köklü tokenizerini seçer.

telugu

Telugu için Microsoft'un kök tokenizer'ını seçer.

turkish

Turkish için Microsoft kök tokenizer'ını seçer.

ukrainian

Ukraynaca için Microsoft kök tokenizer'ını seçer.

urdu

Urduca için Microsoft köklü tokenizer'ı seçer.

MicrosoftTokenizerLanguage

Microsoft dil tokenizer'ı tarafından desteklenen dilleri listeler.

Değer Description
bangla

Bangla için Microsoft tokenizer'ını seçer.

bulgarian

Bulgarca için Microsoft tokenizer'ını seçer.

catalan

Katalanca için Microsoft tokenizer'ını seçer.

chineseSimplified

Çince için Microsoft tokenizer'ını seçer (Basitleştirilmiş).

chineseTraditional

Çince (Geleneksel) için Microsoft tokenizer'ını seçer.

croatian

Hırvatça için Microsoft tokenizer'ını seçer.

czech

Çekçe için Microsoft tokenizer'ını seçer.

danish

Dança için Microsoft tokenizer'ını seçer.

dutch

Hollanda için Microsoft tokenizer'ını seçer.

english

İngilizce için Microsoft tokenizer'ını seçer.

french

Fransızca için Microsoft tokenizer'ını seçer.

german

Almanca için Microsoft tokenizer'ını seçer.

greek

Yunanca için Microsoft tokenizer'ını seçer.

gujarati

Gujarati için Microsoft tokenizer'ını seçer.

hindi

Hintçe için Microsoft tokenizer'ını seçer.

icelandic

İzlanda için Microsoft tokenizer'ını seçer.

indonesian

Endonezya için Microsoft tokenizer'ını seçer.

italian

İtalyanca için Microsoft tokenizer'ını seçer.

japanese

Japonca için Microsoft tokenizer'ını seçer.

kannada

Kannada için Microsoft tokenizer'ını seçer.

korean

Korece için Microsoft tokenizer'ını seçer.

malay

Malay için Microsoft tokenizer'ını seçer.

malayalam

Malayalam için Microsoft tokenizer'ını seçer.

marathi

Marathi için Microsoft tokenizer'ını seçer.

norwegianBokmaal

Norveççe için Microsoft tokenizer'ı seçer (BokmÃ¥l).

polish

Polonya için Microsoft tokenizer'ını seçer.

portuguese

Portekizce için Microsoft tokenizer'ını seçer.

portugueseBrazilian

Portekizce (Brezilya) için Microsoft tokenizer'ını seçer.

punjabi

Pencapça için Microsoft tokenizer'ını seçer.

romanian

Romanca için Microsoft tokenizer'ını seçer.

russian

Rusça için Microsoft tokenizer'ını seçer.

serbianCyrillic

Sırp (Kiril) için Microsoft tokenizer'ını seçer.

serbianLatin

Sırpça (Latince) için Microsoft tokenizer'ını seçer.

slovenian

Slovence için Microsoft tokenizer'ını seçer.

spanish

İspanyolca için Microsoft tokenizer'ını seçer.

swedish

İsveççe için Microsoft tokenizer'ını seçer.

tamil

Tamilce için Microsoft tokenizer'ını seçer.

telugu

Telugu için Microsoft tokenizer'ını seçer.

thai

Taylandca için Microsoft tokenizer'ını seçer.

ukrainian

Ukraynaca için Microsoft tokenizer'ını seçer.

urdu

Urduca için Microsoft tokenizer'ını seçer.

vietnamese

Vietnamca için Microsoft tokenizer'ını seçer.

NGramTokenFilter

Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.NGramTokenFilter

Türetilmiş türler için ayrımcı.

maxGram

integer (int32)

2

En fazla n gram uzunluk. Varsayılan değer 2'dir.

minGram

integer (int32)

1

En az n gram uzunluk. Varsayılan değer 1'dir. maxGram değerinden küçük olmalıdır.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

NGramTokenFilterV2

Verilen boyutların n gramını oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.NGramTokenFilterV2

Türetilmiş türler için ayrımcı.

maxGram

integer (int32)

maximum: 300
2

En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür.

minGram

integer (int32)

maximum: 300
1

En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

NGramTokenizer

Girişi verilen boyutların n gramını belirteci haline getirmektedir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.NGramTokenizer

Türetilmiş türler için ayrımcı.

maxGram

integer (int32)

maximum: 300
2

En fazla n gram uzunluk. Varsayılan değer 2'dir. Maksimum değer 300'dür.

minGram

integer (int32)

maximum: 300
1

En az n gram uzunluk. Varsayılan değer 1'dir. Maksimum değer 300'dür. maxGram değerinden küçük olmalıdır.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

tokenChars

TokenCharacterKind[]

Belirteçlerde tutulacak karakter sınıfları.

PathHierarchyTokenizerV2

Yol benzeri hiyerarşiler için belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.PathHierarchyTokenizerV2

Türetilmiş türler için ayrımcı.

delimiter

string

maxLength: 1
/

Kullanılacak sınırlayıcı karakteri. Varsayılan değer "/" şeklindedir.

maxTokenLength

integer (int32)

maximum: 300
300

En fazla belirteç uzunluğu. Varsayılan ve maksimum değer 300'dür.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

replacement

string

maxLength: 1
/

Ayarlanırsa sınırlayıcı karakterinin yerini alan bir değer. Varsayılan değer "/" şeklindedir.

reverse

boolean

False

Belirteçlerin ters sırada oluşturulup oluşturulmayacağını gösteren bir değer. Varsayılan değer false'tur.

skip

integer (int32)

0

Atlana ilk belirteçlerin sayısı. Varsayılan değer 0'dır.

PatternAnalyzer

Normal ifade deseni aracılığıyla metni esnek bir şekilde terimlere ayırır. Bu çözümleyici Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.PatternAnalyzer

Türetilmiş türler için ayrımcı.

flags

string

RegexFlags değerlerinden oluşan '|' ayrılmış bir dizi olarak tanımlanan düzenli ifade bayrakları.

lowercase

boolean

True

Terimlerin küçük harfle yazılıp yazılmayacağını belirten bir değer. Varsayılan değer doğrudur

name

string

Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

pattern

string

\W+

Belirteç ayırıcılarıyla eşleşmesi için bir normal ifade deseni. Varsayılan, sözcük olmayan bir veya daha fazla karakterle eşleşen bir ifadedir.

stopwords

string[]

Stopwords listesi.

PatternCaptureTokenFilter

Bir veya daha fazla desendeki her yakalama grubu için bir tane olmak üzere birden çok belirteç yaymak için Java regexes kullanır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.PatternCaptureTokenFilter

Türetilmiş türler için ayrımcı.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

patterns

string[]

Her belirteçle eşleşecek desenlerin listesi.

preserveOriginal

boolean

True

Desenlerden biri eşleşse bile özgün belirtecin döndürülip döndürülmeyeceğini belirten bir değer. Varsayılan değer doğrudur

PatternReplaceCharFilter

Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu karakter filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.PatternReplaceCharFilter

Türetilmiş türler için ayrımcı.

name

string

Karakter filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

pattern

string

Normal ifade deseni.

replacement

string

Değiştirme metni.

PatternReplaceTokenFilter

Giriş dizesindeki karakterlerin yerini alan karakter filtresi. Korunacak karakter dizilerini tanımlamak için normal bir ifade ve değiştirilecek karakterleri tanımlamak için bir değiştirme düzeni kullanır. Örneğin, "aa bb aa bb", desen "(aa)\s+(bb)" ve yerine "$1#$2" giriş metni verilmelidir, sonuç "aa#bb aa#bb" olacaktır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.PatternReplaceTokenFilter

Türetilmiş türler için ayrımcı.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

pattern

string

Normal ifade deseni.

replacement

string

Değiştirme metni.

PatternTokenizer

Farklı belirteçler oluşturmak için regex desen eşleştirmesi kullanan belirteç oluşturucu. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.PatternTokenizer

Türetilmiş türler için ayrımcı.

flags

string

RegexFlags değerlerinden oluşan '|' ayrılmış bir dizi olarak tanımlanan düzenli ifade bayrakları.

group

integer (int32)

-1

Belirteçlere ayıklamak için normal ifade desenindeki eşleşen grubun sıfır tabanlı sırası. Eşleşen gruplardan bağımsız olarak girdiyi belirteçlere bölmek için tüm deseni kullanmak istiyorsanız -1 kullanın. Varsayılan değer -1'dir.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

pattern

string

\W+

Belirteç ayırıcılarıyla eşleşmesi için bir normal ifade deseni. Varsayılan, sözcük olmayan bir veya daha fazla karakterle eşleşen bir ifadedir.

PhoneticEncoder

PhoneticTokenFilter ile kullanılacak fonetik kodlayıcı türünü tanımlar.

Değer Description
metaphone

Bir belirteci Metafon değerine kodlar.

doubleMetaphone

Bir belirteci çift metafon değerine kodlar.

soundex

Bir belirteci Soundex değerine kodlar.

refinedSoundex

Bir belirteci Rafine Soundex değerine kodlar.

caverphone1

Bir belirteci Caverphone 1.0 değerine kodlar.

caverphone2

Bir belirteci Caverphone 2.0 değerine kodlar.

cologne

Bir belirteci Köln Fonetik değerine kodlar.

nysiis

Bir belirteci bir NYSIIS değerine kodlar.

koelnerPhonetik

Kölner Phonetik algoritmasını kullanarak bir belirteci kodlar.

haasePhonetik

Kölner Phonetik algoritmasının Haase iyileştirmesini kullanarak bir belirteci kodlar.

beiderMorse

Belirteci Beider-Morse bir değere kodlar.

PhoneticTokenFilter

Fonetik eşleşmeler için belirteçler oluşturun. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.PhoneticTokenFilter

Türetilmiş türler için ayrımcı.

encoder

PhoneticEncoder

metaphone

Kullanılacak fonetik kodlayıcı. Varsayılan değer "metaphone" şeklindedir.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

replace

boolean

True

Kodlanmış belirteçlerin özgün belirteçlerin yerini alıp almayacağını gösteren değer. False ise kodlanmış belirteçler eş anlamlı olarak eklenir. Varsayılan değer doğrudur

RankingOrder

Belgelerin sıralama düzeni için kullanılacak puanı temsil eder.

Değer Description
BoostedRerankerScore

Sıralama düzenini BoostedRerankerScore olarak ayarlar

RerankerScore

Sıralama düzenini ReRankerScore olarak ayarlar

RescoringOptions

Yeniden puanlama seçeneklerini içerir.

Name Tür Default value Description
defaultOversampling

number (double)

Varsayılan fazla örnekleme faktörü. Yüksek hızda örnekleme, nicelemeden kaynaklanan çözünürlük kaybını dengelemek için daha büyük bir potansiyel belge kümesini alır. Bu, tam duyarlıklı vektörlerde yeniden puanlanacak sonuç kümesini artırır. En düşük değer 1'dir, yani fazla örnekleme (1x). Bu parametre yalnızca 'enableRescoring' true olduğunda ayarlanabilir. Daha yüksek değerler gecikme süresiyle geri çağırmayı iyileştirir.

enableRescoring

boolean

True

Doğru olarak ayarlanırsa, sıkıştırılmış vektörler üzerinde yapılan ilk aramadan sonra, benzerlik puanları tam duyarlıklı vektörler kullanılarak yeniden hesaplanır. Bu, gecikme süresine karşı geri çağırmayı iyileştirir.

rescoreStorageMethod enum:
  • discardOriginals
  • preserveOriginals
preserveOriginals

Orijinal vektörler için depolama yöntemini kontrol eder. Bu ayar sabittir.

ScalarQuantizationCompression

Dizin oluşturma ve sorgulama sırasında kullanılan skaler niceleme sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir.

Name Tür Description
kind string:

scalarQuantization

VektörAramaSıkıştırma Türü.

name

string

Bu özel yapılandırmayla ilişkilendirilecek ad.

rescoringOptions

RescoringOptions

Yeniden puanlama seçeneklerini içerir.

scalarQuantizationParameters

ScalarQuantizationParameters

Skaler Niceleme'ye özgü parametreleri içerir.

truncationDimension

integer (int32)

Vektörlerin kesilmesi için boyut sayısı. Vektörlerin kesilmesi, vektörlerin boyutunu ve arama sırasında aktarılması gereken veri miktarını azaltır. Bu, depolama maliyetinden tasarruf edebilir ve geri çekme pahasına arama performansını artırabilir. Yalnızca OpenAI metin ekleme-3-büyük (küçük) gibi Matryoshka Temsili Öğrenmesi (MRL) ile eğitilen eklemeler için kullanılmalıdır. Varsayılan değer null'tır, yani kesme yoktur.

ScalarQuantizationParameters

Skaler Niceleme'ye özgü parametreleri içerir.

Name Tür Description
quantizedDataType

VectorSearchCompressionTarget

Sıkıştırılmış vektör değerlerinin nicelleştirilmiş veri türü.

ScoringFunctionAggregation

Bir puanlama profilindeki tüm puanlama işlevlerinin sonuçlarını birleştirmek için kullanılan toplama işlevini tanımlar.

Değer Description
sum

Puanları, tüm puanlama işlevi sonuçlarının toplamına göre artırın.

average

Puanları, tüm puanlama işlevi sonuçlarının ortalaması kadar artırın.

minimum

Puanları, tüm puanlama işlevi sonuçlarının minimumu kadar artırın.

maximum

Puanları, tüm puanlama işlevi sonuçlarının maksimumu kadar artırın.

firstMatching

Puanlama profilinde ilk geçerli puanlama işlevini kullanarak puanları artırın.

product

Tüm puanlama işlevi sonuçlarının çarpımına göre puanları artırın.

ScoringFunctionInterpolation

Bir dizi belgede puan artırmayı enterpolasyon yapmak için kullanılan işlevi tanımlar.

Değer Description
linear

Puanları doğrusal olarak azalan bir miktarda artırır. Bu, puanlama işlevleri için varsayılan enterpolasyondur.

constant

Puanları sabit bir faktörle artırır.

quadratic

Puanları ikinci dereceden azalan bir miktarda artırır. Takviyeler, daha yüksek puanlar için yavaş ve puanlar azaldıkça daha hızlı azalır. Bu enterpolasyon seçeneğine, etiket puanlama işlevlerinde izin verilmez.

logarithmic

Puanları logaritmik olarak azalan bir miktarda artırır. Artışlar, daha yüksek puanlar için hızlı bir şekilde azalır ve puanlar azaldıkça daha yavaş azalır. Bu enterpolasyon seçeneğine, etiket puanlama işlevlerinde izin verilmez.

ScoringProfile

Arama sorgularında puanlama işlemini etkileyen bir arama dizininin parametrelerini tanımlar.

Name Tür Description
functionAggregation

ScoringFunctionAggregation

Tek tek puanlama işlevlerinin sonuçlarının nasıl birleştirilmesi gerektiğini gösteren bir değer. Varsayılan olarak "Toplam" kullanılır. Puanlama işlevi yoksa yoksayılır.

functions ScoringFunction[]:

Belgelerin puanlanmasını etkileyen işlevlerin toplamı.

name

string

Puanlama profilinin adı.

text

TextWeights

Belirli dizin alanlarındaki metin eşleşmelerine dayalı olarak puanlamayı artıran parametreler.

SearchField

Bir alanın adını, veri türünü ve arama davranışını açıklayan dizin tanımındaki bir alanı temsil eder.

Name Tür Description
analyzer

LexicalAnalyzerName

Alan için kullanılacak çözümleyicinin adı. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir ve searchAnalyzer veya indexAnalyzer ile birlikte ayarlanamaz. Çözümleyici seçildikten sonra alan için değiştirilemez. Karmaşık alanlar için null olmalıdır.

dimensions

integer (int32)

minimum: 2
maximum: 4096

Vektör alanının boyutsallığı.

facetable

boolean

Model sorgularında alana başvurulmasının etkinleştirilip etkinleştirilmeymeyeceğini gösteren değer. Genellikle kategoriye göre isabet sayısını içeren arama sonuçlarının bir sunumunda kullanılır (örneğin, dijital kameraları arayın ve markaya göre, megapiksellere, fiyata vb. göre isabetleri görün). Bu özellik karmaşık alanlar için null olmalıdır. Edm.GeographyPoint veya Collection(Edm.GeographyPoint) türünde alanlar modellenemez. Varsayılan değer, diğer tüm basit alanlar için geçerlidir.

fields

SearchField[]

Bu Edm.ComplexType veya Collection(Edm.ComplexType) türünde bir alansa, alt alanların listesi. Basit alanlar için null veya boş olmalıdır.

filterable

boolean

$filter sorgularda alana başvurulmasının etkinleştirilip etkinleştirilmeymeyeceğini gösteren değer. filterable, dizelerin işlenme biçiminde aranabilirden farklıdır. Filtrelenebilir Edm.String veya Collection(Edm.String) türündeki alanlarda sözcük kesme işlemi yapılmaz, bu nedenle karşılaştırmalar yalnızca tam eşleşmeler içindir. Örneğin, f alanını "güneşli gün" olarak ayarlarsanız, $filter=f eq 'güneşli' eşleşme bulamaz, ancak $filter=f eq 'güneşli gün'. Bu özellik karmaşık alanlar için null olmalıdır. Varsayılan değer basit alanlar için doğru, karmaşık alanlar için null değeridir.

indexAnalyzer

LexicalAnalyzerName

Alan için dizin oluşturma zamanında kullanılan çözümleyicinin adı. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir. SearchAnalyzer ile birlikte ayarlanmalıdır ve çözümleyici seçeneğiyle birlikte ayarlanamaz. Bu özellik bir dil çözümleyicisinin adına ayarlanamaz; dil çözümleyicisine ihtiyacınız varsa çözümleyici özelliğini kullanın. Çözümleyici seçildikten sonra alan için değiştirilemez. Karmaşık alanlar için null olmalıdır.

key

boolean

Alanın dizindeki belgeleri benzersiz olarak tanımlayıp tanımlamadığını gösteren değer. Her dizinde tam olarak bir üst düzey alan anahtar alanı olarak seçilmeli ve Edm.String türünde olmalıdır. Önemli alanlar, belgeleri doğrudan aramak ve belirli belgeleri güncelleştirmek veya silmek için kullanılabilir. Varsayılan değer, basit alanlar için false ve karmaşık alanlar için null değeridir.

name

string

Dizin veya üst alanın alan koleksiyonu içinde benzersiz olması gereken alanın adı.

normalizer

LexicalNormalizerName

Alan için kullanılacak normalleştiricinin adı. Bu seçenek yalnızca filtrelenebilir, sıralanabilir veya facetable özelliği etkinleştirilmiş alanlarla kullanılabilir. Normalleştirici seçildikten sonra, alan için değiştirilemez. Karmaşık alanlar için null olmalıdır.

retrievable

boolean

Alanın bir arama sonucunda döndürülebilir olup olmadığını gösteren değer. Bir alanı (örneğin, kenar boşluğu) filtre, sıralama veya puanlama mekanizması olarak kullanmak ancak alanın son kullanıcıya görünür olmasını istemiyorsanız bu seçeneği devre dışı bırakabilirsiniz. Bu özellik anahtar alanlar için true olmalı ve karmaşık alanlar için null olmalıdır. Bu özellik mevcut alanlarda değiştirilebilir. Bu özelliğin etkinleştirilmesi dizin depolama gereksinimlerinde herhangi bir artışa neden olmaz. Varsayılan değer basit alanlar için true, vektör alanları için false ve karmaşık alanlar için null değeridir.

searchAnalyzer

LexicalAnalyzerName

Alan için arama zamanında kullanılan çözümleyicinin adı. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir. indexAnalyzer ile birlikte ayarlanmalıdır ve çözümleyici seçeneğiyle birlikte ayarlanamaz. Bu özellik bir dil çözümleyicisinin adına ayarlanamaz; dil çözümleyicisine ihtiyacınız varsa çözümleyici özelliğini kullanın. Bu çözümleyici mevcut bir alanda güncelleştirilebilir. Karmaşık alanlar için null olmalıdır.

searchable

boolean

Alanın tam metin aranabilir olup olmadığını gösteren değer. Bu, dizin oluşturma sırasında sözcük kesme gibi bir analizden geçeceği anlamına gelir. Aranabilir bir alanı "güneşli gün" gibi bir değere ayarlarsanız, dahili olarak "güneşli" ve "gün" belirteçlerine bölünür. Bu, bu terimler için tam metin aramaları sağlar. Edm.String veya Collection(Edm.String) türündeki alanlar varsayılan olarak aranabilir. Bu özellik, diğer dize olmayan veri türlerinin basit alanları için false olmalı ve karmaşık alanlar için null olmalıdır. Not: Aranabilir alanlar, tam metin aramaları için alan değerinin ek belirteçli sürümlerini barındırmak için dizininizde fazladan alan kullanır. Dizininizde yer kazanmak istiyorsanız ve aramalara bir alanın eklenmesi gerekmiyorsa, aranabilir değerini false olarak ayarlayın.

sortable

boolean

$orderby ifadelerinde alana başvurulmasının etkinleştirilip etkinleştirilmeymeyeceğini gösteren değer. Varsayılan olarak, arama altyapısı sonuçları puana göre sıralar, ancak birçok deneyimde kullanıcılar belgelerdeki alanlara göre sıralamak isteyecektir. Basit bir alan yalnızca tek değerliyse sıralanabilir (üst belge kapsamında tek bir değere sahiptir). Basit koleksiyon alanları çok değerli olduğundan sıralanabilir olamaz. Karmaşık koleksiyonların basit alt alanları da çok değerlidir ve bu nedenle sıralanamaz. Bu, ister doğrudan bir üst alan ister bir atalar alanı olsun, karmaşık koleksiyon budur. Karmaşık alanlar sıralanabilir olamaz ve bu tür alanlar için sıralanabilir özelliğin null olması gerekir. Sıralanabilir için varsayılan değer, tek değerli basit alanlar için doğru, çok değerli basit alanlar için false ve karmaşık alanlar için null değeridir.

stored

boolean

Alanın bir arama sonucunda döndürülmek üzere diskte ayrı olarak kalıcı olup olmayacağını gösteren sabit bir değer. Depolama ek yükünden tasarruf etmek için arama yanıtında alan içeriğini döndürmeyi planlamıyorsanız bu seçeneği devre dışı bırakabilirsiniz. Bu yalnızca dizin oluşturma sırasında ve yalnızca vektör alanları için ayarlanabilir. Bu özellik mevcut alanlar için değiştirilemez veya yeni alanlar için false olarak ayarlanamaz. Bu özellik false olarak ayarlanırsa, 'retrievable' özelliği de false olarak ayarlanmalıdır. Bu özellik anahtar alanlar, yeni alanlar ve vektör olmayan alanlar için true veya unset olmalı ve karmaşık alanlar için null olmalıdır. Bu özelliğin devre dışı bırakılması dizin depolama gereksinimlerini azaltır. Vektör alanları için varsayılan değer doğrudur.

synonymMaps

string[]

Bu alanla ilişkilendirilecek eş anlamlılar haritalarının isimlerinin listesi. Bu seçenek yalnızca aranabilir alanlarla kullanılabilir. Şu anda alan başına yalnızca bir eş anlamlı eşleme desteklenir. Bir alana eş anlamlı eşlem atamak, bu alanı hedefleyen sorgu terimlerinin eş anlamlı eşlemedeki kurallar kullanılarak sorgu zamanında genişletilmesini sağlar. Bu öznitelik mevcut alanlarda değiştirilebilir. Karmaşık alanlar için null veya boş bir koleksiyon olmalıdır.

type

SearchFieldDataType

Alanın veri türü.

vectorEncoding

VectorEncodingFormat

Alan içeriğini yorumlamak için kodlama biçimi.

vectorSearchProfile

string

Vektör alanında arama yaparken kullanılacak algoritmayı ve vektörleştiriciyi belirten vektör arama profilinin adı.

SearchFieldDataType

Arama dizinindeki bir alanın veri türünü tanımlar.

Değer Description
Edm.String

Bir alanın dize içerdiğini gösterir.

Edm.Int32

Bir alanın 32 bit imzalı bir tamsayı içerdiğini gösterir.

Edm.Int64

Bir alanın 64 bit imzalı bir tamsayı içerdiğini gösterir.

Edm.Double

Bir alanın IEEE çift duyarlıklı kayan nokta numarası içerdiğini gösterir.

Edm.Boolean

Bir alanın Boole değeri (true veya false) içerdiğini gösterir.

Edm.DateTimeOffset

Bir alanın saat dilimi bilgileri de dahil olmak üzere bir tarih/saat değeri içerdiğini gösterir.

Edm.GeographyPoint

Bir alanın boylam ve enlem açısından coğrafi konum içerdiğini gösterir.

Edm.ComplexType

Bir alanın, başka türlerde alt alanları olan bir veya daha fazla karmaşık nesne içerdiğini gösterir.

Edm.Single

Bir alanın tek duyarlıklı kayan nokta numarası içerdiğini gösterir. Bu yalnızca Collection(Edm.Single) ile kullanıldığında geçerlidir.

Edm.Half

Bir alanın yarım duyarlıklı kayan nokta numarası içerdiğini gösterir. Bu yalnızca Collection(Edm.Half) ile kullanıldığında geçerlidir.

Edm.Int16

Bir alanın 16 bit imzalı bir tamsayı içerdiğini gösterir. Bu yalnızca Collection(Edm.Int16) ile kullanıldığında geçerlidir.

Edm.SByte

Bir alanın 8 bit imzalı bir tamsayı içerdiğini gösterir. Bu yalnızca Collection(Edm.SByte) ile kullanıldığında geçerlidir.

Edm.Byte

Bir alanın 8 bit işaretsiz tamsayı içerdiğini gösterir. Bu yalnızca Collection(Edm.Byte) ile kullanıldığında geçerlidir.

SearchIndex

Bir dizinin alanlarını ve arama davranışını açıklayan bir arama dizini tanımını temsil eder.

Name Tür Description
@odata.etag

string

Dizinin ETag'i.

analyzers LexicalAnalyzer[]:

Dizin için çözümleyiciler.

charFilters CharFilter[]:

Dizin için karakter filtreleri.

corsOptions

CorsOptions

Dizin için Çıkış Noktaları Arası Kaynak Paylaşımını (CORS) denetleme seçenekleri.

defaultScoringProfile

string

Sorguda belirtilmemişse kullanılacak puanlama profilinin adı. Bu özellik ayarlanmazsa ve sorguda puanlama profili belirtilmezse, varsayılan puanlama (tf-idf) kullanılır.

description

string

Dizinin açıklaması.

encryptionKey

SearchResourceEncryptionKey

Azure Key Vault'ta oluşturduğunuz bir şifreleme anahtarının açıklaması. Bu anahtar, kimsenin, hatta Microsoft'un bile verilerinizi şifreleyemeyeceğine tam güvence vermek istediğinizde, verileriniz için ek bir şifreleme seviyesi sağlamak için kullanılır. Verilerinizi şifreledikten sonra her zaman şifrelenmiş olarak kalır. Arama hizmeti, bu özelliği null olarak ayarlama girişimlerini yoksayar. Şifreleme anahtarınızı döndürmek istiyorsanız bu özelliği gerektiği gibi değiştirebilirsiniz; Verileriniz etkilenmez. Müşteri tarafından yönetilen anahtarlarla şifreleme, ücretsiz arama hizmetlerinde kullanılamaz ve yalnızca 1 Ocak 2019 veya sonrasında oluşturulan ücretli hizmetler için kullanılabilir.

fields

SearchField[]

Dizinin alanları.

name

string

Dizinin adı.

normalizers LexicalNormalizer[]:

CustomNormalizer[]

Dizin için normalleştiriciler.

scoringProfiles

ScoringProfile[]

Dizin için puanlama profilleri.

semantic

SemanticSearch

Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar.

similarity SimilarityAlgorithm:

Arama sorgusuyla eşleşen belgeleri puanlama ve derecelendirme sırasında kullanılacak benzerlik algoritmasının türü. Benzerlik algoritması yalnızca dizin oluşturma zamanında tanımlanabilir ve mevcut dizinlerde değiştirilemez. Null ise ClassicSimilarity algoritması kullanılır.

suggesters

SearchSuggester[]

Dizin için öneride bulunanlar.

tokenFilters TokenFilter[]:

Belirteç, dizin için filtreler.

tokenizers LexicalTokenizer[]:

Dizin için belirteç oluşturucular.

vectorSearch

VectorSearch

Vektör araması ile ilgili yapılandırma seçeneklerini içerir.

SearchIndexerDataNoneIdentity

Veri kaynağının kimlik özelliğini temizler.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.DataNoneIdentity

Kimlik türünü belirten bir URI parçası.

SearchIndexerDataUserAssignedIdentity

Kullanılacak veri kaynağının kimliğini belirtir.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.DataUserAssignedIdentity

Kimlik türünü belirten bir URI parçası.

userAssignedIdentity

string

Kullanıcı tarafından atanan yönetilen kimliğin tam Azure kaynak kimliği genellikle arama hizmetine atanması gereken "/subscriptions/12345678-1234-1234-1234-123467890ab/resourceGroups/rg/providers/Microsoft.ManagedIdentity/userAssignedIdentities/myId" biçimindedir.

SearchResourceEncryptionKey

Azure Key Vault'ta müşteri tarafından yönetilen bir şifreleme anahtarı. Oluşturduğunuz ve yönettiğiniz anahtarlar, dizinler ve eş anlamlı eşlemeler gibi bekleyen verileri şifrelemek veya şifresini çözmek için kullanılabilir.

Name Tür Description
accessCredentials.applicationId

string

Bekleyen verilerinizi şifrelerken kullanılacak Azure Key Vault'a gerekli erişim izinleri verilmiş bir AAD Uygulama Kimliği. Uygulama Kimliği, AAD Uygulamanızın Nesne Kimliği ile karıştırılmamalıdır.

accessCredentials.applicationSecret

string

Belirtilen AAD uygulamasının kimlik doğrulama anahtarı.

identity SearchIndexerDataIdentity:

Bu şifreleme anahtarı için kullanılacak açık bir yönetilen kimlik. Belirtilmezse ve erişim kimlik bilgileri özelliği null ise, sistem tarafından atanan yönetilen kimlik kullanılır. Kaynağa güncelleştirildiğinde, açık kimlik belirtilmezse değişmeden kalır. "Hiçbiri" belirtilirse, bu özelliğin değeri temizlenir.

keyVaultKeyName

string

Bekleyen verilerinizi şifrelemek için kullanılacak Azure Key Vault anahtarınızın adı.

keyVaultKeyVersion

string

Bekleyen verilerinizi şifrelemek için kullanılacak Azure Key Vault anahtarınızın sürümü.

keyVaultUri

string

Bekleyen verilerinizi şifrelemek için kullanılacak anahtarı içeren, DNS adı olarak da adlandırılan Azure Key Vault URI'sidir. Örnek bir URI https://my-keyvault-name.vault.azure.netolabilir.

SearchSuggester

Öneri API'sinin dizindeki bir alan grubuna nasıl uygulanacağını tanımlar.

Name Tür Description
name

string

Önerenin adı.

searchMode enum:

analyzingInfixMatching

Önerenin yeteneklerini gösteren bir değer.

sourceFields

string[]

Önerinin uygulandığı alan adlarının listesi. Her alan aranabilir olmalıdır.

SemanticConfiguration

Anlamsal özellikler bağlamında kullanılacak belirli bir yapılandırmayı tanımlar.

Name Tür Description
name

string

Anlamsal yapılandırmanın adı.

prioritizedFields

SemanticPrioritizedFields

Anlam derecelendirmesi, açıklamalı alt yazılar, vurgular ve yanıtlar için kullanılacak başlık, içerik ve anahtar sözcük alanlarını açıklar. Üç alt özellikten en az birinin (titleField, prioritizedKeywordsFields ve prioritizedContentFields) ayarlanması gerekir.

rankingOrder

RankingOrder

Arama sonuçlarının sıralama düzeni için kullanılacak puan türünü belirtir.

SemanticField

Anlamsal yapılandırmanın bir parçası olarak kullanılan alan.

Name Tür Description
fieldName

string

Dosya adı

SemanticPrioritizedFields

Anlam derecelendirmesi, açıklamalı alt yazılar, vurgular ve yanıtlar için kullanılacak başlık, içerik ve anahtar sözcük alanlarını açıklar.

Name Tür Description
prioritizedContentFields

SemanticField[]

Anlamsal sıralama, başlıklar, vurgular ve yanıtlar için kullanılacak içerik alanlarını tanımlar. En iyi sonucu elde etmek için, seçilen alanların doğal dil biçiminde metin içermesi gerekir. Dizideki alanların sırası, önceliklerini temsil eder. İçerik uzunsa daha düşük önceliğe sahip alanlar kesilebilir.

prioritizedKeywordsFields

SemanticField[]

Anlamsal sıralama, başlıklar, vurgular ve yanıtlar için kullanılacak anahtar kelime alanlarını tanımlar. En iyi sonucu elde etmek için, seçilen alanlar bir anahtar kelime listesi içermelidir. Dizideki alanların sırası, önceliklerini temsil eder. İçerik uzunsa daha düşük önceliğe sahip alanlar kesilebilir.

titleField

SemanticField

Anlamsal sıralama, başlıklar, vurgular ve yanıtlar için kullanılacak başlık alanını tanımlar. Dizininizde bir başlık alanınız yoksa, bu alanı boş bırakın.

SemanticSearch

Anlamsal özellikleri etkileyen bir arama dizini için parametreleri tanımlar.

Name Tür Description
configurations

SemanticConfiguration[]

Dizin için anlamsal yapılandırmalar.

defaultConfiguration

string

Dizininizde varsayılan bir anlamsal yapılandırmanın adını ayarlamanıza olanak tanır ve her seferinde sorgu parametresi olarak geçirmeyi isteğe bağlı hale getirir.

ShingleTokenFilter

Belirteç birleşimlerini tek bir belirteç olarak oluşturur. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.ShingleTokenFilter

Türetilmiş türler için ayrımcı.

filterToken

string

_

Belirtecin olmadığı her konum için eklenecek dize. Varsayılan, bir alt çizgidir ("_").

maxShingleSize

integer (int32)

minimum: 2
2

Maksimum zona boyutu. Varsayılan ve en düşük değer 2'dir.

minShingleSize

integer (int32)

minimum: 2
2

En düşük zona boyutu. Varsayılan ve en düşük değer 2'dir. maxShingleSize değerinden küçük olmalıdır.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

outputUnigrams

boolean

True

Çıkış akışının hem giriş belirteçlerini (tek birimleri) hem de zonaları içerip içermeyeceğini gösteren bir değer. Varsayılan değer doğrudur

outputUnigramsIfNoShingles

boolean

False

Kullanılabilir zona olmadığı zamanlarda tek birimlerin çıkışını alıp almayacağını belirten bir değer. OutputUnigrams false olarak ayarlandığında bu özellik önceliklidir. Varsayılan değer false'tur.

tokenSeparator

string

Bir shingle oluşturmak için bitişik belirteçleri birleştirirken kullanılacak dize. Varsayılan değer tek bir boşluk (" ") şeklindedir.

SnowballTokenFilter

Snowball tarafından oluşturulan kök ayırıcı kullanarak sözcüklerin köklerini oluşturan bir filtre. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.SnowballTokenFilter

Türetilmiş türler için ayrımcı.

language

SnowballTokenFilterLanguage

Kullanılacak dil.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

SnowballTokenFilterLanguage

Snowball belirteç filtresi için kullanılacak dil.

Değer Description
armenian

Ermenice için Lucene Snowball köklendirme tokenizer'ını seçer.

basque

Bask için Lucene Snowball köklendirme tokenizer'ını seçer.

catalan

Katalanca için Lucene Snowball köklendirme tokenizer'ını seçer.

danish

Danca için Lucene Snowball köklendirme tokenizer'ını seçer.

dutch

Felemenkçe için Lucene Snowball köklendirme tokenizer'ını seçer.

english

İngilizce için Lucene Snowball köklendirme belirteç oluşturucusunu seçer.

finnish

Fince için Lucene Snowball köklendirme tokenizer'ını seçer.

french

Fransızca için Lucene Snowball köklendirme tokenizer'ını seçer.

german

Almanca için Lucene Snowball köklendirme tokenizer'ını seçer.

german2

Alman varyant algoritmasını kullanan Lucene Snowball kök belirteç oluşturucusunu seçer.

hungarian

Macarca için Lucene Snowball köklendirme tokenizer'ını seçer.

italian

İtalyanca için Lucene Snowball köklendirme tokenizer'ını seçer.

kp

Hollandaca için Kraaij-Pohlmann köklendirme algoritmasını kullanan Lucene Snowball köklendirme belirteçleyicisini seçer.

lovins

Lovins köklendirme algoritmasını kullanan İngilizce için Lucene Snowball köklendirme belirteçleyicisini seçer.

norwegian

Norveççe için Lucene Snowball köklendirme tokenizer'ını seçer.

porter

Porter köklendirme algoritmasını kullanan İngilizce için Lucene Snowball köklendirme belirteçleyicisini seçer.

portuguese

Portekizce için Lucene Snowball köklendirme belirteç oluşturucusunu seçer.

romanian

Romence için Lucene Snowball köklendirme tokenizer'ını seçer.

russian

Rusça için Lucene Snowball köklendirme tokenizer'ını seçer.

spanish

İspanyolca için Lucene Snowball köklendirme tokenizer'ını seçer.

swedish

İsveççe için Lucene Snowball köklendirme tokenizer'ını seçer.

turkish

Türkçe için Lucene Snowball köklendirme tokenizer'ını seçer.

StemmerOverrideTokenFilter

Özel sözlük tabanlı kök oluşturma ile diğer kök filtreleme filtrelerini geçersiz kılma olanağı sağlar. Sözlük köküne sahip terimler anahtar sözcük olarak işaretlenir, böylece zincirdeki kök ayırıcılarla kaynaklanmaz. Herhangi bir köklendirme filtresinin önüne yerleştirilmelidir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/StemmerOverrideFilter.html

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.StemmerOverrideTokenFilter

Türetilmiş türler için ayrımcı.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

rules

string[]

Şu biçimdeki kök oluşturma kurallarının listesi: "word => stem", örneğin: "ran => run".

StemmerTokenFilter

Dile özgü gövde filtresi. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#TokenFilters

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.StemmerTokenFilter

Türetilmiş türler için ayrımcı.

language

StemmerTokenFilterLanguage

Kullanılacak dil.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

StemmerTokenFilterLanguage

Stemmer belirteç filtresi için kullanılacak dil.

Değer Description
arabic

Arapça için Lucene köklendirme belirteç oluşturucusunu seçer.

armenian

Ermenice için Lucene kök tokenizer'ı seçer.

basque

Bask için Lucene köklendirme tokenizer'ını seçer.

brazilian

Portekizce (Brezilya) için Lucene köklendirme tokenizer'ını seçer.

bulgarian

Bulgarca için Lucene köklendirme tokenizer'ını seçer.

catalan

Katalanca için Lucene köklendirme tokenizer'ını seçer.

czech

Çekçe için Lucene köklendirme tokenizer'ını seçer.

danish

Danca için Lucene köklendirme tokenizer'ını seçer.

dutch

Felemenkçe için Lucene köklendirme tokenizer'ını seçer.

dutchKp

Hollandaca için Kraaij-Pohlmann köklendirme algoritmasını kullanan Lucene köklendirme belirteçleyicisini seçer.

english

İngilizce için Lucene köklendirme tokenizer'ını seçer.

lightEnglish

İngilizce için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

minimalEnglish

Minimum köklendirme yapan İngilizce için Lucene köklendirme belirteçleyicisini seçer.

possessiveEnglish

Sözcüklerden sondaki iyelik eklerini kaldıran İngilizce için Lucene köklendirme belirteçleyicisini seçer.

porter2

Porter2 köklendirme algoritmasını kullanan İngilizce için Lucene köklendirme belirteçleyicisini seçer.

lovins

Lovins köklendirme algoritmasını kullanan İngilizce için Lucene köklendirme belirteçleyicisini seçer.

finnish

Fince için Lucene köklendirme tokenizer'ını seçer.

lightFinnish

Fince için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

french

Fransızca için Lucene köklendirme tokenizer'ını seçer.

lightFrench

Fransızca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

minimalFrench

Fransızca için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

galician

Galiçya dili için Lucene kök tokenizer'ı seçer.

minimalGalician

Galiçya dili için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

german

Almanca için Lucene köklendirme tokenizer'ını seçer.

german2

Alman varyant algoritmasını kullanan Lucene kök tokenizer'ı seçer.

lightGerman

Almanca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

minimalGerman

Almanca için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

greek

Yunanca için Lucene köklendirme tokenizer'ını seçer.

hindi

Hintçe için Lucene köklendirme belirteç oluşturucusunu seçer.

hungarian

Macarca için Lucene köklendirme tokenizer'ını seçer.

lightHungarian

Macarca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

indonesian

Endonezce için Lucene köklendirme tokenizer'ını seçer.

irish

İrlandaca için Lucene köklendirme tokenizer'ını seçer.

italian

İtalyanca için Lucene köklendirme tokenizer'ını seçer.

lightItalian

İtalyanca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

sorani

Sorani için Lucene köklendirme tokenizer'ını seçer.

latvian

Letonca için Lucene köklendirme tokenizer'ını seçer.

norwegian

Norwegian (BokmÃ¥l) için Lucene stemming tokenizer seçer.

lightNorwegian

Norveççe için Lucene köklü tokenizer'ı seçer (BokmÅl), hafif kök yapma yapar.

minimalNorwegian

Norveççe için (BokmÃ¥l) için minimal stemming yapan Lucene stemming tokenizer'ı seçer.

lightNynorsk

Hafif köklendirme yapan Norveççe (Nynorsk) için Lucene köklendirme belirteçleyicisini seçer.

minimalNynorsk

Minimum köklendirme yapan Norveççe (Nynorsk) için Lucene köklendirme tokenizer'ını seçer.

portuguese

Portekizce için Lucene köklendirme tokenizer'ını seçer.

lightPortuguese

Portekizce için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

minimalPortuguese

Portekizce için minimum köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

portugueseRslp

RSLP köklendirme algoritmasını kullanan Portekizce için Lucene köklendirme belirteçleyicisini seçer.

romanian

Romence için Lucene köklendirme tokenizer'ını seçer.

russian

Rusça için Lucene köklendirme tokenizer'ını seçer.

lightRussian

Rusça için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

spanish

İspanyolca için Lucene köklendirme tokenizer'ını seçer.

lightSpanish

İspanyolca için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

swedish

İsveççe için Lucene köklendirme tokenizer'ını seçer.

lightSwedish

İsveççe için hafif köklendirme yapan Lucene köklendirme belirteçleyicisini seçer.

turkish

Türkçe için Lucene köklendirme tokenizer'ını seçer.

StopAnalyzer

Metni harf olmayanlara böler; Küçük harf ve stopword belirteci filtrelerini uygular. Bu çözümleyici Apache Lucene kullanılarak uygulanır.

Name Tür Description
@odata.type string:

#Microsoft.Azure.Search.StopAnalyzer

Türetilmiş türler için ayrımcı.

name

string

Çözümleyicinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

stopwords

string[]

Stopwords listesi.

StopwordsList

Dile özgü durdurma sözcüklerinin önceden tanımlanmış bir listesini tanımlar.

Değer Description
arabic

Arapça için durdurma sözcüğü listesini seçer.

armenian

Ermenice için durdurma sözcüğü listesini seçer.

basque

Bask için durdurma sözcüğü listesini seçer.

brazilian

Portekizce (Brezilya) için stopword listesini seçer.

bulgarian

Bulgarca için durdurma sözcüğü listesini seçer.

catalan

Katalanca için durdurma sözcüğü listesini seçer.

czech

Çekçe için durdurma sözcüğü listesini seçer.

danish

Danca için durdurma sözcüğü listesini seçer.

dutch

Felemenkçe için durdurma sözcüğü listesini seçer.

english

İngilizce için durdurma sözcüğü listesini seçer.

finnish

Fince için durdurma sözcüğü listesini seçer.

french

Fransızca için durdurma sözcüğü listesini seçer.

galician

Galiçyaca için durdurma sözcüğü listesini seçer.

german

Almanca için durdurma sözcüğü listesini seçer.

greek

Yunanca için durdurma sözcüğü listesini seçer.

hindi

Hintçe için durdurma sözcüğü listesini seçer.

hungarian

Macarca için durdurma sözcüğü listesini seçer.

indonesian

Endonezce için durdurma sözcüğü listesini seçer.

irish

İrlandaca için durdurma sözcüğü listesini seçer.

italian

İtalyanca için durdurma sözcüğü listesini seçer.

latvian

Letonca için durdurma sözcüğü listesini seçer.

norwegian

Norveççe için durdurma sözcüğü listesini seçer.

persian

Farsça için durdurma sözcüğü listesini seçer.

portuguese

Portekizce için durdurma sözcüğü listesini seçer.

romanian

Romence için durdurma sözcüğü listesini seçer.

russian

Rusça için durdurma sözcüğü listesini seçer.

sorani

Sorani için durdurma sözcüğü listesini seçer.

spanish

İspanyolca için durdurma sözcüğü listesini seçer.

swedish

İsveççe için durdurma sözcüğü listesini seçer.

thai

Tay dili için durdurma sözcüğü listesini seçer.

turkish

Türkçe için durdurma sözcüğü listesini seçer.

StopwordsTokenFilter

Belirteç akışından duraklama sözcüklerini kaldırır. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopFilter.html

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.StopwordsTokenFilter

Türetilmiş türler için ayrımcı.

ignoreCase

boolean

False

Büyük/küçük harf yoksayılıp yoksayılmayacağını belirten bir değer. True ise, önce tüm sözcükler küçük harfe dönüştürülür. Varsayılan değer false'tur.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

removeTrailing

boolean

True

Bir durdurma sözcüğüyse son arama teriminin yoksayılıp yoksayılmayacağını belirten değer. Varsayılan değer doğrudur

stopwords

string[]

Stopwords listesi. Bu özellik ve stopwords listesi özelliği ayarlanamaz.

stopwordsList

StopwordsList

english

Kullanılacak önceden tanımlanmış bir stopword listesi. Bu özellik ve stopwords özelliği ayarlanamaz. Varsayılan değer İngilizce'dir.

SynonymTokenFilter

Belirteç akışındaki tek veya çok sözcüklü eş anlamlılarla eşleşir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.SynonymTokenFilter

Türetilmiş türler için ayrımcı.

expand

boolean

True

Eş anlamlılar listesindeki tüm sözcüklerin (eğer => gösterimi kullanılmazsa) birbiriyle eşlenip eşlenmediğini gösteren bir değer. True ise, eş anlamlılar listesindeki tüm sözcükler (eğer => gösterimi kullanılmazsa) birbiriyle eşlenir. Aşağıdaki liste: inanılmaz, inanılmaz, muhteşem, şaşırtıcı eşdeğerdir: inanılmaz, inanılmaz, muhteşem, şaşırtıcı => inanılmaz, inanılmaz, muhteşem, şaşırtıcı. False ise, şu liste: inanılmaz, inanılmaz, muhteşem, şaşırtıcı şunun eşdeğeri olacaktır: inanılmaz, inanılmaz, muhteşem, şaşırtıcı => inanılmaz. Varsayılan değer doğrudur

ignoreCase

boolean

False

Eşleştirme için büyük/küçük harfe katlanmış girişin yapılıp yapılmayacağını gösteren değer. Varsayılan değer false'tur.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

synonyms

string[]

İki biçimden birini izleyen eş anlamlıların listesi: 1. inanılmaz, inanılmaz, muhteşem => şaşırtıcı - => simgesinin sol tarafındaki tüm terimler sağ tarafındaki tüm terimlerle değiştirilecek; 2. inanılmaz, inanılmaz, muhteşem, şaşırtıcı - eşdeğer sözcüklerin virgülle ayrılmış listesi. Bu listenin yorumlandığı şekli değiştirmek için genişletme seçeneğini ayarlayın.

TagScoringFunction

Belirli bir etiket listesiyle eşleşen dize değerleriyle belge puanlarını artıran bir işlev tanımlar.

Name Tür Description
boost

number (double)

Ham puanın çarpanı. 1,0'a eşit olmayan pozitif bir sayı olmalıdır.

fieldName

string

Puanlama işlevine giriş olarak kullanılan alanın adı.

interpolation

ScoringFunctionInterpolation

Artırmanın belge puanları arasında nasıl ilişkilendirilmiş olacağını gösteren değer; varsayılan olarak "Doğrusal" olarak adlandırılır.

tag

TagScoringParameters

Etiket puanlama işlevi için parametre değerleri.

type string:

tag

ScoringFunction türü.

TagScoringParameters

Etiket puanlama işlevine parametre değerleri sağlar.

Name Tür Description
tagsParameter

string

Hedef alanla karşılaştırılacak etiketlerin listesini belirtmek için arama sorgularında geçirilen parametrenin adı.

TextWeights

Eşleşmelerin arama sorgularında puanlamanın artırılması gereken dizin alanlarında ağırlıkları tanımlar.

Name Tür Description
weights

object

Belge puanlamasını artırmak için alan başına ağırlıklar sözlüğü. Anahtarlar alan adlarıdır ve değerler her alanın ağırlıklarıdır.

TokenCharacterKind

Belirteç filtresinin üzerinde çalışabileceği karakter sınıflarını temsil eder.

Değer Description
letter

Harfleri jeton halinde tutar.

digit

Rakamları jetonlarda tutar.

whitespace

Boşlukları belirteçlerde tutar.

punctuation

Noktalama işaretlerini belirteçlerde tutar.

symbol

Sembolleri jetonlarda tutar.

TokenFilterName

Arama motoru tarafından desteklenen tüm belirteç filtrelerinin adlarını tanımlar.

Değer Description
arabic_normalization

Ortografiyi normalleştirmek için Arapça normalleştiriciyi uygulayan bir belirteç filtresi. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ar/ArabicNormalizationFilter.html

apostrophe

Kesme işaretinden sonraki tüm karakterleri (kesme işareti de dahil) siler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/tr/ApostropheFilter.html

asciifolding

İlk 127 ASCII karakterde ("Temel Latin" Unicode bloğu) bulunmayan alfabetik, sayısal ve sembolik Unicode karakterlerini, bu eşdeğerler varsa ASCII eşdeğerlerine dönüştürür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ASCIIFoldingFilter.html

cjk_bigram

Standart belirteç oluşturucudan oluşturulan CJK terimlerinin büyük simgelerini oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/cjk/CJKBigramFilter.html

cjk_width

CJK genişlik farklarını normalleştirir. Tam genişlikteki ASCII varyantlarını eşdeğer temel Latinceye, yarım genişlikteki Katakana varyantlarını ise eşdeğer Kana'ya katlar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/cjk/CJKWidthFilter.html

classic

İngilizce sahiplik ve noktaları kısaltmalardan kaldırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/standard/ClassicFilter.html

common_grams

Dizin oluştururken sık karşılaşılan terimler için bigrams oluşturun. Tek terimler de dizine eklenir ve ikili kelime birimleri üzerine yerleştirilir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/commongrams/CommonGramsFilter.html

edgeNGram_v2

Giriş belirtecinin önünden veya arkasından başlayarak verilen boyutların n gramını oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/EdgeNGramTokenFilter.html

elision

Kısaltmaları kaldırır. Örneğin, "l'avion" (düzlem) "avion" (düzlem) olarak dönüştürülür. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/util/ElisionFilter.html

german_normalization

Almanca karakterleri, German2 kartopu algoritmasının buluşsal yöntemlerine göre normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/de/GermanNormalizationFilter.html

hindi_normalization

Yazım varyasyonlarındaki bazı farklılıkları kaldırmak için Hintçe metinleri normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/hi/HindiNormalizationFilter.html

indic_normalization

Hint dillerindeki metnin Unicode gösterimini normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/in/IndicNormalizationFilter.html

keyword_repeat

Gelen her belirteci bir kez anahtar sözcük, bir kez de anahtar sözcük olmayan olarak iki kez yayar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/KeywordRepeatFilter.html

kstem

İngilizce için yüksek performanslı kstem filtresi. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/en/KStemFilter.html

length

Çok uzun veya çok kısa sözcükleri kaldırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/LengthFilter.html

limit

Dizin oluşturma sırasında belirteç sayısını sınırlar. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/LimitTokenCountFilter.html

lowercase

Belirteç metnini küçük harfe göre normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/LowerCaseFilter.html

nGram_v2

Verilen boyutların n gramını oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ngram/NGramTokenFilter.html

persian_normalization

Farsça için normalleştirme uygular. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/fa/PersianNormalizationFilter.html

phonetic

Fonetik eşleşmeler için belirteçler oluşturun. Bkz. https://lucene.apache.org/core/4_10_3/analyzers-phonetic/org/apache/lucene/analysis/phonetic/package-tree.html

porter_stem

Belirteç akışını dönüştürmek için Porter kök oluşturma algoritmasını kullanır. Bkz. http://tartarus.org/~martin/PorterStemmer

reverse

Belirteç dizesini tersine çevirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/reverse/ReverseStringFilter.html

scandinavian_normalization

Değiştirilebilir İskandinav karakterlerinin kullanımını normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ScandinavianNormalizationFilter.html

scandinavian_folding

Folds İskandinav karakterler ååÃ... äææÃ"Æ->a ve öÖÜ̧Ü̃-o>. Ayrıca aa, ae, ao, oe ve oo çift sesli harf kullanımına karşı ayrımcılığa neden olur ve yalnızca ilkini bırakır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/ScandinavianFoldingFilter.html

shingle

Belirteç birleşimlerini tek bir belirteç olarak oluşturur. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/shingle/ShingleFilter.html

snowball

Snowball tarafından oluşturulan kök ayırıcı kullanarak sözcüklerin köklerini oluşturan bir filtre. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/snowball/SnowballFilter.html

sorani_normalization

Sorani metninin Unicode gösterimini normalleştirir. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/ckb/SoraniNormalizationFilter.html

stemmer

Dile özgü gövde filtresi. Bkz. https://learn.microsoft.com/rest/api/searchservice/Custom-analyzers-in-Azure-Search#TokenFilters

stopwords

Belirteç akışından duraklama sözcüklerini kaldırır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/core/StopFilter.html

trim

Belirteçlerden öndeki ve sondaki boşlukları kırpılır. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/TrimFilter.html

truncate

Terimleri belirli bir uzunlukta kısaltın. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/TruncateTokenFilter.html

unique

Önceki belirteçle aynı metindeki belirteçleri filtreler. Bkz. http://lucene.apache.org/core/4_10_3/analyzers-common/org/apache/lucene/analysis/miscellaneous/RemoveDuplicatesTokenFilter.html

uppercase

Belirteç metnini büyük harfe göre normalleştirir. Bkz. https://lucene.apache.org/core/6_6_1/analyzers-common/org/apache/lucene/analysis/core/UpperCaseFilter.html

word_delimiter

Sözcükleri alt sözcüklere böler ve alt sözcük gruplarında isteğe bağlı dönüştürmeler gerçekleştirir.

TruncateTokenFilter

Terimleri belirli bir uzunlukta kısaltın. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.TruncateTokenFilter

Türetilmiş türler için ayrımcı.

length

integer (int32)

maximum: 300
300

Koşulların kesileceği uzunluk. Varsayılan ve maksimum değer 300'dür.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

UaxUrlEmailTokenizer

URL'ler ve e-postalar tek bir belirteç olacak şekilde işlenir. Bu belirteç oluşturucu Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.UaxUrlEmailTokenizer

Türetilmiş türler için ayrımcı.

maxTokenLength

integer (int32)

maximum: 300
255

En fazla belirteç uzunluğu. Varsayılan değer 255'tir. Uzunluk üst sınırından uzun olan belirteçler bölünür. Kullanılabilecek en fazla belirteç uzunluğu 300 karakterdir.

name

string

Belirteç oluşturucunun adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

UniqueTokenFilter

Önceki belirteçle aynı metindeki belirteçleri filtreler. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.UniqueTokenFilter

Türetilmiş türler için ayrımcı.

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

onlyOnSamePosition

boolean

False

Yinelenenlerin yalnızca aynı konumda kaldırılıp kaldırılmayacağını gösteren bir değer. Varsayılan değer false'tur.

VectorEncodingFormat

Vektör alanı içeriklerini yorumlamak için kodlama biçimi.

Değer Description
packedBit

Daha geniş bir veri türüne paketlenmiş bitleri temsil eden kodlama biçimi.

VectorSearch

Vektör araması ile ilgili yapılandırma seçeneklerini içerir.

Name Tür Description
algorithms VectorSearchAlgorithmConfiguration[]:

Dizin oluşturma veya sorgulama sırasında kullanılan algoritmaya özgü yapılandırma seçeneklerini içerir.

compressions VectorSearchCompression[]:

Dizin oluşturma veya sorgulama sırasında kullanılan sıkıştırma yöntemine özgü yapılandırma seçeneklerini içerir.

profiles

VectorSearchProfile[]

Vektör araması ile kullanılacak yapılandırma birleşimlerini tanımlar.

vectorizers VectorSearchVectorizer[]:

Metin vektör sorgularını vektörleştirmeye ilişkin yapılandırma seçeneklerini içerir.

VectorSearchAlgorithmKind

Dizin oluşturma ve sorgulama için kullanılan algoritma.

Değer Description
hnsw

HNSW (Hiyerarşik Gezinilebilir Küçük Dünya), yaklaşık en yakın komşular algoritması türü.

exhaustiveKnn

Deneme yanılma araması yapacak kapsamlı KNN algoritması.

VectorSearchAlgorithmMetric

Vektör karşılaştırmaları için kullanılacak benzerlik metriği. Ekleme modelinin eğitildiği benzerlik metriğinin seçilmesi önerilir.

Değer Description
cosine

Benzerliklerini ölçmek için vektörler arasındaki açıyı ölçer ve büyüklüğünü göz ardı eder. Açı ne kadar küçük olursa benzerlik de o kadar yakın olur.

euclidean

Çok boyutlu bir alanda vektörler arasındaki düz çizgi mesafesini hesaplar. Mesafe ne kadar küçük olursa benzerlik de o kadar yakın olur.

dotProduct

Hizalamayı ve büyüklük benzerliğini ölçmek için elemana göre ürünlerin toplamını hesaplar. Ne kadar büyük ve daha pozitif olursa benzerlik o kadar yakın olur.

hamming

Yalnızca bit dolu ikili veri türleri için geçerlidir. İkili vektörlerdeki farklı konumları sayarak eşitsizliği belirler. Ne kadar az fark olursa benzerlik o kadar yakın olur.

VectorSearchCompressionKind

Dizin oluşturma ve sorgulama için kullanılan sıkıştırma yöntemi.

Değer Description
scalarQuantization

Skaler Niceleme, bir sıkıştırma yöntemi türüdür. Skaler nicelemede, özgün vektör değerleri daha dar bir türe sıkıştırılır ve azaltılmış bir nicelenmiş değer kümesi kullanılarak vektörün her bileşenini ayrık hale getirerek ve temsil ederek genel veri boyutunu küçültür.

binaryQuantization

İkili Niceleme, bir sıkıştırma yöntemi türüdür. İkili nicelemede özgün vektör değerleri, ikili değerler kullanılarak bir vektördeki her bileşeni ayrıklaştırıp temsil ederek daha dar ikili türe sıkıştırılır ve böylece genel veri boyutu küçültülebilir.

VectorSearchCompressionTarget

Sıkıştırılmış vektör değerlerinin nicelleştirilmiş veri türü.

Değer Description
int8

8 bit işaretli tamsayı.

VectorSearchProfile

Vektör araması ile kullanılacak yapılandırmaların bir bileşimini tanımlar.

Name Tür Description
algorithm

string

Algoritmayı ve isteğe bağlı parametreleri belirten vektör arama algoritması yapılandırmasının adı.

compression

string

Sıkıştırma yöntemini ve isteğe bağlı parametreleri belirten sıkıştırma yöntemi yapılandırmasının adı.

name

string

Bu belirli vektör arama profiliyle ilişkilendirilecek ad.

vectorizer

string

Vektör aramasıyla kullanılmak üzere yapılandırılan vektörleştirmenin adı.

VectorSearchVectorizerKind

Sorgu sırasında kullanılacak vektörleştirme yöntemi.

Değer Description
azureOpenAI

Sorgu zamanında bir Azure OpenAI kaynağı kullanarak eklemeler oluşturun.

customWebApi

Sorgu zamanında özel bir web uç noktası kullanarak eklemeler oluşturun.

aiServicesVision

Azure AI Services Vision Vectorize API'sini kullanarak sorgu zamanında bir görüntü veya metin girişi için eklemeler oluşturun.

aml

Sorgu zamanında Azure Yapay Zeka Atölyesi Model Kataloğu aracılığıyla dağıtılan bir Azure Machine Learning uç noktası kullanarak eklemeler oluşturun.

WebApiVectorizer

Bir sorgu dizesinin vektör eklemesini oluşturmak için kullanıcı tanımlı bir vektörleştirici belirtir. Bir beceri kümesinin özel Web API arabirimi kullanılarak dış vektörleştiricinin tümleştirilmesi sağlanır.

Name Tür Description
customWebApiParameters

WebApiVectorizerParameters

Kullanıcı tanımlı vektörleştiricinin özelliklerini belirtir.

kind string:

customWebApi

VectorSearchVectorizer türü.

name

string

Bu özel vektörleştirme yöntemiyle ilişkilendirilecek ad.

WebApiVectorizerParameters

Kullanıcı tanımlı vektörleştiriciye bağlanma özelliklerini belirtir.

Name Tür Description
authIdentity SearchIndexerDataIdentity:

Giden bağlantılar için kullanılan kullanıcı tarafından atanan yönetilen kimlik. Bir authResourceId sağlanırsa ve belirtilmezse, sistem tarafından atanan yönetilen kimlik kullanılır. Dizin oluşturucu güncelleştirmelerinde kimlik belirtilmezse değer değişmeden kalır. "Yok" olarak ayarlanırsa, bu özelliğin değeri temizlenir.

authResourceId

string

Dönüşümleri sağlayan bir Azure fonksiyonunda veya başka bir uygulamada harici koda bağlanan özel uç noktalar için geçerlidir. Bu değer, Azure Active Directory'ye kaydedildiğinde işlev veya uygulama için oluşturulan uygulama kimliği olmalıdır. Belirtildiğinde, vektörleştirme, arama hizmetinin yönetilen kimliğini (sistem veya kullanıcı tarafından atanan) ve işlevin veya uygulamanın erişim belirtecini kullanarak işleve veya uygulamaya bağlanır ve bu değeri erişim belirtecinin kapsamını oluşturmak için kaynak kimliği olarak kullanır.

httpHeaders

object

HTTP isteğinde bulunmak için gereken üst bilgiler.

httpMethod

string

HTTP isteğinin yöntemi.

timeout

string (duration)

İstek için istenen zaman aşımı. Varsayılan değer 30 saniyedir.

uri

string (uri)

Vektörleştiriciyi sağlayan Web API'sinin URI'si.

WordDelimiterTokenFilter

Sözcükleri alt sözcüklere böler ve alt sözcük gruplarında isteğe bağlı dönüştürmeler gerçekleştirir. Bu belirteç filtresi Apache Lucene kullanılarak uygulanır.

Name Tür Default value Description
@odata.type string:

#Microsoft.Azure.Search.WordDelimiterTokenFilter

Türetilmiş türler için ayrımcı.

catenateAll

boolean

False

Tüm alt parçaların katılmış olup olmayacağını gösteren bir değer. Örneğin, bu true olarak ayarlanırsa, "Azure-Search-1" "AzureSearch1" olur. Varsayılan değer false'tur.

catenateNumbers

boolean

False

Sayı parçalarının en fazla çalıştırılıp çalıştırılmayacağını gösteren bir değer. Örneğin, bu true olarak ayarlanırsa, "1-2" "12" olur. Varsayılan değer false'tur.

catenateWords

boolean

False

Sözcük bölümlerinin en fazla çalıştırılıp çalıştırılmayacağını gösteren değer. Örneğin, bu true olarak ayarlanırsa, "Azure-Search" "AzureSearch" olur. Varsayılan değer false'tur.

generateNumberParts

boolean

True

Sayı alt sözcüğü oluşturulup oluşturulmayacağını gösteren değer. Varsayılan değer doğrudur

generateWordParts

boolean

True

Parça sözcükleri oluşturulup oluşturulmayacağını gösteren bir değer. Ayarlanırsa, sözcük parçalarının oluşturulmasına neden olur; Örneğin, "AzureSearch" "Azure" "Search" olur. Varsayılan değer doğrudur

name

string

Belirteç filtresinin adı. Yalnızca harf, basamak, boşluk, tire veya alt çizgi içermelidir, yalnızca alfasayısal karakterlerle başlayıp bitebilir ve 128 karakterle sınırlıdır.

preserveOriginal

boolean

False

Özgün sözcüklerin korunup korunmayacağını ve alt sözcük listesine eklenip eklenmeyeceğini gösteren değer. Varsayılan değer false'tur.

protectedWords

string[]

Sınırlandırılmaktan korunmak için belirteçlerin listesi.

splitOnCaseChange

boolean

True

caseChange üzerinde sözcüklerin bölünip bölünmeyeceğini belirten bir değer. Örneğin, bu true olarak ayarlanırsa, "AzureSearch" "Azure" "Search" olur. Varsayılan değer doğrudur

splitOnNumerics

boolean

True

Sayılara bölünip bölünmeyeceğini gösteren bir değer. Örneğin, bu true olarak ayarlanırsa, "Azure1Search" "Azure" "1" "Search" olur. Varsayılan değer doğrudur

stemEnglishPossessive

boolean

True

Her alt kelime için sondaki "'leri" kaldırılıp kaldırılmayacağını belirten bir değer. Varsayılan değer doğrudur