IndexingParametersConfiguration interface

Indexelőspecifikus konfigurációs tulajdonságok szótára. Minden név egy adott tulajdonság neve. Minden értéknek primitív típusúnak kell lennie.

Tulajdonságok

allowSkillsetToReadFileData

Ha igaz, létrehoz egy elérési utat //document//file_data, amely a blob adatforrásából letöltött eredeti fájladatokat képviselő objektum. Ez lehetővé teszi az eredeti fájladatok átadását egy egyéni képességnek a bővítési folyamaton belüli feldolgozáshoz, vagy a Dokumentumkinyerési képességnek.

dataToExtract

Megadja az Azure Blob Storage-ból kinyerni kívánt adatokat, és közli az indexelővel, hogy mely adatokat kell kinyerni a képtartalomból, ha az "imageAction" értéke nem "none". Ez egy .PDF vagy más alkalmazás beágyazott képtartalmaira, illetve az Azure-blobokban lévő képfájlokra, például .jpg és .pngvonatkozik.

delimitedTextDelimiter

CSV-blobok esetén az egykarakteres elválasztó karaktert adja meg azokhoz a CSV-fájlokhoz, ahol minden sor új dokumentumot indít el (például "|").

delimitedTextHeaders

CSV-blobok esetén az oszlopfejlécek vesszővel tagolt listáját adja meg, amely hasznos lehet az index célmezőihez való leképezéséhez.

documentRoot

JSON-tömbök esetén, strukturált vagy részben strukturált dokumentum esetén a tulajdonság használatával megadhatja a tömb elérési útját.

excludedFileNameExtensions

Az Azure Blob Storage-ból történő feldolgozáskor figyelmen kívül hagyandó fájlnévkiterjesztések vesszőkkel tagolt listája. Kizárhatja például a ".png, .mp4" lehetőséget, hogy átugorja ezeket a fájlokat az indexelés során.

executionEnvironment

Azt a környezetet adja meg, amelyben az indexelőnek végre kell hajtania.

failOnUnprocessableDocument

Az Azure-blobok esetében állítsa hamis értékre, ha folytatni szeretné az indexelést, ha egy dokumentum indexelése sikertelen.

failOnUnsupportedContentType

Az Azure-blobok esetében állítsa hamis értékre, ha nem támogatott tartalomtípus esetén szeretné folytatni az indexelést, és nem ismeri előre az összes tartalomtípust (fájlkiterjesztést).

firstLineContainsHeaders

CSV-blobok esetén az egyes blobok első (nem üres) sora fejléceket tartalmaz.

imageAction

Meghatározza, hogyan dolgozhatja fel a beágyazott képeket és képfájlokat az Azure Blob Storage-ban. Ha az "imageAction" konfigurációt a "none" értéken kívül más értékre állítja be, egy képességkészletet is hozzá kell csatolni az indexelőhöz.

indexedFileNameExtensions

Az Azure Blob Storage-ból történő feldolgozáskor kiválasztandó fájlnévkiterjesztések vesszőkkel tagolt listája. A ".docx, .pptx, .msg" alkalmazásfájlok indexelésével például kifejezetten belefoglalhatja ezeket a fájltípusokat.

indexStorageMetadataOnlyForOversizedDocuments

Azure-blobok esetén állítsa ezt a tulajdonságot igaz értékre, hogy továbbra is indexelje a tárolási metaadatokat olyan blobtartalmak esetében, amelyek túl nagyok a feldolgozáshoz. A túlméretezett blobokat alapértelmezés szerint hibaként kezeli a rendszer. A blob méretkorlátjaiért lásd: https://learn.microsoft.com/azure/search/search-limits-quotas-capacity.

markdownHeaderDepth

Megadja a Markdown-tartalom csoportosítása során figyelembe vett maximális fejlécmélységet. Az alapértelmezett érték h6.

markdownParsingSubmode

Megadja azt az almódot, amely meghatározza, hogy egy Markdown-fájl pontosan egy vagy több keresési dokumentumba kerüljön-e. Az alapértelmezett érték oneToMany.

parsingMode

Az Azure Blob-adatforrásból történő indexelés elemzési módját jelöli.

pdfTextRotationAlgorithm

Meghatározza az Azure Blob Storage-beli PDF-fájlokból való szövegkivétel algoritmusát.

queryTimeout

Növeli az időtúllépést az "hh:mm:ss" formátumban megadott Azure SQL Database-adatforrások esetében az 5 perces alapértelmezettnél.

Tulajdonság adatai

allowSkillsetToReadFileData

Ha igaz, létrehoz egy elérési utat //document//file_data, amely a blob adatforrásából letöltött eredeti fájladatokat képviselő objektum. Ez lehetővé teszi az eredeti fájladatok átadását egy egyéni képességnek a bővítési folyamaton belüli feldolgozáshoz, vagy a Dokumentumkinyerési képességnek.

allowSkillsetToReadFileData?: boolean

Tulajdonság értéke

boolean

dataToExtract

Megadja az Azure Blob Storage-ból kinyerni kívánt adatokat, és közli az indexelővel, hogy mely adatokat kell kinyerni a képtartalomból, ha az "imageAction" értéke nem "none". Ez egy .PDF vagy más alkalmazás beágyazott képtartalmaira, illetve az Azure-blobokban lévő képfájlokra, például .jpg és .pngvonatkozik.

dataToExtract?: "storageMetadata" | "allMetadata" | "contentAndMetadata"

Tulajdonság értéke

"storageMetadata" | "allMetadata" | "contentAndMetadata"

delimitedTextDelimiter

CSV-blobok esetén az egykarakteres elválasztó karaktert adja meg azokhoz a CSV-fájlokhoz, ahol minden sor új dokumentumot indít el (például "|").

delimitedTextDelimiter?: string

Tulajdonság értéke

string

delimitedTextHeaders

CSV-blobok esetén az oszlopfejlécek vesszővel tagolt listáját adja meg, amely hasznos lehet az index célmezőihez való leképezéséhez.

delimitedTextHeaders?: string

Tulajdonság értéke

string

documentRoot

JSON-tömbök esetén, strukturált vagy részben strukturált dokumentum esetén a tulajdonság használatával megadhatja a tömb elérési útját.

documentRoot?: string

Tulajdonság értéke

string

excludedFileNameExtensions

Az Azure Blob Storage-ból történő feldolgozáskor figyelmen kívül hagyandó fájlnévkiterjesztések vesszőkkel tagolt listája. Kizárhatja például a ".png, .mp4" lehetőséget, hogy átugorja ezeket a fájlokat az indexelés során.

excludedFileNameExtensions?: string

Tulajdonság értéke

string

executionEnvironment

Azt a környezetet adja meg, amelyben az indexelőnek végre kell hajtania.

executionEnvironment?: "standard" | "private"

Tulajdonság értéke

"standard" | "private"

failOnUnprocessableDocument

Az Azure-blobok esetében állítsa hamis értékre, ha folytatni szeretné az indexelést, ha egy dokumentum indexelése sikertelen.

failOnUnprocessableDocument?: boolean

Tulajdonság értéke

boolean

failOnUnsupportedContentType

Az Azure-blobok esetében állítsa hamis értékre, ha nem támogatott tartalomtípus esetén szeretné folytatni az indexelést, és nem ismeri előre az összes tartalomtípust (fájlkiterjesztést).

failOnUnsupportedContentType?: boolean

Tulajdonság értéke

boolean

firstLineContainsHeaders

CSV-blobok esetén az egyes blobok első (nem üres) sora fejléceket tartalmaz.

firstLineContainsHeaders?: boolean

Tulajdonság értéke

boolean

imageAction

Meghatározza, hogyan dolgozhatja fel a beágyazott képeket és képfájlokat az Azure Blob Storage-ban. Ha az "imageAction" konfigurációt a "none" értéken kívül más értékre állítja be, egy képességkészletet is hozzá kell csatolni az indexelőhöz.

imageAction?: "none" | "generateNormalizedImages" | "generateNormalizedImagePerPage"

Tulajdonság értéke

"none" | "generateNormalizedImages" | "generateNormalizedImagePerPage"

indexedFileNameExtensions

Az Azure Blob Storage-ból történő feldolgozáskor kiválasztandó fájlnévkiterjesztések vesszőkkel tagolt listája. A ".docx, .pptx, .msg" alkalmazásfájlok indexelésével például kifejezetten belefoglalhatja ezeket a fájltípusokat.

indexedFileNameExtensions?: string

Tulajdonság értéke

string

indexStorageMetadataOnlyForOversizedDocuments

Azure-blobok esetén állítsa ezt a tulajdonságot igaz értékre, hogy továbbra is indexelje a tárolási metaadatokat olyan blobtartalmak esetében, amelyek túl nagyok a feldolgozáshoz. A túlméretezett blobokat alapértelmezés szerint hibaként kezeli a rendszer. A blob méretkorlátjaiért lásd: https://learn.microsoft.com/azure/search/search-limits-quotas-capacity.

indexStorageMetadataOnlyForOversizedDocuments?: boolean

Tulajdonság értéke

boolean

markdownHeaderDepth

Megadja a Markdown-tartalom csoportosítása során figyelembe vett maximális fejlécmélységet. Az alapértelmezett érték h6.

markdownHeaderDepth?: string

Tulajdonság értéke

string

markdownParsingSubmode

Megadja azt az almódot, amely meghatározza, hogy egy Markdown-fájl pontosan egy vagy több keresési dokumentumba kerüljön-e. Az alapértelmezett érték oneToMany.

markdownParsingSubmode?: string

Tulajdonság értéke

string

parsingMode

Az Azure Blob-adatforrásból történő indexelés elemzési módját jelöli.

parsingMode?: "text" | "default" | "delimitedText" | "json" | "jsonArray" | "jsonLines" | "markdown"

Tulajdonság értéke

"text" | "default" | "delimitedText" | "json" | "jsonArray" | "jsonLines" | "markdown"

pdfTextRotationAlgorithm

Meghatározza az Azure Blob Storage-beli PDF-fájlokból való szövegkivétel algoritmusát.

pdfTextRotationAlgorithm?: "none" | "detectAngles"

Tulajdonság értéke

"none" | "detectAngles"

queryTimeout

Növeli az időtúllépést az "hh:mm:ss" formátumban megadott Azure SQL Database-adatforrások esetében az 5 perces alapértelmezettnél.

queryTimeout?: string

Tulajdonság értéke

string