IndexingParametersConfiguration interface
Indexelőspecifikus konfigurációs tulajdonságok szótára. Minden név egy adott tulajdonság neve. Minden értéknek primitív típusúnak kell lennie.
Tulajdonságok
| allow |
Ha igaz, létrehoz egy elérési utat //document//file_data, amely a blob adatforrásából letöltött eredeti fájladatokat képviselő objektum. Ez lehetővé teszi az eredeti fájladatok átadását egy egyéni képességnek a bővítési folyamaton belüli feldolgozáshoz, vagy a Dokumentumkinyerési képességnek. |
| data |
Megadja az Azure Blob Storage-ból kinyerni kívánt adatokat, és közli az indexelővel, hogy mely adatokat kell kinyerni a képtartalomból, ha az "imageAction" értéke nem "none". Ez egy .PDF vagy más alkalmazás beágyazott képtartalmaira, illetve az Azure-blobokban lévő képfájlokra, például .jpg és .pngvonatkozik. |
| delimited |
CSV-blobok esetén az egykarakteres elválasztó karaktert adja meg azokhoz a CSV-fájlokhoz, ahol minden sor új dokumentumot indít el (például "|"). |
| delimited |
CSV-blobok esetén az oszlopfejlécek vesszővel tagolt listáját adja meg, amely hasznos lehet az index célmezőihez való leképezéséhez. |
| document |
JSON-tömbök esetén, strukturált vagy részben strukturált dokumentum esetén a tulajdonság használatával megadhatja a tömb elérési útját. |
| excluded |
Az Azure Blob Storage-ból történő feldolgozáskor figyelmen kívül hagyandó fájlnévkiterjesztések vesszőkkel tagolt listája. Kizárhatja például a ".png, .mp4" lehetőséget, hogy átugorja ezeket a fájlokat az indexelés során. |
| execution |
Azt a környezetet adja meg, amelyben az indexelőnek végre kell hajtania. |
| fail |
Az Azure-blobok esetében állítsa hamis értékre, ha folytatni szeretné az indexelést, ha egy dokumentum indexelése sikertelen. |
| fail |
Az Azure-blobok esetében állítsa hamis értékre, ha nem támogatott tartalomtípus esetén szeretné folytatni az indexelést, és nem ismeri előre az összes tartalomtípust (fájlkiterjesztést). |
| first |
CSV-blobok esetén az egyes blobok első (nem üres) sora fejléceket tartalmaz. |
| image |
Meghatározza, hogyan dolgozhatja fel a beágyazott képeket és képfájlokat az Azure Blob Storage-ban. Ha az "imageAction" konfigurációt a "none" értéken kívül más értékre állítja be, egy képességkészletet is hozzá kell csatolni az indexelőhöz. |
| indexed |
Az Azure Blob Storage-ból történő feldolgozáskor kiválasztandó fájlnévkiterjesztések vesszőkkel tagolt listája. A ".docx, .pptx, .msg" alkalmazásfájlok indexelésével például kifejezetten belefoglalhatja ezeket a fájltípusokat. |
| index |
Azure-blobok esetén állítsa ezt a tulajdonságot igaz értékre, hogy továbbra is indexelje a tárolási metaadatokat olyan blobtartalmak esetében, amelyek túl nagyok a feldolgozáshoz. A túlméretezett blobokat alapértelmezés szerint hibaként kezeli a rendszer. A blob méretkorlátjaiért lásd: https://learn.microsoft.com/azure/search/search-limits-quotas-capacity. |
| markdown |
Megadja a Markdown-tartalom csoportosítása során figyelembe vett maximális fejlécmélységet. Az alapértelmezett érték |
| markdown |
Megadja azt az almódot, amely meghatározza, hogy egy Markdown-fájl pontosan egy vagy több keresési dokumentumba kerüljön-e. Az alapértelmezett érték |
| parsing |
Az Azure Blob-adatforrásból történő indexelés elemzési módját jelöli. |
| pdf |
Meghatározza az Azure Blob Storage-beli PDF-fájlokból való szövegkivétel algoritmusát. |
| query |
Növeli az időtúllépést az "hh:mm:ss" formátumban megadott Azure SQL Database-adatforrások esetében az 5 perces alapértelmezettnél. |
Tulajdonság adatai
allowSkillsetToReadFileData
Ha igaz, létrehoz egy elérési utat //document//file_data, amely a blob adatforrásából letöltött eredeti fájladatokat képviselő objektum. Ez lehetővé teszi az eredeti fájladatok átadását egy egyéni képességnek a bővítési folyamaton belüli feldolgozáshoz, vagy a Dokumentumkinyerési képességnek.
allowSkillsetToReadFileData?: boolean
Tulajdonság értéke
boolean
dataToExtract
Megadja az Azure Blob Storage-ból kinyerni kívánt adatokat, és közli az indexelővel, hogy mely adatokat kell kinyerni a képtartalomból, ha az "imageAction" értéke nem "none". Ez egy .PDF vagy más alkalmazás beágyazott képtartalmaira, illetve az Azure-blobokban lévő képfájlokra, például .jpg és .pngvonatkozik.
dataToExtract?: "storageMetadata" | "allMetadata" | "contentAndMetadata"
Tulajdonság értéke
"storageMetadata" | "allMetadata" | "contentAndMetadata"
delimitedTextDelimiter
CSV-blobok esetén az egykarakteres elválasztó karaktert adja meg azokhoz a CSV-fájlokhoz, ahol minden sor új dokumentumot indít el (például "|").
delimitedTextDelimiter?: string
Tulajdonság értéke
string
delimitedTextHeaders
CSV-blobok esetén az oszlopfejlécek vesszővel tagolt listáját adja meg, amely hasznos lehet az index célmezőihez való leképezéséhez.
delimitedTextHeaders?: string
Tulajdonság értéke
string
documentRoot
JSON-tömbök esetén, strukturált vagy részben strukturált dokumentum esetén a tulajdonság használatával megadhatja a tömb elérési útját.
documentRoot?: string
Tulajdonság értéke
string
excludedFileNameExtensions
Az Azure Blob Storage-ból történő feldolgozáskor figyelmen kívül hagyandó fájlnévkiterjesztések vesszőkkel tagolt listája. Kizárhatja például a ".png, .mp4" lehetőséget, hogy átugorja ezeket a fájlokat az indexelés során.
excludedFileNameExtensions?: string
Tulajdonság értéke
string
executionEnvironment
Azt a környezetet adja meg, amelyben az indexelőnek végre kell hajtania.
executionEnvironment?: "standard" | "private"
Tulajdonság értéke
"standard" | "private"
failOnUnprocessableDocument
Az Azure-blobok esetében állítsa hamis értékre, ha folytatni szeretné az indexelést, ha egy dokumentum indexelése sikertelen.
failOnUnprocessableDocument?: boolean
Tulajdonság értéke
boolean
failOnUnsupportedContentType
Az Azure-blobok esetében állítsa hamis értékre, ha nem támogatott tartalomtípus esetén szeretné folytatni az indexelést, és nem ismeri előre az összes tartalomtípust (fájlkiterjesztést).
failOnUnsupportedContentType?: boolean
Tulajdonság értéke
boolean
firstLineContainsHeaders
CSV-blobok esetén az egyes blobok első (nem üres) sora fejléceket tartalmaz.
firstLineContainsHeaders?: boolean
Tulajdonság értéke
boolean
imageAction
Meghatározza, hogyan dolgozhatja fel a beágyazott képeket és képfájlokat az Azure Blob Storage-ban. Ha az "imageAction" konfigurációt a "none" értéken kívül más értékre állítja be, egy képességkészletet is hozzá kell csatolni az indexelőhöz.
imageAction?: "none" | "generateNormalizedImages" | "generateNormalizedImagePerPage"
Tulajdonság értéke
"none" | "generateNormalizedImages" | "generateNormalizedImagePerPage"
indexedFileNameExtensions
Az Azure Blob Storage-ból történő feldolgozáskor kiválasztandó fájlnévkiterjesztések vesszőkkel tagolt listája. A ".docx, .pptx, .msg" alkalmazásfájlok indexelésével például kifejezetten belefoglalhatja ezeket a fájltípusokat.
indexedFileNameExtensions?: string
Tulajdonság értéke
string
indexStorageMetadataOnlyForOversizedDocuments
Azure-blobok esetén állítsa ezt a tulajdonságot igaz értékre, hogy továbbra is indexelje a tárolási metaadatokat olyan blobtartalmak esetében, amelyek túl nagyok a feldolgozáshoz. A túlméretezett blobokat alapértelmezés szerint hibaként kezeli a rendszer. A blob méretkorlátjaiért lásd: https://learn.microsoft.com/azure/search/search-limits-quotas-capacity.
indexStorageMetadataOnlyForOversizedDocuments?: boolean
Tulajdonság értéke
boolean
markdownHeaderDepth
Megadja a Markdown-tartalom csoportosítása során figyelembe vett maximális fejlécmélységet. Az alapértelmezett érték h6.
markdownHeaderDepth?: string
Tulajdonság értéke
string
markdownParsingSubmode
Megadja azt az almódot, amely meghatározza, hogy egy Markdown-fájl pontosan egy vagy több keresési dokumentumba kerüljön-e. Az alapértelmezett érték oneToMany.
markdownParsingSubmode?: string
Tulajdonság értéke
string
parsingMode
Az Azure Blob-adatforrásból történő indexelés elemzési módját jelöli.
parsingMode?: "text" | "default" | "delimitedText" | "json" | "jsonArray" | "jsonLines" | "markdown"
Tulajdonság értéke
"text" | "default" | "delimitedText" | "json" | "jsonArray" | "jsonLines" | "markdown"
pdfTextRotationAlgorithm
Meghatározza az Azure Blob Storage-beli PDF-fájlokból való szövegkivétel algoritmusát.
pdfTextRotationAlgorithm?: "none" | "detectAngles"
Tulajdonság értéke
"none" | "detectAngles"
queryTimeout
Növeli az időtúllépést az "hh:mm:ss" formátumban megadott Azure SQL Database-adatforrások esetében az 5 perces alapértelmezettnél.
queryTimeout?: string
Tulajdonság értéke
string