SplitSkill interface
Навык разделения строки на фрагменты текста.
- Extends
Свойства
| default |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
| maximum |
Применимо только в том случае, если для параметра textSplitMode установлено значение 'pages'. Если указано, SplitSkill прекратит разделение после обработки первых страниц 'maximumPagesToTake', чтобы повысить производительность, когда требуется всего несколько начальных страниц из каждого документа. |
| max |
Требуемая максимальная длина страницы. Значение по умолчанию — 10000. |
| odatatype | Полиморфная дискриминация, указывающая различные типы этого объекта, может быть |
| page |
Применимо только в том случае, если для параметра textSplitMode установлено значение 'pages'. Если указано, n+1-й чанк будет начинаться с этим количеством символов/токенов с конца n-го чанка. |
| text |
Значение, указывающее, какой режим разделения для выполнения. |
Унаследованные свойства
| context | Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| description | Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs | Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
| name | Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs | Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
Сведения о свойстве
defaultLanguageCode
Значение, указывающее, какой языковой код следует использовать. По умолчанию — en.
defaultLanguageCode?: "da" | "de" | "en" | "es" | "fi" | "fr" | "it" | "ko" | "pt" | "bs" | "cs" | "et" | "he" | "hi" | "hr" | "hu" | "id" | "ja" | "lv" | "nb" | "nl" | "pl" | "ru" | "sk" | "sl" | "sv" | "tr" | "zh" | "is" | "sr" | "ur" | "am" | "pt-br"
Значение свойства
"da" | "de" | "en" | "es" | "fi" | "fr" | "it" | "ko" | "pt" | "bs" | "cs" | "et" | "he" | "hi" | "hr" | "hu" | "id" | "ja" | "lv" | "nb" | "nl" | "pl" | "ru" | "sk" | "sl" | "sv" | "tr" | "zh" | "is" | "sr" | "ur" | "am" | "pt-br"
maximumPagesToTake
Применимо только в том случае, если для параметра textSplitMode установлено значение 'pages'. Если указано, SplitSkill прекратит разделение после обработки первых страниц 'maximumPagesToTake', чтобы повысить производительность, когда требуется всего несколько начальных страниц из каждого документа.
maximumPagesToTake?: number
Значение свойства
number
maxPageLength
Требуемая максимальная длина страницы. Значение по умолчанию — 10000.
maxPageLength?: number
Значение свойства
number
odatatype
Полиморфная дискриминация, указывающая различные типы этого объекта, может быть
odatatype: "#Microsoft.Skills.Text.SplitSkill"
Значение свойства
"#Microsoft.Skills.Text.SplitSkill"
pageOverlapLength
Применимо только в том случае, если для параметра textSplitMode установлено значение 'pages'. Если указано, n+1-й чанк будет начинаться с этим количеством символов/токенов с конца n-го чанка.
pageOverlapLength?: number
Значение свойства
number
textSplitMode
Значение, указывающее, какой режим разделения для выполнения.
textSplitMode?: "pages" | "sentences"
Значение свойства
"pages" | "sentences"
Сведения об унаследованном свойстве
context
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document.
context?: string
Значение свойства
string
Наследуется отSearchIndexerSkill.context
description
Описание навыка, описывающего входные данные, выходные данные и использование навыка.
description?: string
Значение свойства
string
Наследуется отSearchIndexerSkill.description
inputs
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка.
inputs: InputFieldMappingEntry[]
Значение свойства
Наследуется отSearchIndexerSkill.inputs
name
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#".
name?: string
Значение свойства
string
Унаследовано отSearchIndexerSkill.name
outputs
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком.
outputs: OutputFieldMappingEntry[]
Значение свойства
Наследуется отSearchIndexerSkill.outputs