Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Извлекает структурированные данные из столбца документа с помощью ИИ/LLM.
Для соответствующей функции Databricks SQL смотрите функцию ai_extract.
Syntax
from pyspark.sql import functions as dbf
dbf.ai_extract(col=<col>, schema=<schema>, options=<options>)
Parameters
| Parameter | Тип | Описание |
|---|---|---|
col |
pyspark.sql.Column или str |
Столбец, содержащий содержимое документа для извлечения из. |
schema |
dict или list |
Python дикт (имя {"type": ..., "description": ...}поля в) или список строк имени поля. Сериализуется в литерал JSON автоматически. |
options |
dictнеобязательный |
Словарь параметров для управления поведением извлечения. |
Returns
pyspark.sql.Column: новый столбец VariantType, содержащий извлеченные поля.
Примеры
df.select(ai_extract("text", {"name": {"type": "string", "description": "Name"}}))
df.select(ai_extract("text", ["name", "age"]))