Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Extraheert gestructureerde gegevens uit een documentkolom met BEHULP van AI/LLM.
Voor de overeenkomstige Databricks SQL-functie, zie de ai_extract functie.
Syntax
from pyspark.sql import functions as dbf
dbf.ai_extract(col=<col>, schema=<schema>, options=<options>)
Parameters
| Parameter | Type | Beschrijving |
|---|---|---|
col |
pyspark.sql.Column of str |
Een kolom met de documentinhoud waaruit moet worden geëxtraheerd. |
schema |
dict of list |
Een Python dict (veldnaam aan{"type": ..., "description": ...}) of een lijst met veldnaamtekenreeksen. Automatisch geserialiseerd naar een letterlijke JSON-code. |
options |
dictfacultatief |
Een woordenlijst met opties voor het beheren van het extractiegedrag. |
Returns
pyspark.sql.Column: Een nieuwe kolom van VariantType met de geëxtraheerde velden.
Examples
df.select(ai_extract("text", {"name": {"type": "string", "description": "Name"}}))
df.select(ai_extract("text", ["name", "age"]))