Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Загружает данные из источника данных и возвращает его в виде DataFrame.
Синтаксис
load(path=None, format=None, schema=None, **options)
Параметры
| Параметр | Тип | Описание |
|---|---|---|
path |
str или list, необязательный | Один или несколько путей в источнике данных, поддерживаемом файловой системой. |
format |
str, необязательный | Формат источника данных. По умолчанию — 'parquet'. |
schema |
StructType или str, необязательный | Входная схема в виде StructType объекта или отформатированного DDL-строки (например, 'col0 INT, col1 DOUBLE'). |
**options |
Дикт | Дополнительные параметры строки. |
Возвраты
DataFrame
Примеры
Загрузите CSV-файл с указанным форматом, схемой и параметрами.
import tempfile
with tempfile.TemporaryDirectory(prefix="load") as d:
df = spark.createDataFrame([{"age": 100, "name": "Alice"}])
df.write.option("header", True).mode("overwrite").format("csv").save(d)
df = spark.read.load(
d, schema=df.schema, format="csv", nullValue="Alice", header=True)
df.printSchema()
# root
# |-- age: long (nullable = true)
# |-- name: string (nullable = true)
df.show()
# +---+----+
# |age|name|
# +---+----+
# |100|NULL|
# +---+----+