Нагрузки

Загружает данные из источника данных и возвращает его в виде DataFrame.

Синтаксис

load(path=None, format=None, schema=None, **options)

Параметры

Параметр Тип Описание
path str или list, необязательный Один или несколько путей в источнике данных, поддерживаемом файловой системой.
format str, необязательный Формат источника данных. По умолчанию — 'parquet'.
schema StructType или str, необязательный Входная схема в виде StructType объекта или отформатированного DDL-строки (например, 'col0 INT, col1 DOUBLE').
**options Дикт Дополнительные параметры строки.

Возвраты

DataFrame

Примеры

Загрузите CSV-файл с указанным форматом, схемой и параметрами.

import tempfile
with tempfile.TemporaryDirectory(prefix="load") as d:
    df = spark.createDataFrame([{"age": 100, "name": "Alice"}])
    df.write.option("header", True).mode("overwrite").format("csv").save(d)

    df = spark.read.load(
        d, schema=df.schema, format="csv", nullValue="Alice", header=True)
    df.printSchema()
    # root
    #  |-- age: long (nullable = true)
    #  |-- name: string (nullable = true)
    df.show()
    # +---+----+
    # |age|name|
    # +---+----+
    # |100|NULL|
    # +---+----+