orc (DataFrameWriter)

Сохраняет содержимое DataFrame формата ORC по указанному пути.

Синтаксис

orc(path, mode=None, partitionBy=None, compression=None)

Параметры

Параметр Тип Описание
path str Путь в любой файловой системе, поддерживаемой Hadoop.
mode str, необязательный Поведение, когда данные уже существуют. Допустимые значения: 'append', 'overwrite', 'ignore'и 'error' (по 'errorifexists' умолчанию).
partitionBy str или list, необязательный Имена столбцов секционирования.
compression str, необязательный Используемый кодек сжатия.

Возвраты

Нет

Примеры

Напишите кадр данных в ORC-файл и считывает его обратно.

import tempfile
with tempfile.TemporaryDirectory(prefix="orc") as d:
    spark.createDataFrame(
        [{"age": 100, "name": "Alice"}]
    ).write.orc(d, mode="overwrite")

    spark.read.format("orc").load(d).show()
    # +---+------------+
    # |age|        name|
    # +---+------------+
    # |100|Alice|
    # +---+------------+