csv (DataFrameWriter)

Сохраняет содержимое DataFrame в формате CSV по указанному пути.

Синтаксис

csv(path, mode=None, compression=None, sep=None, quote=None, escape=None,
    header=None, nullValue=None, escapeQuotes=None, quoteAll=None,
    dateFormat=None, timestampFormat=None, ignoreLeadingWhiteSpace=None,
    ignoreTrailingWhiteSpace=None, charToEscapeQuoteEscaping=None,
    encoding=None, emptyValue=None, lineSep=None)

Параметры

Параметр Тип Описание
path str Путь в любой файловой системе, поддерживаемой Hadoop.
mode str, необязательный Поведение, когда данные уже существуют. Допустимые значения: 'append', 'overwrite', 'ignore'и 'error' (по 'errorifexists' умолчанию).

Возвраты

Нет

Примеры

Напишите кадр данных в CSV-файл и считывайте его обратно.

import tempfile
with tempfile.TemporaryDirectory(prefix="csv") as d:
    df = spark.createDataFrame([{"age": 100, "name": "Alice"}])
    df.write.csv(d, mode="overwrite")

    spark.read.schema(df.schema).format("csv").option(
        "nullValue", "Alice").load(d).show()
    # +---+----+
    # |age|name|
    # +---+----+
    # |100|NULL|
    # +---+----+