Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Сохраняет содержимое DataFrame формата ORC по указанному пути.
Синтаксис
orc(path, mode=None, partitionBy=None, compression=None)
Параметры
| Параметр | Тип | Описание |
|---|---|---|
path |
str | Путь в любой файловой системе, поддерживаемой Hadoop. |
mode |
str, необязательный | Поведение, когда данные уже существуют. Допустимые значения: 'append', 'overwrite', 'ignore'и 'error' (по 'errorifexists' умолчанию). |
partitionBy |
str или list, необязательный | Имена столбцов секционирования. |
compression |
str, необязательный | Используемый кодек сжатия. |
Возвраты
Нет
Примеры
Напишите кадр данных в ORC-файл и считывает его обратно.
import tempfile
with tempfile.TemporaryDirectory(prefix="orc") as d:
spark.createDataFrame(
[{"age": 100, "name": "Alice"}]
).write.orc(d, mode="overwrite")
spark.read.format("orc").load(d).show()
# +---+------------+
# |age| name|
# +---+------------+
# |100|Alice|
# +---+------------+