Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Сохраняет содержимое DataFrame источника данных. Источник данных задается format и набором options. Если format это не указано spark.sql.sources.default , используется источник данных по умолчанию.
Синтаксис
save(path=None, format=None, mode=None, partitionBy=None, **options)
Параметры
| Параметр | Тип | Описание |
|---|---|---|
path |
str, необязательный | Путь в файловой системе, поддерживаемой Hadoop. |
format |
str, необязательный | Формат, используемый для сохранения. |
mode |
str, необязательный | Поведение, когда данные уже существуют. Допустимые значения: 'append', 'overwrite', 'ignore'и 'error' (по 'errorifexists' умолчанию). |
partitionBy |
list, необязательный | Имена столбцов секционирования. |
**options |
Дикт | Дополнительные параметры строки. |
Возвраты
Нет
Примеры
Напишите кадр данных в JSON-файл и считывает его обратно.
import tempfile
with tempfile.TemporaryDirectory(prefix="save") as d:
spark.createDataFrame(
[{"age": 100, "name": "Alice"}]
).write.mode("overwrite").format("json").save(d)
spark.read.format('json').load(d).show()
# +---+------------+
# |age| name|
# +---+------------+
# |100|Alice|
# +---+------------+