Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Функция преобразования секций: преобразование для любого типа, который секционирует хэш входного столбца. Поддерживает Spark Connect.
Предупреждение
Не рекомендуется использовать в версии 4.0.0. Вместо этого используйте partitioning.bucket.
Синтаксис
from pyspark.sql import functions as dbf
dbf.bucket(numBuckets=<numBuckets>, col=<col>)
Параметры
| Параметр | Тип | Description |
|---|---|---|
numBuckets |
pyspark.sql.Column или int |
Количество контейнеров. |
col |
pyspark.sql.Column или str |
Целевая дата или столбец метки времени для работы. |
Возвраты
pyspark.sql.Column: данные, секционированные по заданным столбцам.
Примеры
df.writeTo("catalog.db.table").partitionedBy(
bucket(42, "ts")
).createOrReplace()
Замечание
Эту функцию можно использовать только в сочетании с методом partitionedBy DataFrameWriterV2.