zstd_compress

Belirtilen sıkıştırma düzeyine sahip Zstandard kullanarak sıkıştırılmış bir expr değeri döndürür. Varsayılan düzey 3'dür. Varsayılan olarak tek geçiş modunu kullanır.

Sözdizimi

from pyspark.sql import functions as dbf

dbf.zstd_compress(input=<input>, level=<level>, streaming_mode=<streaming_mode>)

Parametreler

Parametre Türü Description
input pyspark.sql.Column veya str Sıkıştırılması gereken ikili değer.
level pyspark.sql.Column veya intveya isteğe bağlı Sıkıştırma düzeyini temsil eden isteğe bağlı tamsayı bağımsız değişkeni. Sıkıştırma düzeyi, sıkıştırma hızı ile sıkıştırma oranı arasındaki dengeyi denetler. Geçerli değerler: 1 ile 22 (dahil) arasında; burada 1 en hızlı ama en düşük sıkıştırma oranı, 22 ise en yavaş ama en yüksek sıkıştırma oranı anlamına gelir. Belirtilmezse varsayılan düzey 3'dür.
streaming_mode pyspark.sql.Column veya boolveya isteğe bağlı Akış modunun kullanılıp kullanılmayacağını gösteren isteğe bağlı boole bağımsız değişkeni. True ise işlev akış modunda sıkıştırılır. Varsayılan değer yanlıştır.

İade

pyspark.sql.Column: Sıkıştırılmış değer içeren yeni bir sütun.

Örnekler

Örnek 1: Zstandard kullanarak verileri sıkıştırma

from pyspark.sql import functions as dbf
df = spark.createDataFrame([("Apache Spark " * 10,)], ["input"])
df.select(dbf.base64(dbf.zstd_compress(df.input)).alias("result")).show(truncate=False)
+----------------------------------------+
|result                                  |
+----------------------------------------+
|KLUv/SCCpQAAaEFwYWNoZSBTcGFyayABABLS+QU=|
+----------------------------------------+

Örnek 2: Belirli bir sıkıştırma düzeyiyle Zstandard kullanarak verileri sıkıştırma

from pyspark.sql import functions as dbf
df = spark.createDataFrame([("Apache Spark " * 10,)], ["input"])
df.select(dbf.base64(dbf.zstd_compress(df.input, dbf.lit(5))).alias("result")).show(truncate=False)
+----------------------------------------+
|result                                  |
+----------------------------------------+
|KLUv/SCCpQAAaEFwYWNoZSBTcGFyayABABLS+QU=|
+----------------------------------------+

Örnek 3: Akış modunda Zstandard kullanarak verileri sıkıştırma

from pyspark.sql import functions as dbf
df = spark.createDataFrame([("Apache Spark " * 10,)], ["input"])
df.select(dbf.base64(dbf.zstd_compress(df.input, dbf.lit(3), dbf.lit(True))).alias("result")).show(truncate=False)
+--------------------------------------------+
|result                                      |
+--------------------------------------------+
|KLUv/QBYpAAAaEFwYWNoZSBTcGFyayABABLS+QUBAAA=|
+--------------------------------------------+