Catatan
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba masuk atau mengubah direktori.
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba mengubah direktori.
Menghitung tabel frekuensi yang bijaksana dari kolom tertentu, juga dikenal sebagai tabel kontingensi. Kolom pertama dari setiap baris berisi nilai yang berbeda dari col1, dan nama kolom adalah nilai yang berbeda dari col2. Nama kolom pertama adalah $col1_$col2. Pasangan tanpa kemunculan memiliki hitungan nol.
DataFrame.crosstab dan DataFrameStatFunctions.crosstab adalah alias satu sama lain.
Sintaksis
crosstab(col1, col2)
Parameter-parameternya
| Parameter | Tipe | Deskripsi |
|---|---|---|
col1 |
str | Nama kolom pertama. Item berbeda membentuk kolom pertama dari setiap baris. |
col2 |
str | Nama kolom kedua. Item berbeda membentuk nama kolom dari yang dihasilkan DataFrame. |
Pengembalian Barang
DataFrame
Examples
df = spark.createDataFrame([(1, 11), (1, 11), (3, 10), (4, 8), (4, 8)], ["c1", "c2"])
df.stat.crosstab("c1", "c2").sort("c1_c2").show()
# +-----+---+---+---+
# |c1_c2| 10| 11| 8|
# +-----+---+---+---+
# | 1| 0| 2| 0|
# | 3| 1| 0| 0|
# | 4| 0| 0| 2|
# +-----+---+---+---+