Not
Bu sayfaya erişim yetkilendirme gerektiriyor. Oturum açmayı veya dizinleri değiştirmeyi deneyebilirsiniz.
Bu sayfaya erişim yetkilendirme gerektiriyor. Dizinleri değiştirmeyi deneyebilirsiniz.
Toplama işlevi: Bir gruptaki null olmayan sayı çiftlerinin sayısını döndürür; burada y bağımlı değişkendir ve x bağımsız değişkendir.
İlgili Databricks SQL işlevi için bkz regr_count . toplama işlevi.
Sözdizimi
import pyspark.sql.functions as sf
sf.regr_count(y=<y>, x=<x>)
Parametreler
| Parametre | Türü | Description |
|---|---|---|
y |
pyspark.sql.Column veya str |
Bağımlı değişken. |
x |
pyspark.sql.Column veya str |
Bağımsız değişken. |
İade
pyspark.sql.Column: bir gruptaki null olmayan sayı çiftlerinin sayısı.
Örnekler
Örnek 1: Tüm çiftler null değil.
import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, 2), (2, 2), (2, 3), (2, 4) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
| 4| 4|
+----------------+--------+
Örnek 2: Tüm çiftlerin x değerleri null olur.
import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, null) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
| 0| 1|
+----------------+--------+
Örnek 3: Tüm çiftlerin y değerleri null olur.
import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (null, 1) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
| 0| 1|
+----------------+--------+
Örnek 4: Bazı çiftlerin x değerleri null.
import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, 2), (2, null), (2, 3), (2, 4) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
| 3| 4|
+----------------+--------+
Örnek 5: Bazı çiftlerin x veya y değerleri null olur.
import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, 2), (2, null), (null, 3), (2, 4) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
| 2| 4|
+----------------+--------+