regr_count

Toplama işlevi: Bir gruptaki null olmayan sayı çiftlerinin sayısını döndürür; burada y bağımlı değişkendir ve x bağımsız değişkendir.

İlgili Databricks SQL işlevi için bkz regr_count . toplama işlevi.

Sözdizimi

import pyspark.sql.functions as sf

sf.regr_count(y=<y>, x=<x>)

Parametreler

Parametre Türü Description
y pyspark.sql.Column veya str Bağımlı değişken.
x pyspark.sql.Column veya str Bağımsız değişken.

İade

pyspark.sql.Column: bir gruptaki null olmayan sayı çiftlerinin sayısı.

Örnekler

Örnek 1: Tüm çiftler null değil.

import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, 2), (2, 2), (2, 3), (2, 4) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
|               4|       4|
+----------------+--------+

Örnek 2: Tüm çiftlerin x değerleri null olur.

import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, null) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
|               0|       1|
+----------------+--------+

Örnek 3: Tüm çiftlerin y değerleri null olur.

import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (null, 1) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
|               0|       1|
+----------------+--------+

Örnek 4: Bazı çiftlerin x değerleri null.

import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, 2), (2, null), (2, 3), (2, 4) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
|               3|       4|
+----------------+--------+

Örnek 5: Bazı çiftlerin x veya y değerleri null olur.

import pyspark.sql.functions as sf
df = spark.sql("SELECT * FROM VALUES (1, 2), (2, null), (null, 3), (2, 4) AS tab(y, x)")
df.select(sf.regr_count("y", "x"), sf.count(sf.lit(0))).show()
+----------------+--------+
|regr_count(y, x)|count(0)|
+----------------+--------+
|               2|       4|
+----------------+--------+