birinci

Gruptaki ilk değeri döndürür. İşlev varsayılan olarak gördüğü ilk değerleri döndürür. IgnoreNulls değeri true olarak ayarlandığında gördüğü ilk null olmayan değeri döndürür. Tüm değerler null ise null döndürülür. sonuçları, bir karıştırmadan sonra belirlenemeyen satırların sırasına bağlı olduğundan işlev belirleyici değildir.

Sözdizimi

from pyspark.sql import functions as sf

sf.first(col, ignorenulls=False)

Parametreler

Parametre Türü Description
col pyspark.sql.Column veya sütun adı İlk değerin getirilmeye hazır olduğu sütun.
ignorenulls bool İlk değer null ise, ilk null olmayan değeri arayın. Varsayılan olarak yanlıştır.

İade

pyspark.sql.Column: grubun ilk değeri.

Örnekler

from pyspark.sql import functions as sf
df = spark.createDataFrame([("Alice", 2), ("Bob", 5), ("Alice", None)], ("name", "age"))
df = df.orderBy(df.age)
df.groupby("name").agg(sf.first("age")).orderBy("name").show()
+-----+----------+
| name|first(age)|
+-----+----------+
|Alice|      NULL|
|  Bob|         5|
+-----+----------+

Null değerleri yoksaymak için olarak ignorenullsayarlayınTrue:

df.groupby("name").agg(sf.first("age", ignorenulls=True)).orderBy("name").show()
+-----+----------+
| name|first(age)|
+-----+----------+
|Alice|         2|
|  Bob|         5|
+-----+----------+