Not
Bu sayfaya erişim yetkilendirme gerektiriyor. Oturum açmayı veya dizinleri değiştirmeyi deneyebilirsiniz.
Bu sayfaya erişim yetkilendirme gerektiriyor. Dizinleri değiştirmeyi deneyebilirsiniz.
Gruptaki ilk değeri döndürür. İşlev varsayılan olarak gördüğü ilk değerleri döndürür. IgnoreNulls değeri true olarak ayarlandığında gördüğü ilk null olmayan değeri döndürür. Tüm değerler null ise null döndürülür. sonuçları, bir karıştırmadan sonra belirlenemeyen satırların sırasına bağlı olduğundan işlev belirleyici değildir.
Sözdizimi
from pyspark.sql import functions as sf
sf.first(col, ignorenulls=False)
Parametreler
| Parametre | Türü | Description |
|---|---|---|
col |
pyspark.sql.Column veya sütun adı |
İlk değerin getirilmeye hazır olduğu sütun. |
ignorenulls |
bool | İlk değer null ise, ilk null olmayan değeri arayın. Varsayılan olarak yanlıştır. |
İade
pyspark.sql.Column: grubun ilk değeri.
Örnekler
from pyspark.sql import functions as sf
df = spark.createDataFrame([("Alice", 2), ("Bob", 5), ("Alice", None)], ("name", "age"))
df = df.orderBy(df.age)
df.groupby("name").agg(sf.first("age")).orderBy("name").show()
+-----+----------+
| name|first(age)|
+-----+----------+
|Alice| NULL|
| Bob| 5|
+-----+----------+
Null değerleri yoksaymak için olarak ignorenullsayarlayınTrue:
df.groupby("name").agg(sf.first("age", ignorenulls=True)).orderBy("name").show()
+-----+----------+
| name|first(age)|
+-----+----------+
|Alice| 2|
| Bob| 5|
+-----+----------+