Not
Bu sayfaya erişim yetkilendirme gerektiriyor. Oturum açmayı veya dizinleri değiştirmeyi deneyebilirsiniz.
Bu sayfaya erişim yetkilendirme gerektiriyor. Dizinleri değiştirmeyi deneyebilirsiniz.
Python'da kullanıcı tanımlı bir işlev.
Bu sınıfın oluşturucusunun doğrudan çağrılmaması gerekir. Örnek oluşturmak için veya pyspark.sql.functions.udf kullanınpyspark.sql.functions.pandas_udf.
Sözdizimi
from pyspark.sql.functions import udf
from pyspark.sql.types import StringType
my_udf = udf(lambda x: x.upper(), StringType())
Özellikler
| Mülkiyet | Açıklama |
|---|---|
returnType |
Kullanıcı tanımlı işlevin DataType olarak dönüş türü. |
Methods
| Yöntem | Açıklama |
|---|---|
asNondeterministic() |
UserDefinedFunction değerini belirsiz olarak güncelleştirir. |
Örnekler
from pyspark.sql.functions import udf
from pyspark.sql.types import StringType
upper_udf = udf(lambda x: x.upper(), StringType())
df = spark.createDataFrame([("alice",), ("bob",)], ["name"])
df.select(upper_udf("name")).show()
+-----------+
|<lambda>(name)|
+-----------+
| ALICE|
| BOB|
+-----------+
import random
from pyspark.sql.functions import udf
from pyspark.sql.types import IntegerType
random_udf = udf(lambda: random.randint(0, 100), IntegerType()).asNondeterministic()
random_udf.returnType
IntegerType()