Not
Bu sayfaya erişim yetkilendirme gerektiriyor. Oturum açmayı veya dizinleri değiştirmeyi deneyebilirsiniz.
Bu sayfaya erişim yetkilendirme gerektiriyor. Dizinleri değiştirmeyi deneyebilirsiniz.
Bir dizeyi cümle dizilerine böler; burada her cümle bir sözcük dizisidir.
language ve country bağımsız değişkenleri isteğe bağlıdır. Atlandığında:
- Her ikisi de atlanırsa,
Locale.ROOT - locale(language='', country='')kullanılır.Locale.ROOT, tüm yerel ayarların temel yerel ayarı olarak kabul edilir ve yerel ayara duyarlı işlemler için dil/ülke nötr yerel ayarı olarak kullanılır. -
countryatlanırsa,locale(language, country='')kullanılır.
Null olduğunda:
- Her ikisi de
nullLocale.US - locale(language='en', country='US')ise kullanılır. -
languagenull ise vecountrynull değilse,Locale.US - locale(language='en', country='US')kullanılır. -
languagenull değilse vecountrynull ise kullanılırlocale(language). - hiçbiri değilse
null,locale(language, country)kullanılır.
İlgili Databricks SQL fonksiyonu için bakınız sentences fonksiyonu.
Sözdizimi
from pyspark.sql import functions as dbf
dbf.sentences(string=<string>, language=<language>, country=<country>)
Parametreler
| Parametre | Türü | Description |
|---|---|---|
string |
pyspark.sql.Column veya str |
bölünecek dize |
language |
pyspark.sql.Column veya str, optional |
yerel ayarın dili |
country |
pyspark.sql.Column veya str, optional |
yerel ayarın ülkesi |
İade
pyspark.sql.Column: bölünmüş cümle dizileri.
Örnekler
from pyspark.sql import functions as dbf
df = spark.createDataFrame([("This is an example sentence.", )], ["s"])
df.select("*", dbf.sentences(df.s, dbf.lit("en"), dbf.lit("US"))).show(truncate=False)
df.select("*", dbf.sentences(df.s, dbf.lit("en"))).show(truncate=False)
df.select("*", dbf.sentences(df.s)).show(truncate=False)