regexp_extract

Belirtilen dize sütunundan Java regex regexpile eşleşen belirli bir grubu ayıklayın. Kayıt defteri ifadesi eşleşmediyse veya belirtilen grup eşleşmediyse boş bir dize döndürülür.

İlgili Databricks SQL fonksiyonu için bakınız regexp_extract fonksiyonu.

Sözdizimi

from pyspark.sql import functions as dbf

dbf.regexp_extract(str=<str>, pattern=<pattern>, idx=<idx>)

Parametreler

Parametre Türü Description
str pyspark.sql.Column veya str üzerinde çalışacak hedef sütun.
pattern str uygulanacak regex deseni.
idx int eşleşen grup kimliği.

Örnekler

from pyspark.sql import functions as dbf
df = spark.createDataFrame([('100-200',)], ['str'])
df.select('*', dbf.regexp_extract('str', r'(\d+)-(\d+)', 1)).show()
df = spark.createDataFrame([('foo',)], ['str'])
df.select('*', dbf.regexp_extract('str', r'(\d+)', 1)).show()
df = spark.createDataFrame([('aaaac',)], ['str'])
df.select('*', dbf.regexp_extract(dbf.col('str'), '(a+)(b)?(c)', 2)).show()