Aller au contenu principal

regexp_extract

Extrayez un groupe spécifique correspondant à l'expression régulière Java regexp, de la colonne de chaîne spécifiée. Si l'expression régulière ne correspondait pas, ou si le groupe spécifié ne correspondait pas, une chaîne vide est renvoyée.

Pour la fonction Databricks SQL correspondante, consultez la fonctionregexp_extract.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.regexp_extract(str=<str>, pattern=<pattern>, idx=<idx>)

parameter

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

pattern

str

Modèle d’expression rationnelle à appliquer.

idx

int

ID de groupe correspondant.

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

pattern

str

Modèle d’expression rationnelle à appliquer.

idx

int

ID de groupe correspondant.

Exemples

Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([('100-200',)], ['str'])
df.select('*', dbf.regexp_extract('str', r'(\d+)-(\d+)', 1)).show()
df = spark.createDataFrame([('foo',)], ['str'])
df.select('*', dbf.regexp_extract('str', r'(\d+)', 1)).show()
df = spark.createDataFrame([('aaaac',)], ['str'])
df.select('*', dbf.regexp_extract(dbf.col('str'), '(a+)(b)?(c)', 2)).show()