Aller au contenu principal

regexp_extract_all

Extraire toutes les chaînes dans le str qui correspondent à l'expression régulière Java regexp et correspondant à l'index du groupe d'expressions régulières.

Pour la fonction Databricks SQL correspondante, consultez la fonctionregexp_extract_all.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.regexp_extract_all(str=<str>, regexp=<regexp>, idx=<idx>)

parameter

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

regexp

pyspark.sql.Column OU str

Modèle d’expression rationnelle à appliquer.

idx

pyspark.sql.Column OU int, optional

ID de groupe correspondant.

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

regexp

pyspark.sql.Column OU str

Modèle d’expression rationnelle à appliquer.

idx

pyspark.sql.Column OU int, optional

ID de groupe correspondant.

Exemples

Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([("100-200, 300-400", r"(\d+)-(\d+)")], ["str", "regexp"])
df.select('*', dbf.regexp_extract_all('str', dbf.lit(r'(\d+)-(\d+)'))).show()
df.select('*', dbf.regexp_extract_all('str', dbf.lit(r'(\d+)-(\d+)'), dbf.lit(1))).show()
df.select('*', dbf.regexp_extract_all('str', dbf.lit(r'(\d+)-(\d+)'), 2)).show()
df.select('*', dbf.regexp_extract_all('str', dbf.col("regexp"))).show()
df.select('*', dbf.regexp_extract_all(dbf.col('str'), "regexp")).show()