regexp_substr
Renvoie la première sous-chaîne qui correspond à l'expression régulière Java regexp dans la chaîne str. Si l'expression régulière n'est pas trouvée, le résultat est nul.
Pour la fonction Databricks SQL correspondante, consultez la fonctionregexp_substr.
Syntaxe
Python
from pyspark.sql import functions as dbf
dbf.regexp_substr(str=<str>, regexp=<regexp>)
parameter
parameter | Type | Description |
|---|---|---|
|
| colonne cible sur laquelle travailler. |
|
| Modèle d’expression rationnelle à appliquer. |
Exemples
Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([("1a 2b 14m", r"\d+")], ["str", "regexp"])
Python
df.select('*', dbf.regexp_substr('str', dbf.lit(r'\d+'))).show()
df.select('*', dbf.regexp_substr('str', dbf.lit(r'mmm'))).show()
df.select('*', dbf.regexp_substr("str", dbf.col("regexp"))).show()
df.select('*', dbf.regexp_substr(dbf.col("str"), "regexp")).show()