substring_index
Renvoie la sous-chaîne de la chaîne str avant le nombre d'occurrences du délimiteur delim. Si le nombre est positif, tout ce qui se trouve à gauche du délimiteur final (en comptant à partir de la gauche) est renvoyé. Si le nombre est négatif, tout ce qui se trouve à droite du délimiteur final (en comptant à partir de la droite) est renvoyé. substring_index effectue une correspondance sensible à la casse lors de la recherche de delim.
Pour la fonction Databricks SQL correspondante, consultez la fonctionsubstring_index.
Syntaxe
Python
from pyspark.sql import functions as dbf
dbf.substring_index(str=<str>, delim=<delim>, count=<count>)
parameter
parameter | Type | Description |
|---|---|---|
|
| colonne cible sur laquelle travailler. |
|
| délimiteur de valeurs. |
|
| Nombre d'occurrences. |
Renvoie
pyspark.sql.Column: sous-chaîne de la valeur donnée.
Exemples
Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([('a.b.c.d',)], ['s'])
df.select('*', dbf.substring_index(df.s, '.', 2)).show()
df.select('*', dbf.substring_index('s', '.', -3)).show()