Aller au contenu principal

substring_index

Renvoie la sous-chaîne de la chaîne str avant le nombre d'occurrences du délimiteur delim. Si le nombre est positif, tout ce qui se trouve à gauche du délimiteur final (en comptant à partir de la gauche) est renvoyé. Si le nombre est négatif, tout ce qui se trouve à droite du délimiteur final (en comptant à partir de la droite) est renvoyé. substring_index effectue une correspondance sensible à la casse lors de la recherche de delim.

Pour la fonction Databricks SQL correspondante, consultez la fonctionsubstring_index.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.substring_index(str=<str>, delim=<delim>, count=<count>)

parameter

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

delim

literal string

délimiteur de valeurs.

count

int

Nombre d'occurrences.

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

delim

literal string

délimiteur de valeurs.

count

int

Nombre d'occurrences.

Renvoie

pyspark.sql.Column: sous-chaîne de la valeur donnée.

Exemples

Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([('a.b.c.d',)], ['s'])
df.select('*', dbf.substring_index(df.s, '.', 2)).show()
df.select('*', dbf.substring_index('s', '.', -3)).show()