Aller au contenu principal

sous-chaîne

La sous-chaîne start à pos et a une longueur de len lorsque la chaîne est de type String, ou renvoie la tranche du tableau d’octets qui start à pos octets et a une longueur de len lorsque la chaîne est de type binaire.

La position n'est pas basée sur zéro, mais sur un index basé sur 1.

Pour la fonction Databricks SQL correspondante, consultez la fonctionsubstring.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.substring(str=<str>, pos=<pos>, len=<len>)

parameter

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

pos

pyspark.sql.Column ou str ou int

position de départ dans str.

len

pyspark.sql.Column ou str ou int

longueur de caractères.

parameter

Type

Description

str

pyspark.sql.Column OU str

colonne cible sur laquelle travailler.

pos

pyspark.sql.Column ou str ou int

position de départ dans str.

len

pyspark.sql.Column ou str ou int

longueur de caractères.

Renvoie

pyspark.sql.Column: sous-chaîne de la valeur donnée.

Exemples

Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([('abcd',)], ['s',])
df.select('*', dbf.substring(df.s, 1, 2)).show()
df = spark.createDataFrame([('Spark', 2, 3)], ['s', 'p', 'l'])
df.select('*', dbf.substring(df.s, 2, df.l)).show()
df.select('*', dbf.substring(df.s, df.p, 3)).show()
df.select('*', dbf.substring(df.s, df.p, df.l)).show()
df = spark.createDataFrame([('Spark', 2, 3)], ['s', 'p', 'l'])
df.select('*', dbf.substring(df.s, 2, 'l')).show()
df.select('*', dbf.substring('s', 'p', 'l')).show()