split_part
Scinde str par délimiteur et retourne la partie demandée de la scission (indexée à partir de 1).
Si une entrée est nulle, elle retourne null. si partNum est en dehors de la plage des parties fractionnées, renvoie une chaîne vide.
Si partNum est 0, une erreur est générée. Si partNum est négatif, les parties sont comptées à rebours à partir de la fin de la chaîne.
Si le delimiter est une chaîne vide, le str n'est pas divisé.
Pour la fonction Databricks SQL correspondante, consultez la fonctionsplit_part.
Syntaxe
from pyspark.sql import functions as dbf
dbf.split_part(src=<src>, delimiter=<delimiter>, partNum=<partNum>)
parameter
parameter | Type | Description |
|---|---|---|
|
| Une colonne de chaînes de caractères à diviser. |
|
| Une colonne de chaîne de caractères, le délimiteur utilisé pour le fractionnement. |
|
| Une colonne de chaîne, partie demandée de la division (basée sur 1). |
Exemples
from pyspark.sql import functions as dbf
df = spark.createDataFrame([("11.12.13", ".", 3,)], ["a", "b", "c"])
df.select("*", dbf.split_part("a", "b", "c")).show()
df.select("*", dbf.split_part(df.a, df.b, dbf.lit(-2))).show()