Fractionnement
Divise la chaîne en fonction des correspondances du motif donné.
Pour la fonction Databricks SQL correspondante, consultez la fonctionsplit.
Syntaxe
from pyspark.sql import functions as dbf
dbf.split(str=<str>, pattern=<pattern>, limit=<limit>)
parameter
parameter | Type | Description |
|---|---|---|
|
| une expression de chaîne à diviser |
|
| une chaîne représentant une expression régulière. La chaîne regex doit être une expression régulière Java. accepté comme représentation d'expression régulière, pour la rétrocompatibilité. En plus d'int, |
|
| un entier qui contrôle le nombre de fois que |
Renvoie
pyspark.sql.Column: tableau de chaînes séparées.
Exemples
from pyspark.sql import functions as dbf
df = spark.createDataFrame([('oneAtwoBthreeC',)], ['s',])
df.select('*', dbf.split(df.s, '[ABC]')).show()
df.select('*', dbf.split(df.s, '[ABC]', 2)).show()
df.select('*', dbf.split('s', '[ABC]', -2)).show()
df = spark.createDataFrame([
('oneAtwoBthreeC', '[ABC]', 2),
('1A2B3C', '[1-9]+', 1),
('aa2bb3cc4', '[1-9]+', -1)], ['s', 'p', 'l'])
df.select('*', dbf.split(df.s, df.p)).show()
df.select(dbf.split('s', df.p, 'l')).show()