masque
Masque la valeur de chaîne donnée. Cela peut être utile pour créer des copies de tables dont les informations sensibles ont été supprimées.
Pour la fonction Databricks SQL correspondante, consultez la fonctionmask.
Syntaxe
from pyspark.sql import functions as dbf
dbf.mask(col=<col>, upperChar=<upperChar>, lowerChar=<lowerChar>, digitChar=<digitChar>, otherChar=<otherChar>)
parameter
parameter | Type | Description |
|---|---|---|
|
| colonne cible sur laquelle effectuer le compute. |
|
| caractère à utiliser pour remplacer les caractères majuscules. Spécifiez NULL pour conserver le caractère d'origine. |
|
| Caractère à utiliser pour remplacer les caractères minuscules. Spécifiez NULL pour conserver le caractère d'origine. |
|
| caractère pour remplacer les caractères numériques. Spécifiez NULL pour conserver le caractère d'origine. |
|
| caractère par lequel remplacer tous les autres caractères. Spécifiez NULL pour conserver le caractère d'origine. |
Renvoie
pyspark.sql.Column:
Exemples
df = spark.createDataFrame([("AbCD123-@$#",), ("abcd-EFGH-8765-4321",)], ['data'])
df.select(mask(df.data).alias('r')).collect()
df.select(mask(df.data, lit('Y')).alias('r')).collect()
df.select(mask(df.data, lit('Y'), lit('y')).alias('r')).collect()
df.select(mask(df.data, lit('Y'), lit('y'), lit('d')).alias('r')).collect()
df.select(mask(df.data, lit('Y'), lit('y'), lit('d'), lit('*')).alias('r')).collect()