Aller au contenu principal

nanvl

Renvoie col1 si elle n'est pas NaN, ou col2 si col1 est NaN. Les deux entrées doivent être des colonnes à virgule flottante (DoubleType ou FloatType). Prend en charge Spark Connect.

Pour la fonction Databricks SQL correspondante, consultez la fonctionnanvl.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.nanvl(col1=<col1>, col2=<col2>)

parameter

parameter

Type

Description

col1

pyspark.sql.Column ou str

Première colonne à vérifier.

col2

pyspark.sql.Column ou str

Deuxième colonne à renvoyer si la première est NaN.

parameter

Type

Description

col1

pyspark.sql.Column ou str

Première colonne à vérifier.

col2

pyspark.sql.Column ou str

Deuxième colonne à renvoyer si la première est NaN.

Renvoie

pyspark.sql.Column: valeur de la première colonne ou de la seconde si la première est NaN.

Exemples

Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([(1.0, float('nan')), (float('nan'), 2.0)], ("a", "b"))
df.select("*", dbf.nanvl("a", "b"), dbf.nanvl(df.a, df.b)).show()
Output
+---+---+-----------+-----------+
| a| b|nanvl(a, b)|nanvl(a, b)|
+---+---+-----------+-----------+
|1.0|NaN| 1.0| 1.0|
|NaN|2.0| 2.0| 2.0|
+---+---+-----------+-----------+