Aller au contenu principal

covar_pop

Renvoie une nouvelle colonne pour la covariance de la population de col1 et col2.

Syntaxe

Python
from pyspark.sql import functions as sf

sf.covar_pop(col1, col2)

parameter

parameter

Type

Description

col1

pyspark.sql.Column ou nom de colonne

Première colonne pour calculer la covariance.

col2

pyspark.sql.Column ou nom de colonne

Deuxième colonne pour calculer la covariance.

parameter

Type

Description

col1

pyspark.sql.Column ou nom de colonne

Première colonne pour calculer la covariance.

col2

pyspark.sql.Column ou nom de colonne

Deuxième colonne pour calculer la covariance.

Renvoie

pyspark.sql.Column: covariance de ces deux valeurs de colonne.

Exemples

Python
from pyspark.sql import functions as sf
a = [1] * 10
b = [1] * 10
df = spark.createDataFrame(zip(a, b), ["a", "b"])
df.agg(sf.covar_pop("a", df.b)).show()
Output
+---------------+
|covar_pop(a, b)|
+---------------+
| 0.0|
+---------------+