Aller au contenu principal

randn

Génère une colonne aléatoire avec des échantillons indépendants et identiquement distribués (i.i.d.) issus de la distribution normale standard. Prend en charge Spark Connect.

Pour la fonction Databricks SQL correspondante, consultez la fonctionrandn.

Syntaxe​

Python
from pyspark.sql import functions as dbf

dbf.randn(seed=<seed>)

parameter​

parameter

Type

Description

seed

int (default: None)

Graine pour le générateur aléatoire.

parameter

Type

Description

seed

int (default: None)

Graine pour le générateur aléatoire.

Renvoie​

pyspark.sql.Column: Une colonne de valeurs aléatoires.

Exemples​

Python
from pyspark.sql import functions as dbf
spark.range(0, 2, 1, 1).select("*", dbf.randn()).show()
Output
+---+--------------------------+
| id|randn(3968742514375399317)|
+---+--------------------------+
| 0| -0.47968645355788...|
| 1| -0.4950952457305...|
+---+--------------------------+

Python
from pyspark.sql import functions as dbf
spark.range(0, 2, 1, 1).select("*", dbf.randn(seed=42)).show()
Output
+---+------------------+
| id| randn(42)|
+---+------------------+
| 0| 2.384479054241...|
| 1|0.1920934041293...|
+---+------------------+