Aller au contenu principal

randn

Génère une colonne aléatoire avec des échantillons indépendants et identiquement distribués (i.i.d.) issus de la distribution normale standard. Prend en charge Spark Connect.

Pour la fonction Databricks SQL correspondante, consultez la fonctionrandn.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.randn(seed=<seed>)

parameter

parameter

Type

Description

seed

int (default: None)

Graine pour le générateur aléatoire.

parameter

Type

Description

seed

int (default: None)

Graine pour le générateur aléatoire.

Renvoie

pyspark.sql.Column: Une colonne de valeurs aléatoires.

Exemples

Python
from pyspark.sql import functions as dbf
spark.range(0, 2, 1, 1).select("*", dbf.randn()).show()
Output
+---+--------------------------+
| id|randn(3968742514375399317)|
+---+--------------------------+
| 0| -0.47968645355788...|
| 1| -0.4950952457305...|
+---+--------------------------+

Python
from pyspark.sql import functions as dbf
spark.range(0, 2, 1, 1).select("*", dbf.randn(seed=42)).show()
Output
+---+------------------+
| id| randn(42)|
+---+------------------+
| 0| 2.384479054241...|
| 1|0.1920934041293...|
+---+------------------+