randn
Génère une colonne aléatoire avec des échantillons indépendants et identiquement distribués (i.i.d.) issus de la distribution normale standard. Prend en charge Spark Connect.
Pour la fonction Databricks SQL correspondante, consultez la fonctionrandn.
Syntaxe
Python
from pyspark.sql import functions as dbf
dbf.randn(seed=<seed>)
parameter
parameter | Type | Description |
|---|---|---|
|
| Graine pour le générateur aléatoire. |
Renvoie
pyspark.sql.Column: Une colonne de valeurs aléatoires.
Exemples
Python
from pyspark.sql import functions as dbf
spark.range(0, 2, 1, 1).select("*", dbf.randn()).show()
Output
+---+--------------------------+
| id|randn(3968742514375399317)|
+---+--------------------------+
| 0| -0.47968645355788...|
| 1| -0.4950952457305...|
+---+--------------------------+
Python
from pyspark.sql import functions as dbf
spark.range(0, 2, 1, 1).select("*", dbf.randn(seed=42)).show()
Output
+---+------------------+
| id| randn(42)|
+---+------------------+
| 0| 2.384479054241...|
| 1|0.1920934041293...|
+---+------------------+