Aller au contenu principal

regroupement

Fonction d'agrégation : indique si une colonne spécifiée dans une liste GROUP BY est agrégée ou non, renvoie 1 pour agrégée ou 0 pour non agrégée dans l'ensemble de résultats.

Syntaxe

Python
from pyspark.sql import functions as sf

sf.grouping(col)

parameter

parameter

Type

Description

col

pyspark.sql.Column ou str

Colonne à vérifier si elle est agrégée.

parameter

Type

Description

col

pyspark.sql.Column ou str

Colonne à vérifier si elle est agrégée.

Renvoie

pyspark.sql.Column: renvoie 1 pour agrégé ou 0 pour non agrégé dans le jeu de résultats.

Exemples

Exemple 1 : Vérifier l’état de regroupement dans l’Opération de cube.

Python
from pyspark.sql import functions as sf
df = spark.createDataFrame([("Alice", 2), ("Bob", 5)], ("name", "age"))
df.cube("name").agg(sf.grouping("name"), sf.sum("age")).orderBy("name").show()
Output
+-----+--------------+--------+
| name|grouping(name)|sum(age)|
+-----+--------------+--------+
| NULL| 1| 7|
|Alice| 0| 2|
| Bob| 0| 5|
+-----+--------------+--------+