Aller au contenu principal

trier

Renvoie un nouveau DataFrame trié par la ou les colonnes spécifiées.

Syntaxe

sort(*cols: Union[int, str, Column, List[Union[int, str, Column]]], **kwargs: Any)

parameter

parameter

Type

Description

cols

int, str, list ou Colonne, facultatif

liste de noms de colonne ou d'ordinaux de colonne à trier par.

ascending

bool ou liste, facultatif, default True

booléen ou liste de booléens. Trier par ordre croissant ou décroissant. Spécifiez une liste pour plusieurs ordres de tri. Si une liste est spécifiée, la longueur de la liste doit être égale à la longueur de cols.

parameter

Type

Description

cols

int, str, list ou Colonne, facultatif

liste de noms de colonne ou d'ordinaux de colonne à trier par.

ascending

bool ou liste, facultatif, default True

booléen ou liste de booléens. Trier par ordre croissant ou décroissant. Spécifiez une liste pour plusieurs ordres de tri. Si une liste est spécifiée, la longueur de la liste doit être égale à la longueur de cols.

Renvoie

DataFrame: DataFrame trié.

Notes

Un ordinal de colonne start à partir de 1, ce qui est différent du __getitem__ basé sur 0. Si un ordinal de colonne est négatif, cela signifie un tri décroissant.

Exemples

Python
from pyspark.sql import functions as sf
df = spark.createDataFrame([
(2, "Alice"), (5, "Bob")], schema=["age", "name"])

df.sort(sf.asc("age")).show()
# +---+-----+
# |age| name|
# +---+-----+
# | 2|Alice|
# | 5| Bob|
# +---+-----+

df.sort(df.age.desc()).show()
# +---+-----+
# |age| name|
# +---+-----+
# | 5| Bob|
# | 2|Alice|
# +---+-----+

df.sort("age", ascending=False).show()
# +---+-----+
# |age| name|
# +---+-----+
# | 5| Bob|
# | 2|Alice|
# +---+-----+

df = spark.createDataFrame([
(2, "Alice"), (2, "Bob"), (5, "Bob")], schema=["age", "name"])
df.orderBy(sf.desc("age"), "name").show()
# +---+-----+
# |age| name|
# +---+-----+
# | 5| Bob|
# | 2|Alice|
# | 2| Bob|
# +---+-----+