drop (DataFrame)
Retourne un nouveau DataFrame sans les colonnes spécifiées. Cette opération est nulle si le schéma ne contient pas le ou les noms de colonne donnés.
Syntaxe
drop(*cols: "ColumnOrName")
parameter
parameter | Type | Description |
|---|---|---|
| str or Column | Un nom de colonne, ou la colonne à supprimer. |
Renvoie
DataFrame: Un nouveau DataFrame sans les colonnes spécifiées.
Notes
Lorsqu'une entrée est un nom de colonne, elle est traitée littéralement sans autre interprétation. Sinon, il essaiera de faire correspondre l'expression équivalente. Ainsi, la suppression d'une colonne par son nom drop(colName) a une sémantique différente de la suppression directe de la colonne drop(col(colName)).
Exemples
Python
df = spark.createDataFrame(
[(14, "Tom"), (23, "Alice"), (16, "Bob")], ["age", "name"])
df.drop('age').show()
# +-----+
# | name|
# +-----+
# | Tom|
# |Alice|
# | Bob|
# +-----+
df.drop(df.age).show()
# +-----+
# | name|
# +-----+
# | Tom|
# |Alice|
# | Bob|
# +-----+
df2 = spark.createDataFrame([(80, "Tom"), (85, "Bob")], ["height", "name"])
df.join(df2, df.name == df2.name).drop('name').sort('age').show()
# +---+------+
# |age|height|
# +---+------+
# | 14| 80|
# | 16| 85|
# +---+------+