Aller au contenu principal

Excel (DataFrameReader)

Charge les fichiers Excel et renvoie le résultat en tant que DataFrame.

Syntaxe

excel(path, dataAddress=None, headerRows=None, listSheets=None,
dateFormat=None, timestampFormat=None)

parameter

parameter

Type

Description

path

str ou list

Un ou plusieurs chemins d'entrée.

dataAddress

str, facultatif

L'adresse des données dans le fichier Excel.

headerRows

int ou str, facultatif

Le nombre de lignes d'en-tête.

listSheets

bool ou str, facultatif

Si True, renvoie la liste des noms de feuille au lieu de lire les données.

dateFormat

str, facultatif

La chaîne de format de date.

timestampFormat

str, facultatif

La chaîne de format du Timestamp.

parameter

Type

Description

path

str ou list

Un ou plusieurs chemins d'entrée.

dataAddress

str, facultatif

L'adresse des données dans le fichier Excel.

headerRows

int ou str, facultatif

Le nombre de lignes d'en-tête.

listSheets

bool ou str, facultatif

Si True, renvoie la liste des noms de feuille au lieu de lire les données.

dateFormat

str, facultatif

La chaîne de format de date.

timestampFormat

str, facultatif

La chaîne de format du Timestamp.

Renvoie

DataFrame

Exemples

Écrivez un DataFrame dans un fichier Excel et relisez-le.

Python
import tempfile
with tempfile.TemporaryDirectory(prefix="excel") as d:
spark.createDataFrame(
[{"age": 100.1, "name": "Alice"}]
).write.mode("overwrite").option("headerRows", 1).excel(d)

spark.read.excel(d, headerRows=1).show()
# +-----+------------+
# | age| name|
# +-----+------------+
# |100.1|Alice|
# +-----+------------+