Aller au contenu principal

csv (DataFrameWriter)

Enregistre le contenu du DataFrame au format CSV au chemin d'accès spécifié.

Syntaxe​

csv(path, mode=None, compression=None, sep=None, quote=None, escape=None,
header=None, nullValue=None, escapeQuotes=None, quoteAll=None,
dateFormat=None, timestampFormat=None, ignoreLeadingWhiteSpace=None,
ignoreTrailingWhiteSpace=None, charToEscapeQuoteEscaping=None,
encoding=None, emptyValue=None, lineSep=None)

parameter​

parameter

Type

Description

path

str

Le chemin dans tout système de fichiers pris en charge par Hadoop.

mode

str, facultatif

Le comportement lorsque des données existent déjà. Les valeurs acceptées sont 'append', 'overwrite', 'ignore' et 'error' ou 'errorifexists' (default).

parameter

Type

Description

path

str

Le chemin dans tout système de fichiers pris en charge par Hadoop.

mode

str, facultatif

Le comportement lorsque des données existent déjà. Les valeurs acceptées sont 'append', 'overwrite', 'ignore' et 'error' ou 'errorifexists' (default).

Renvoie​

Aucun

Exemples​

Écrire un DataFrame dans un fichier CSV et le relire.

Python
import tempfile
with tempfile.TemporaryDirectory(prefix="csv") as d:
df = spark.createDataFrame([{"age": 100, "name": "Alice"}])
df.write.csv(d, mode="overwrite")

spark.read.schema(df.schema).format("csv").option(
"nullValue", "Alice").load(d).show()
# +---+----+
# |age|name|
# +---+----+
# |100|NULL|
# +---+----+