Aller au contenu principal

orc (DataFrameWriter)

Enregistre le contenu du DataFrame au format ORC au chemin d'accès spécifié.

Syntaxe

orc(path, mode=None, partitionBy=None, compression=None)

parameter

parameter

Type

Description

path

str

Le chemin dans tout système de fichiers pris en charge par Hadoop.

mode

str, facultatif

Le comportement lorsque des données existent déjà. Les valeurs acceptées sont 'append', 'overwrite', 'ignore' et 'error' ou 'errorifexists' (default).

partitionBy

chaîne ou liste, facultatif

Noms des colonnes de partitionnement.

compression

str, facultatif

Le codec de compression à utiliser.

parameter

Type

Description

path

str

Le chemin dans tout système de fichiers pris en charge par Hadoop.

mode

str, facultatif

Le comportement lorsque des données existent déjà. Les valeurs acceptées sont 'append', 'overwrite', 'ignore' et 'error' ou 'errorifexists' (default).

partitionBy

chaîne ou liste, facultatif

Noms des colonnes de partitionnement.

compression

str, facultatif

Le codec de compression à utiliser.

Renvoie

Aucun

Exemples

Écrire un DataFrame dans un fichier ORC et le relire.

Python
import tempfile
with tempfile.TemporaryDirectory(prefix="orc") as d:
spark.createDataFrame(
[{"age": 100, "name": "Alice"}]
).write.orc(d, mode="overwrite")

spark.read.format("orc").load(d).show()
# +---+------------+
# |age| name|
# +---+------------+
# |100|Alice|
# +---+------------+