Aller au contenu principal

toArrow

Renvoie le contenu de ce DataFrame en tant que PyArrow pyarrow.Table.

Ajouté dans Databricks Runtime 15.3

Syntaxe

toArrow()

Renvoie

pyarrow.Table

Notes

Cette méthode ne doit être utilisée que si le PyArrow pyarrow.Table résultant est censé être petit, car toutes les données sont chargées dans la mémoire du driver.

Ceci n'est disponible que si PyArrow est installé et disponible.

Cette API est une API de développeur.

Exemples

Python
df = spark.createDataFrame([(2, "Alice"), (5, "Bob")], schema=["age", "name"])
df.coalesce(1).toArrow()
# pyarrow.Table
# age: int64
# name: string
# ----
# age: [[2,5]]
# name: [["Alice","Bob"]]