Aller au contenu principal

toPandas

Retourne le contenu de ce DataFrame sous forme de Pandas pandas.DataFrame.

Syntaxe

toPandas()

Renvoie

pandas.DataFrame

Notes

Cette méthode ne doit être utilisée que si le pandas.DataFrame Pandas résultant est censé être petit, car toutes les données sont chargées dans la mémoire du Driver.

L'utilisation avec spark.sql.execution.arrow.pyspark.enabled=True est expérimentale.

Ceci n'est disponible que si Pandas est installé et disponible.

Exemples

Python
df = spark.createDataFrame([(2, "Alice"), (5, "Bob")], schema=["age", "name"])
df.toPandas()
# age name
# 0 2 Alice
# 1 5 Bob