toPandas
Retourne le contenu de ce DataFrame sous forme de Pandas pandas.DataFrame.
Syntaxe
toPandas()
Renvoie
pandas.DataFrame
Notes
Cette méthode ne doit être utilisée que si le pandas.DataFrame Pandas résultant est censé être petit, car toutes les données sont chargées dans la mémoire du Driver.
L'utilisation avec spark.sql.execution.arrow.pyspark.enabled=True est expérimentale.
Ceci n'est disponible que si Pandas est installé et disponible.
Exemples
Python
df = spark.createDataFrame([(2, "Alice"), (5, "Bob")], schema=["age", "name"])
df.toPandas()
# age name
# 0 2 Alice
# 1 5 Bob