Aller au contenu principal

diffusion

Marque un DataFrame comme suffisamment petit pour être utilisé dans les jointures de diffusion. Prend en charge Spark Connect.

Syntaxe​

Python
from pyspark.sql import functions as dbf

dbf.broadcast(df=<df>)

parameter​

parameter

Type

Description

df

pyspark.sql.DataFrame

DataFrame à marquer comme prêt pour la jointure de diffusion.

parameter

Type

Description

df

pyspark.sql.DataFrame

DataFrame à marquer comme prêt pour la jointure de diffusion.

Renvoie​

pyspark.sql.DataFrame: DataFrame marqué comme prêt pour la jointure par diffusion.

Exemples​

Python
from pyspark.sql import functions as dbf
df = spark.createDataFrame([1, 2, 3, 3, 4], "int")
df_small = spark.range(3)
df_b = dbf.broadcast(df_small)
df.join(df_b, df.value == df_small.id).show()
Output
+-----+---+
|value| id|
+-----+---+
| 1| 1|
| 2| 2|
+-----+---+