Aller au contenu principal

compartiment

Fonction de transformation de partition : une transformation pour tout type qui partitionne par un hachage de la colonne d'entrée. Prend en charge Spark Connect.

attention

Obsolète dans la version 4.0.0. Utilisez partitioning.bucket au lieu de.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.bucket(numBuckets=<numBuckets>, col=<col>)

parameter

parameter

Type

Description

numBuckets

pyspark.sql.Column OU int

Le nombre de compartiments.

col

pyspark.sql.Column OU str

Ciblez la colonne de date ou de Timestamp sur laquelle travailler.

parameter

Type

Description

numBuckets

pyspark.sql.Column OU int

Le nombre de compartiments.

col

pyspark.sql.Column OU str

Ciblez la colonne de date ou de Timestamp sur laquelle travailler.

Renvoie

pyspark.sql.Column: Données partitionnées par les colonnes données.

Exemples

Python
df.writeTo("catalog.db.table").partitionedBy(
bucket(42, "ts")
).createOrReplace()
remarque

Cette fonction peut être utilisée uniquement en combinaison avec la méthode partitionedBy du DataFrameWriterV2.