partitioning.hours
Une transformation pour les Timestamps afin de partitionner les données par heure.
remarque
Cette fonction ne peut être utilisée qu'en combinaison avec la méthode DataFrameWriterV2.partitionedBy.
Syntaxe
Python
from pyspark.sql.functions import partitioning
partitioning.hours(col)
parameter
parameter | Type | Description |
|---|---|---|
|
| Ciblez la colonne de date ou de Timestamp sur laquelle travailler. |
Exemples
Python
from pyspark.sql.functions import partitioning
df.writeTo("catalog.db.table").partitionedBy(
partitioning.hours("ts")
).createOrReplace()