Aller au contenu principal

timestamp_diff

Obtient la différence entre les horodatages dans les unités spécifiées en tronquant la partie fractionnaire.

Syntaxe

Python
from pyspark.sql import functions as dbf

dbf.timestamp_diff(unit=<unit>, start=<start>, end=<end>)

parameter

parameter

Type

Description

unit

literal string

Ceci indique les unités de la différence entre les Timestamp donnés. Les options prises en charge sont (insensibles à la casse) : "YEAR", "QUARTER", "MONTH", "WEEK", "DAY", "HOUR", "MINUTE", "SECOND", "MILLISECOND" et "MICROSECOND".

start

pyspark.sql.Column OU str

Un Timestamp que l'expression soustrait de endTimestamp.

end

pyspark.sql.Column OU str

Un Timestamp à partir duquel l'expression soustrait startTimestamp.

parameter

Type

Description

unit

literal string

Ceci indique les unités de la différence entre les Timestamp donnés. Les options prises en charge sont (insensibles à la casse) : "YEAR", "QUARTER", "MONTH", "WEEK", "DAY", "HOUR", "MINUTE", "SECOND", "MILLISECOND" et "MICROSECOND".

start

pyspark.sql.Column OU str

Un Timestamp que l'expression soustrait de endTimestamp.

end

pyspark.sql.Column OU str

Un Timestamp à partir duquel l'expression soustrait startTimestamp.

Renvoie

pyspark.sql.Column: la différence entre les Timestamp.

Exemples

Python
import datetime
from pyspark.sql import functions as dbf
df = spark.createDataFrame(
[(datetime.datetime(2016, 3, 11, 9, 0, 7), datetime.datetime(2024, 4, 2, 9, 0, 7))],
['ts1', 'ts2'])
df.select('*', dbf.timestamp_diff('year', 'ts1', 'ts2')).show()
df.select('*', dbf.timestamp_diff('WEEK', 'ts1', 'ts2')).show()
df.select('*', dbf.timestamp_diff('day', df.ts2, df.ts1)).show()