trigger (DataStreamWriter)
Définit le Trigger pour la query de streaming. Si non défini, la query s'exécute aussi vite que possible, équivalent à processingTime='0 seconds'. Un seul paramètre de trigger peut être défini à la fois.
Pour plus d'informations, consultez Configurer les intervalles de trigger de Structured Streaming.
Syntaxe
trigger(*, processingTime=None, once=None, continuous=None, availableNow=None, realTime=None)
parameter
parameter | Type | Description |
|---|---|---|
| str, facultatif | Une chaîne d'intervalle de temps de traitement (par exemple, |
| bool, facultatif | Si |
| str, facultatif | Une chaîne d'intervalle de temps (par exemple, |
| bool, facultatif | Si |
| str, facultatif | Une chaîne de durée de batch (par exemple, |
Renvoie
DataStreamWriter
Exemples
df = spark.readStream.format("rate").load()
Exécution du Trigger toutes les 5 secondes :
df.writeStream.trigger(processingTime='5 seconds')
# <...streaming.readwriter.DataStreamWriter object ...>
Trigger continuous execution every 5 secondes :
:::note Compatibilité Serverless
trigger(continuous=) n'est pas pris en charge sur le compute Serverless de Databricks. Pour les pipelines continus sur serverless, utilisez le mode continu Lakeflow Pipelines plutôt.
:::
df.writeStream.trigger(continuous='5 seconds')
# <...streaming.readwriter.DataStreamWriter object ...>
Traitez toutes les données disponibles par lots :
df.writeStream.trigger(availableNow=True)
# <...streaming.readwriter.DataStreamWriter object ...>
Trigger l'exécution en temps réel toutes les 5 secondes :
df.writeStream.trigger(realTime='5 seconds')
# <...streaming.readwriter.DataStreamWriter object ...>