DataStreamWriter
Interface permettant d'écrire un DataFrame en streaming dans des systèmes de stockage externes (par exemple, les systèmes de fichiers et les magasins de clé-valeur). Utilisez df.writeStream pour y accéder.
Syntaxe
# Access through DataFrame
df.writeStream
Méthodes
Méthode | Description |
|---|---|
Spécifie comment les données d'un DataFrame de streaming sont écrites vers le récepteur. Les options sont | |
Spécifie le format de la source de données de sortie. | |
Ajoute une option de sortie pour la source de données sous-jacente. | |
Ajoute plusieurs options de sortie pour la source de données sous-jacente. | |
Partitionne la sortie par les colonnes données sur le système de fichiers. | |
Clusters la sortie par les colonnes données. | |
Spécifie le nom de la query de streaming. | |
Définit le Trigger pour l'exécution de la query en streaming. | |
Définit la sortie de la query en streaming à traiter par la fonction ou l'objet donné. | |
Définit la sortie de chaque microbatch à traiter par la fonction donnée. | |
Démarre l’exécution de la query de streaming et renvoie un objet | |
Alias pour | |
start l'exécution de la query de streaming, produisant continuellement des résultats vers la table spécifiée. |
Exemples
Chargez un stream de taux, appliquez une transformation, écrivez sur la console et arrêtez après 3 secondes.
import time
df = spark.readStream.format("rate").load()
df = df.selectExpr("value % 3 as v")
q = df.writeStream.format("console").start()
time.sleep(3)
q.stop()