Nom (DataStreamReader)
Attribue un nom à la source de streaming pour l'évolution des points de contrôle. Cela permet aux query de streaming d'évoluer en autorisant la réorganisation ou l'ajout de sources sans rompre la compatibilité des points de contrôle. Lorsque l'évolution de la source est activée, toutes les sources d'une query doivent être nommées.
Syntaxe
name(source_name)
parameter
parameter | Type | Description |
|---|---|---|
| str | Le nom de cette source de streaming. Doit contenir uniquement des lettres ASCII (a-z, A-Z), des chiffres (0-9) et des traits de soulignement (_). |
Renvoie
DataStreamReader
Notes
Nécessite que l'évolution de la source de streaming soit activée via la configuration spark.sql.streaming.enableSourceEvolution.
Exemples
Nommez deux sources et unissez-les :
Python
df1 = spark.readStream.format("rate").name("source1").load()
df2 = spark.readStream.format("rate").name("source2").load()
query = df1.union(df2).writeStream.format("console").start()
Noms de source valides et non valides :
Python
# Valid names
spark.readStream.format("rate").name("mySource").load()
spark.readStream.format("rate").name("my_source_123").load()
# Invalid name — raises AnalysisException
spark.readStream.format("rate").name("my-source").load()