Aller au contenu principal

Nom (DataStreamReader)

Attribue un nom à la source de streaming pour l'évolution des points de contrôle. Cela permet aux query de streaming d'évoluer en autorisant la réorganisation ou l'ajout de sources sans rompre la compatibilité des points de contrôle. Lorsque l'évolution de la source est activée, toutes les sources d'une query doivent être nommées.

Syntaxe

name(source_name)

parameter

parameter

Type

Description

source_name

str

Le nom de cette source de streaming. Doit contenir uniquement des lettres ASCII (a-z, A-Z), des chiffres (0-9) et des traits de soulignement (_).

parameter

Type

Description

source_name

str

Le nom de cette source de streaming. Doit contenir uniquement des lettres ASCII (a-z, A-Z), des chiffres (0-9) et des traits de soulignement (_).

Renvoie

DataStreamReader

Notes

Nécessite que l'évolution de la source de streaming soit activée via la configuration spark.sql.streaming.enableSourceEvolution.

Exemples

Nommez deux sources et unissez-les :

Python
df1 = spark.readStream.format("rate").name("source1").load()
df2 = spark.readStream.format("rate").name("source2").load()
query = df1.union(df2).writeStream.format("console").start()

Noms de source valides et non valides :

Python
# Valid names
spark.readStream.format("rate").name("mySource").load()
spark.readStream.format("rate").name("my_source_123").load()

# Invalid name — raises AnalysisException
spark.readStream.format("rate").name("my-source").load()