Aller au contenu principal

Nom (DataStreamReader)

Attribue un nom à la source de streaming pour l'évolution des points de contrôle. Cela permet aux query de streaming d'évoluer en autorisant la réorganisation ou l'ajout de sources sans rompre la compatibilité des points de contrôle. Lorsque l'évolution de la source est activée, toutes les sources d'une query doivent être nommées.

Syntaxe​

name(source_name)

parameter​

parameter

Type

Description

source_name

str

Le nom de cette source de streaming. Doit contenir uniquement des lettres ASCII (a-z, A-Z), des chiffres (0-9) et des traits de soulignement (_).

parameter

Type

Description

source_name

str

Le nom de cette source de streaming. Doit contenir uniquement des lettres ASCII (a-z, A-Z), des chiffres (0-9) et des traits de soulignement (_).

Renvoie​

DataStreamReader

Notes​

Nécessite que l'évolution de la source de streaming soit activée via la configuration spark.sql.streaming.enableSourceEvolution.

Exemples​

Nommez deux sources et unissez-les :

Python
df1 = spark.readStream.format("rate").name("source1").load()
df2 = spark.readStream.format("rate").name("source2").load()
query = df1.union(df2).writeStream.format("console").start()

Noms de source valides et non valides :

Python
# Valid names
spark.readStream.format("rate").name("mySource").load()
spark.readStream.format("rate").name("my_source_123").load()

# Invalid name — raises AnalysisException
spark.readStream.format("rate").name("my-source").load()