Aller au contenu principal

array_append

Renvoie une nouvelle colonne de tableau en ajoutant une valeur au tableau existant.

Ajouté dans Databricks Runtime 12.2 LTS

Syntaxe

Python
from pyspark.sql import functions as sf

sf.array_append(col, value)

parameter

parameter

Type

Description

col

pyspark.sql.Column ou str

Le nom de la colonne contenant le tableau.

value

Tout

Une valeur littérale, ou une expression de colonne à ajouter au tableau.

parameter

Type

Description

col

pyspark.sql.Column ou str

Le nom de la colonne contenant le tableau.

value

Tout

Une valeur littérale, ou une expression de colonne à ajouter au tableau.

Renvoie

pyspark.sql.Column: Une nouvelle colonne de tableau avec value ajouté au tableau original.

Exemples

Exemple 1 : Ajout d'une valeur de colonne à une colonne de tableau

Python
from pyspark.sql import Row, functions as sf
df = spark.createDataFrame([Row(c1=["b", "a", "c"], c2="c")])
df.select(sf.array_append(df.c1, df.c2)).show()
Output
+--------------------+
|array_append(c1, c2)|
+--------------------+
| [b, a, c, c]|
+--------------------+

Exemple 2 : Ajout d'une valeur numérique à une colonne de tableau

Python
from pyspark.sql import functions as sf
df = spark.createDataFrame([([1, 2, 3],)], ['data'])
df.select(sf.array_append(df.data, 4)).show()
Output
+---------------------+
|array_append(data, 4)|
+---------------------+
| [1, 2, 3, 4]|
+---------------------+

Exemple 3 : Ajout d'une valeur nulle à une colonne de tableau.

Python
from pyspark.sql import functions as sf
df = spark.createDataFrame([([1, 2, 3],)], ['data'])
df.select(sf.array_append(df.data, None)).show()
Output
+------------------------+
|array_append(data, NULL)|
+------------------------+
| [1, 2, 3, NULL]|
+------------------------+

**Exemple 4** : Ajout d'une valeur à une colonne de tableau NULL

Python
from pyspark.sql import functions as sf
from pyspark.sql.types import ArrayType, IntegerType, StructType, StructField
schema = StructType([
StructField("data", ArrayType(IntegerType()), True)
])
df = spark.createDataFrame([(None,)], schema=schema)
df.select(sf.array_append(df.data, 4)).show()
Output
+---------------------+
|array_append(data, 4)|
+---------------------+
| NULL|
+---------------------+

Exemple 5 : ajout d'une valeur à un tableau vide

Python
from pyspark.sql import functions as sf
from pyspark.sql.types import ArrayType, IntegerType, StructType, StructField
schema = StructType([
StructField("data", ArrayType(IntegerType()), True)
])
df = spark.createDataFrame([([],)], schema=schema)
df.select(sf.array_append(df.data, 1)).show()
Output
+---------------------+
|array_append(data, 1)|
+---------------------+
| [1]|
+---------------------+