Aller au contenu principal

Créer une table

Crée une table basée sur le dataset dans une source de données.

Syntaxe

createTable(tableName: str, path: str = None, source: str = None, schema: StructType = None, description: str = None, **options: str)

parameter

parameter

Type

Description

tableName

str

Nom de la table à créer. Peut être qualifié avec le nom du catalogue.

path

str, facultatif

Le chemin dans lequel les données de cette table existent. Lorsque path est spécifié, une table externe est créée à partir des données au chemin donné. Sinon, une table gérée est créée.

source

str, facultatif

La source de cette table telle que 'parquet', 'orc', etc. Si source n'est pas spécifié, la source de données default configurée par spark.sql.sources.default sera utilisée.

schema

StructType, facultatif

Le schéma de cette table.

description

str, facultatif

La description de cette table.

**options

dictionnaire, facultatif

Options supplémentaires à spécifier dans la table.

parameter

Type

Description

tableName

str

Nom de la table à créer. Peut être qualifié avec le nom du catalogue.

path

str, facultatif

Le chemin dans lequel les données de cette table existent. Lorsque path est spécifié, une table externe est créée à partir des données au chemin donné. Sinon, une table gérée est créée.

source

str, facultatif

La source de cette table telle que 'parquet', 'orc', etc. Si source n'est pas spécifié, la source de données default configurée par spark.sql.sources.default sera utilisée.

schema

StructType, facultatif

Le schéma de cette table.

description

str, facultatif

La description de cette table.

**options

dictionnaire, facultatif

Options supplémentaires à spécifier dans la table.

Renvoie

DataFrame

Le DataFrame associé à la table.

Exemples

Python
# Creating a managed table.
_ = spark.catalog.createTable("tbl1", schema=spark.range(1).schema, source='parquet')
_ = spark.sql("DROP TABLE tbl1")

# Creating an external table.
import tempfile
with tempfile.TemporaryDirectory(prefix="createTable") as d:
_ = spark.catalog.createTable(
"tbl2", schema=spark.range(1).schema, path=d, source='parquet')
_ = spark.sql("DROP TABLE tbl2")