Configurations de l'accès aux données
Ces instructions s'appliquent aux modèles d'accès aux données hérités. Databricks recommande d'utiliser les emplacements externes de Unity Catalog pour l'accès aux données. Consultez Connectez-vous au stockage d'objets cloud à l'aide de Unity Catalog.
Cet article décrit comment gérer les propriétés d'accès aux données pour des SQL Warehouse dans un Workspace.
La modification de ces paramètres redémarre tous les SQL Warehouse en cours d'exécution.
Configurez un compte de service Google Cloud
Pour configurer tous les warehouse afin qu’ils utilisent un compte de service Google Cloud lors de l’accès à Google Cloud Storage (GCS) :
-
Dans Google Cloud Platform, créez un compte de service qui dispose des autorisations sur les services Google Cloud Platform sous-jacents nécessaires pour accéder à vos assets Google Cloud Storage.
-
Accédez à la page des paramètres d'administration.
-
Cliquez sur l'onglet Compute .
-
Cliquez sur **Gérer** à côté de **SQL Warehouses**.
-
Dans le champ **Google Service Account**, saisissez l'adresse e-mail du compte de service dont l'identité sera utilisée au lancement de tous les SQL Warehouse.
Toutes les queries exécutées sur ces warehouses auront accès aux services Google Cloud Platform sous-jacents, dans la limite des autorisations accordées à ce compte de service dans Google Cloud Platform.
-
Cliquez sur Enregistrer .
Configurer les propriétés d'accès aux données pour les SQL Warehouses
-
Cliquez sur votre nom d'utilisateur dans la barre supérieure du workspace et sélectionnez Paramètres dans le menu déroulant.
-
Cliquez sur l'onglet Compute .
-
Cliquez sur **Gérer** à côté de **SQL Warehouses**.
-
Dans la zone de texte Configuration de l'accès aux données , spécifiez des paires clé-valeur contenant des propriétés de metastore.
Pour définir une propriété de configuration Spark sur la valeur d'un secret sans exposer la valeur du secret à Spark, définissez la valeur sur {{secrets/<secret-scope>/<secret-name>}}. Remplacez <secret-scope> par le Secret Scope et <secret-name> par le nom du secret. La valeur doit commencer par {{secrets/ and end with }}. Pour plus d'information sur cette syntaxe, consultez Gérer les secrets.
- Cliquez sur Enregistrer .
Vous pouvez également configurer les propriétés d'accès aux données à l'aide du fournisseur Databricks Terraform et de databricks_sql_global_config.
Propriétés prises en charge
-
Pour une entrée se terminant par
*, toutes les propriétés de ce préfixe sont prises en charge.Par exemple,
spark.sql.hive.metastore.*indique quespark.sql.hive.metastore.jarsetspark.sql.hive.metastore.versionsont pris en charge, ainsi que toute autre propriété start parspark.sql.hive.metastore. -
Pour les propriétés dont les valeurs contiennent des informations sensibles, vous pouvez stocker les informations sensibles dans un secret et définir la valeur de la propriété au nom du secret en utilisant la syntaxe suivante :
secrets/<secret-scope>/<secret-name>.
Les propriétés suivantes sont prises en charge pour les SQL warehouses :
-
spark.databricks.hive.metastore.glueCatalog.enabled -
spark.sql.hive.metastore.* -
spark.sql.warehouse.dir -
spark.hadoop.datanucleus.* -
spark.hadoop.fs.* -
spark.hadoop.hive.* -
spark.hadoop.javax.jdo.option.* -
spark.hive.*
Pour plus d'informations sur la façon de définir ces propriétés, consultez Hive metastore externe.