Gérez le catalogue par default
Cet article présente le catalogue Unity Catalog default, explique comment décider quel catalogue utiliser par default et montre comment le modifier.
Quel est le catalogue default dans Unity Catalog ?
Un catalogue default est configuré pour chaque Workspace compatible avec Unity Catalog. Le catalogue default vous permet d’effectuer des Opérations de données sans spécifier de catalogue. Si vous omettez le nom du catalogue de niveau supérieur lorsque vous effectuez des Opérations de données, le catalogue default est assumé.
Un administrateur de Workspace peut afficher ou changer le catalogue default en utilisant l'interface utilisateur des paramètres d'administration. Vous pouvez également définir le catalogue par default d'un cluster à l'aide d'une configuration Spark.
Le paramètre de catalogue par default du Workspace ne s'applique que lors de l'utilisation de compute qui répond aux exigences de compute pour Unity Catalog. Plus précisément, cela signifie que vous utilisez soit un SQL Warehouse, soit un cluster configuré avec un mode d'accès standard ou dédié. Les ressources de compute qui ne sont pas compatibles avec Unity Catalog utilisent hive_metastore comme default catalog.
Les commandes qui ne spécifient pas le catalogue (par exemple GRANT CREATE TABLE ON SCHEMA myschema TO mygroup) sont évaluées pour le catalogue dans l'ordre suivant :
- Le catalogue est-il défini pour la session à l'aide d'une instruction
USE CATALOGou d'un paramètre JDBC ? - La configuration Spark
spark.databricks.sql.initial.catalog.namespaceest-elle définie sur le cluster ? - Un catalogue par default de Workspace est-il défini pour les clusters ?
La configuration du pipeline pour les LakeFlow Pipelines définit un catalogue default qui remplace le default du Workspace.
La configuration du catalogue default lorsque Unity Catalog est activé
Le catalogue default qui a été initialement configuré pour votre Workspace dépend de la manière dont votre Workspace a été activé pour Unity Catalog :
- Pour certains workspaces activés automatiquement pour Unity Catalog, le *catalogue de Workspace* a été défini comme catalogue par default. Consultez start avec Unity Catalog.
- Pour tous les autres Workspace, le catalogue
hive_metastorea été défini comme catalogue par default.
Lorsque vous migrez du Hive metastore vers Unity Catalog, vous pouvez définir le catalogue par default sur hive_metastore afin d’éviter d’impacter le code existant qui référence le Hive metastore.
Modifier le catalogue default
Un administrateur de Workspace peut modifier le catalogue default du Workspace. Toute personne disposant de l'autorisation de créer ou de modifier une ressource de compute peut définir un catalogue default différent pour la ressource de compute.
La modification du catalogue default peut interrompre les opérations de données existantes qui en dépendent.
Pour configurer un catalogue par default différent pour un Workspace :
- Connectez-vous à votre workspace en tant qu'administrateur de workspace.
- Cliquez sur votre nom d’utilisateur dans la barre supérieure du workspace et sélectionnez Paramètres d’administration dans le menu déroulant.
- Cliquez sur l'onglet Advanced tab.
- Sur la ligne Catalogue default pour le Workspace , entrez le nom du catalogue et cliquez sur Enregistrer .
Redémarrez vos SQL warehouses et clusters pour que la modification prenne effet. Tous les nouveaux SQL Warehouse et clusters redémarrés utiliseront ce catalogue comme Workspace default.
Vous pouvez également remplacer le catalogue par default d'un cluster spécifique en définissant la configuration Spark suivante sur le cluster. Cette approche n'est pas disponible pour les SQL warehouses :
spark.databricks.sql.initial.catalog.namespace
Pour obtenir des instructions, consultez la configuration Spark.
Afficher le catalogue default actuel
Pour obtenir le catalogue default actuel de votre Workspace, vous pouvez utiliser une instruction SQL dans un Notebook ou une query SQL Editor. Un administrateur de Workspace peut obtenir le catalogue default à l'aide de l'interface utilisateur des paramètres d'administration.
- Admin Settings
- SQL
- Connectez-vous à votre workspace en tant qu'administrateur de workspace.
- Cliquez sur votre nom d’utilisateur dans la barre supérieure du workspace et sélectionnez Paramètres d’administration dans le menu déroulant.
- Cliquez sur l'onglet Advanced tab.
- Sur la ligne default catalog for the Workspace , visualisez le nom du catalogue.
Exécutez la commande suivante dans un Notebook ou une query SQL Editor s’exécutant sur un SQL Warehouse ou un cluster compatible Unity Catalog. Le catalogue default du Workspace est renvoyé tant qu’aucune instruction USE CATALOG ou aucun paramètre JDBC n’a été défini sur la session, et tant qu’aucune configuration spark.databricks.sql.initial.catalog.namespace n’est définie pour le cluster.
SELECT current_catalog();