Intégration de DBeaver avec Databricks
Cet article porte sur DBeaver, qui est développé par un tiers. Pour contacter le fournisseur, consultez la page issues du repository dbeaver/dbeaver sur GitHub.
DBeaver est un outil de base de données local et multiplateforme pour les développeurs, les administrateurs de bases de données, les data analysts, les data engineers et d'autres personnes qui ont besoin de travailler avec des bases de données. DBeaver prend en charge Databricks ainsi que d'autres bases de données populaires.
Cet article décrit comment utiliser votre machine de développement locale pour installer, configurer et utiliser DBeaver Community Edition (CE), l'outil gratuit et open source, pour travailler avec des bases de données dans Databricks.
Cet article a été testé avec macOS, le JDBC Databricks Driver version 2.6.36, et DBeaver CE version 23.3.0.
Exigences
Avant d’installer DBeaver, votre machine de développement locale doit satisfaire aux exigences suivantes :
- Un système d'exploitation Linux 64 bits, macOS ou Windows 64 bits. (Linux 32 bits est pris en charge, mais non recommandé.)
- Le Databricks JDBC Driver sur votre machine de développement locale, en extrayant le fichier
DatabricksJDBC42.jardu fichierDatabricksJDBC42-<version>.zipdownload.
Vous devez également disposer d'un cluster ou d'un SQL Warehouse Databricks pour vous connecter avec DBeaver.
Étape 1 : Installez DBeaver
download et installez DBeaver CE comme suit :
- **Linux** : Téléchargez et exécutez l'un des installateurs Linux depuis la page de download du site web de DBeaver. Les options d'installation
snapetflatpaksont également fournies sur cette page. - **macOS** :Utilisez Homebrew pour
brew install --cask dbeaver-communityexécuter, ou utilisez MacPorts poursudo port install dbeaver-communityexécuter. Un programme d'installation macOS est également disponible sur la page Download du site web DBeaver. - Windows : utilisez Chocolatey pour exécuter
choco install dbeaver. Un programme d'installation Windows est également disponible sur la page de Download du site web de DBeaver.
Étape 2 : Configurez le Driver JDBC Databricks pour DBeaver.
Configurez DBeaver avec les informations sur le Driver JDBC Databricks que vous avez download précédemment.
- Start DBeaver.
- Si vous êtes invité à créer une nouvelle base de données, cliquez sur **Non**.
- Si vous êtes invité à vous connecter à une base de données ou à en sélectionner une, cliquez sur Annuler .
- Cliquez sur **Base de données > Gestionnaire de Driver**.
- Dans la boîte de dialogue **Driver Manager**, cliquez sur **Nouveau**.
- Dans la boîte de dialogue **Créer un nouveau Driver**, cliquez sur l'onglet **Libraries**.
- Cliquez sur **Ajouter un fichier**.
- Accédez au dossier dans lequel vous avez extrait le Driver JDBC Databricks.
- Naviguez un niveau plus bas pour trouver le fichier
.jar. - Surlignez le fichier
.jaret cliquez sur Ouvrir . - Sous l'onglet Paramètres , pour Nom du Driver , saisissez
Databricks. - Dans l'onglet Paramètres , pour Nom de la classe , saisissez
com.databricks.client.jdbc.Driver. - Cliquez sur **OK**.
- Dans la boîte de dialogue Gestionnaire de Driver , cliquez sur Fermer .
Étape 3 : Connecter DBeaver à vos bases de données Databricks
Utilisez DBeaver pour vous connecter au cluster ou au SQL Warehouse afin d'accéder aux bases de données de votre workspace Databricks.
-
Dans DBeaver, cliquez sur Base de données > Nouvelle connexion à la base de données .
-
Dans la boîte de dialogue Se connecter à une base de données , sur l' tab Tous , cliquez sur Databricks , puis cliquez sur Suivant.
-
Cliquez sur l'onglet Main et saisissez une valeur dans le champ URL JDBC pour votre ressource Databricks. Pour la syntaxe du champ URL JDBC , consultez Authentication settings for the Databricks JDBC Driver (Simba).
-
Cliquez sur Test de la connexion .
Vous devez start votre ressource Databricks avant de tester votre connexion. Dans le cas contraire, le test pourrait prendre plusieurs minutes pour se terminer pendant que la ressource start.
-
Si la connexion réussit, dans la boîte de dialogue **Test de connexion**, cliquez sur **OK**.
-
Dans la boîte de dialogue Se connecter à une base de données , cliquez sur Terminer .
Dans la fenêtre **Navigateur de base de données**, une entrée **Databricks** s'affiche. Pour modifier le nom de la connexion afin de faciliter son identification :
- Cliquez avec le bouton droit sur **Databricks**, puis cliquez sur **Modifier la connexion**.
- Dans la boîte de dialogue Configuration de la connexion , cliquez sur Général .
- Pour **Nom
Databricksde la connexion**, remplacez par un nom différent pour la connexion. - Cliquez sur **OK**.
Répétez les instructions de cette étape pour chaque ressource à laquelle vous souhaitez que DBeaver accède.
Étape 4 : Utilisez DBeaver pour parcourir les objets de données
Utilisez DBeaver pour accéder aux objets de données dans votre Workspace Databricks tels que les tables et leurs propriétés, les vues, les index, les types de données et d'autres types d'objets de données.
-
Dans DBeaver, dans la fenêtre Database Navigator , cliquez avec le bouton droit sur la connexion que vous souhaitez utiliser.
-
Si Connect est activé, cliquez dessus. (Si Connect est désactivé, vous êtes déjà connecté.)
Vous devriez start votre ressource avant d'essayer de vous y connecter. Dans le cas contraire, la connexion pourrait prendre plusieurs minutes avant d'être complète pendant le start de la ressource.
-
Développez la connexion à laquelle vous venez de vous connecter.
-
Développer et parcourir les objets de données disponibles. Double-cliquez sur un objet de données pour obtenir plus d'informations à son sujet.
Répétez les instructions de cette étape pour accéder à des objets de données supplémentaires.
Étape 5 : Utilisez DBeaver pour exécuter des instructions SQL
Utilisez DBeaver pour charger la table trips échantillon à partir du schéma nyctaxi du catalogue samples.
-
Dans DBeaver, dans la fenêtre Database Navigator , cliquez avec le bouton droit sur la connexion que vous souhaitez utiliser.
-
Si Connect est activé, cliquez dessus. (Si Connect est désactivé, vous êtes déjà connecté.)
Vous devriez start votre ressource avant d'essayer de vous y connecter. Dans le cas contraire, la connexion pourrait prendre plusieurs minutes avant d'être complète pendant le start de la ressource.
-
Cliquez sur Éditeur SQL > Nouveau script SQL .
-
Dans l'onglet (connection-name) Script-1 , saisissez cette instruction SQL :
SQLSELECT * FROM samples.nyctaxi.trips; -
Cliquez sur Éditeur SQL > Exécuter le script SQL .
Étapes suivantes
- Utilisez l'éditeur d'objets de base de données pour travailler avec les propriétés des objets de base de données, les données et les diagrammes d'entité-relation.
- Utilisez l’ éditeur de données pour afficher et modifier les données dans une table ou une vue de base de données.
- Utilisez l'éditeur SQL pour travailler avec des scripts SQL.
- Travaillez avec les diagrammes entité-association (ERD) dans DBeaver.
- Importer et exporter des données vers et depuis DBeaver.
- Migrez des données à l'aide de DBeaver.
- Dépanner les problèmes de driver JDBC avec DBeaver.