Aller au contenu principal

Intégration de DBeaver avec Databricks

remarque

Cet article porte sur DBeaver, qui est développé par un tiers. Pour contacter le fournisseur, consultez la page issues du repository dbeaver/dbeaver sur GitHub.

DBeaver est un outil de base de données local et multiplateforme pour les développeurs, les administrateurs de bases de données, les data analysts, les data engineers et d'autres personnes qui ont besoin de travailler avec des bases de données. DBeaver prend en charge Databricks ainsi que d'autres bases de données populaires.

Cet article décrit comment utiliser votre machine de développement locale pour installer, configurer et utiliser DBeaver Community Edition (CE), l'outil gratuit et open source, pour travailler avec des bases de données dans Databricks.

remarque

Cet article a été testé avec macOS, le JDBC Databricks Driver version 2.6.36, et DBeaver CE version 23.3.0.

Exigences

Avant d’installer DBeaver, votre machine de développement locale doit satisfaire aux exigences suivantes :

  • Un système d'exploitation Linux 64 bits, macOS ou Windows 64 bits. (Linux 32 bits est pris en charge, mais non recommandé.)
  • Le Databricks JDBC Driver sur votre machine de développement locale, en extrayant le fichier DatabricksJDBC42.jar du fichier DatabricksJDBC42-<version>.zip download.

Vous devez également disposer d'un cluster ou d'un SQL Warehouse Databricks pour vous connecter avec DBeaver.

Étape 1 : Installez DBeaver

download et installez DBeaver CE comme suit :

  • **Linux** : Téléchargez et exécutez l'un des installateurs Linux depuis la page de download du site web de DBeaver. Les options d'installation snap et flatpak sont également fournies sur cette page.
  • **macOS** :Utilisez Homebrew pour brew install --cask dbeaver-community exécuter, ou utilisez MacPorts pour sudo port install dbeaver-community exécuter. Un programme d'installation macOS est également disponible sur la page Download du site web DBeaver.
  • Windows : utilisez Chocolatey pour exécuter choco install dbeaver. Un programme d'installation Windows est également disponible sur la page de Download du site web de DBeaver.

Étape 2 : Configurez le Driver JDBC Databricks pour DBeaver.

Configurez DBeaver avec les informations sur le Driver JDBC Databricks que vous avez download précédemment.

  1. Start DBeaver.
  2. Si vous êtes invité à créer une nouvelle base de données, cliquez sur **Non**.
  3. Si vous êtes invité à vous connecter à une base de données ou à en sélectionner une, cliquez sur Annuler .
  4. Cliquez sur **Base de données > Gestionnaire de Driver**.
  5. Dans la boîte de dialogue **Driver Manager**, cliquez sur **Nouveau**.
  6. Dans la boîte de dialogue **Créer un nouveau Driver**, cliquez sur l'onglet **Libraries**.
  7. Cliquez sur **Ajouter un fichier**.
  8. Accédez au dossier dans lequel vous avez extrait le Driver JDBC Databricks.
  9. Naviguez un niveau plus bas pour trouver le fichier .jar.
  10. Surlignez le fichier .jar et cliquez sur Ouvrir .
  11. Sous l'onglet Paramètres , pour Nom du Driver , saisissez Databricks.
  12. Dans l'onglet Paramètres , pour Nom de la classe , saisissez com.databricks.client.jdbc.Driver.
  13. Cliquez sur **OK**.
  14. Dans la boîte de dialogue Gestionnaire de Driver , cliquez sur Fermer .

Étape 3 : Connecter DBeaver à vos bases de données Databricks

Utilisez DBeaver pour vous connecter au cluster ou au SQL Warehouse afin d'accéder aux bases de données de votre workspace Databricks.

  1. Dans DBeaver, cliquez sur Base de données > Nouvelle connexion à la base de données .

  2. Dans la boîte de dialogue Se connecter à une base de données , sur l' tab Tous , cliquez sur Databricks , puis cliquez sur Suivant.

  3. Cliquez sur l'onglet Main et saisissez une valeur dans le champ URL JDBC pour votre ressource Databricks. Pour la syntaxe du champ URL JDBC , consultez Authentication settings for the Databricks JDBC Driver (Simba).

  4. Cliquez sur Test de la connexion .

astuce

Vous devez start votre ressource Databricks avant de tester votre connexion. Dans le cas contraire, le test pourrait prendre plusieurs minutes pour se terminer pendant que la ressource start.

  1. Si la connexion réussit, dans la boîte de dialogue **Test de connexion**, cliquez sur **OK**.

  2. Dans la boîte de dialogue Se connecter à une base de données , cliquez sur Terminer .

Dans la fenêtre **Navigateur de base de données**, une entrée **Databricks** s'affiche. Pour modifier le nom de la connexion afin de faciliter son identification :

  1. Cliquez avec le bouton droit sur **Databricks**, puis cliquez sur **Modifier la connexion**.
  2. Dans la boîte de dialogue Configuration de la connexion , cliquez sur Général .
  3. Pour **Nom Databricks de la connexion**, remplacez par un nom différent pour la connexion.
  4. Cliquez sur **OK**.

Répétez les instructions de cette étape pour chaque ressource à laquelle vous souhaitez que DBeaver accède.

Étape 4 : Utilisez DBeaver pour parcourir les objets de données

Utilisez DBeaver pour accéder aux objets de données dans votre Workspace Databricks tels que les tables et leurs propriétés, les vues, les index, les types de données et d'autres types d'objets de données.

  1. Dans DBeaver, dans la fenêtre Database Navigator , cliquez avec le bouton droit sur la connexion que vous souhaitez utiliser.

  2. Si Connect est activé, cliquez dessus. (Si Connect est désactivé, vous êtes déjà connecté.)

astuce

Vous devriez start votre ressource avant d'essayer de vous y connecter. Dans le cas contraire, la connexion pourrait prendre plusieurs minutes avant d'être complète pendant le start de la ressource.

  1. Développez la connexion à laquelle vous venez de vous connecter.

  2. Développer et parcourir les objets de données disponibles. Double-cliquez sur un objet de données pour obtenir plus d'informations à son sujet.

Répétez les instructions de cette étape pour accéder à des objets de données supplémentaires.

Étape 5 : Utilisez DBeaver pour exécuter des instructions SQL

Utilisez DBeaver pour charger la table trips échantillon à partir du schéma nyctaxi du catalogue samples.

  1. Dans DBeaver, dans la fenêtre Database Navigator , cliquez avec le bouton droit sur la connexion que vous souhaitez utiliser.

  2. Si Connect est activé, cliquez dessus. (Si Connect est désactivé, vous êtes déjà connecté.)

astuce

Vous devriez start votre ressource avant d'essayer de vous y connecter. Dans le cas contraire, la connexion pourrait prendre plusieurs minutes avant d'être complète pendant le start de la ressource.

  1. Cliquez sur Éditeur SQL > Nouveau script SQL .

  2. Dans l'onglet (connection-name) Script-1 , saisissez cette instruction SQL :

    SQL
    SELECT * FROM samples.nyctaxi.trips;
  3. Cliquez sur Éditeur SQL > Exécuter le script SQL .

Étapes suivantes

Ressources supplémentaires