Intégration DataGrip avec Databricks
Cet article présente DataGrip, qui est développé par un tiers. Pour contacter le fournisseur, consultez le support DataGrip.
DataGrip est un environnement de développement intégré (IDE) pour les développeurs de bases de données qui fournit une console de query, une navigation de schéma, des plans d'explication, une complétion de code intelligente, une analyse en temps réel et des corrections rapides, des refactorisations, une intégration de contrôle de version et d'autres fonctionnalités.
Cet article décrit comment utiliser votre machine de développement locale pour installer, configurer et utiliser DataGrip afin de travailler avec des bases de données dans Databricks.
Cet article a été testé avec macOS, la version 2.6.36 du Driver JDBC Databricks et la version 2023.3.1 de DataGrip.
Exigences
Avant d'installer DataGrip, votre machine de développement locale doit satisfaire aux exigences suivantes :
- Un système d'exploitation Linux, macOS ou Windows.
- Téléchargez le Databricks JDBC Driver sur votre machine de développement locale, en extrayant le fichier
DatabricksJDBC42.jardu fichierDatabricksJDBC42-<version>.ziptéléchargé. - Un cluster ou un SQL Warehouse Databricks à connecter à DataGrip.
Étape 1 : Installez DataGrip
download et installer DataGrip.
- Linux : download le fichier
.zip, extrayez son contenu, puis suivez les instructions du fichierInstall-Linux-tar.txt. - macOS : download et exécutez le fichier
.dmg. - Windows : Download et exécutez le fichier
.exe.
Pour plus d'informations, voir Installer DataGrip sur le site web de DataGrip.
Étape 2 : Configurez le Driver JDBC Databricks pour DataGrip
Configurez DataGrip avec les informations relatives au Driver JDBC Databricks que vous avez téléchargé précédemment.
- Start DataGrip.
- Cliquez sur Fichier > Sources de données .
- Dans la boîte de dialogue Sources de données et Drivers , cliquez sur l'onglet Drivers .
- Cliquez sur le bouton + ( Driver ) pour ajouter un Driver.
- Pour **Nom**,
Databrickssaisissez. - Dans le tab Général, dans la liste Fichiers Driver , cliquez sur le bouton + ( Ajouter ).
- Cliquez sur JARs personnalisés .
- Recherchez et sélectionnez le fichier
DatabricksJDBC42.jarque vous avez extrait précédemment, puis cliquez sur Ouvrir . - Pour la **Classe**,
com.databricks.client.jdbc.Driversélectionnez. - Cliquez sur **OK**.
Étape 3 : connecter DataGrip à vos bases de données Databricks
-
Dans DataGrip, cliquez sur Fichier > Sources de données .
-
Dans l'onglet Sources de données , cliquez sur le bouton + ( Ajouter ).
-
Sélectionnez le **driver Databricks** que vous avez ajouté à l'étape précédente.
-
Sous l'onglet Général , pour URL , saisissez la valeur du champ URL JDBC pour votre ressource Databricks. Pour la syntaxe du champ URL JDBC , consultez Paramètres d'authentification pour le Driver JDBC Databricks (Simba).
Le ConnCatalog paramètre de capacité du Driver doit être spécifié dans l'URL JDBC, sinon les schémas ne peuvent pas être identifiés.
- Cliquez sur Test de la connexion .
Vous devriez start votre ressource avant de tester votre connexion. Dans le cas contraire, le test pourrait prendre plusieurs minutes pour se terminer pendant que la ressource start.
-
Si la connexion réussit, dans l'onglet **Schemas tab**, cochez les cases des schémas auxquels vous souhaitez accéder, par exemple **Tous les schémas**.
-
Cliquez sur **OK**.
Répétez les instructions de cette étape pour chaque ressource à laquelle vous souhaitez que DataGrip accède.
Étape 4 : Utilisez DataGrip pour parcourir les tables
Utilisez DataGrip pour accéder aux tables de votre workspace Databricks.
- Dans DataGrip, dans la fenêtre **Base de données**, développez votre nœud de ressources, développez le schéma que vous souhaitez parcourir, puis développez **tables**.
- Double-cliquez sur une table. Le premier ensemble de lignes du tableau s'affiche.
Répétez les instructions de cette étape pour accéder à des tables supplémentaires.
Pour accéder aux tables dans d'autres schémas, dans la barre d'outils de la fenêtre Base de données , cliquez sur l'icône Propriétés de la source de données . Dans la boîte de dialogue **Sources de données et Drivers**, dans l'onglet **tab**, cochez la case pour chaque schéma supplémentaire auquel vous souhaitez accéder, puis cliquez sur **OK**.
Étape 5 : utiliser DataGrip pour exécuter des instructions SQL
Utilisez DataGrip pour charger la table d'exemple trips à partir du schéma nyctaxi du catalogue samples.
-
Dans DataGrip, cliquez sur Fichier > Nouveau > Fichier SQL .
-
Saisissez un nom pour le fichier, par exemple
select_trips. -
Dans le
select_trips.sqlfile tab, saisissez l'instruction SQL suivante :SQLSELECT * FROM samples.nyctaxi.trips; -
Sélectionnez l'
SELECTinstruction. -
Dans la barre d’outils de l’onglet du fichier, cliquez sur l’icône **Exécuter**.
Étapes suivantes
- En savoir plus sur la console de requête dans DataGrip.
- En savoir plus sur l'éditeur de données dans DataGrip.
- En savoir plus sur les diverses fenêtres d'outil dans DataGrip.
- Découvrez comment rechercher dans DataGrip.
- Découvrez comment exporter des données dans DataGrip.
- Découvrez comment rechercher et remplacer du texte à l'aide d'expressions régulières dans DataGrip.