Aller au contenu principal

Intégration DataGrip avec Databricks

remarque

Cet article présente DataGrip, qui est développé par un tiers. Pour contacter le fournisseur, consultez le support DataGrip.

DataGrip est un environnement de développement intégré (IDE) pour les développeurs de bases de données qui fournit une console de query, une navigation de schéma, des plans d'explication, une complétion de code intelligente, une analyse en temps réel et des corrections rapides, des refactorisations, une intégration de contrôle de version et d'autres fonctionnalités.

Cet article décrit comment utiliser votre machine de développement locale pour installer, configurer et utiliser DataGrip afin de travailler avec des bases de données dans Databricks.

remarque

Cet article a été testé avec macOS, la version 2.6.36 du Driver JDBC Databricks et la version 2023.3.1 de DataGrip.

Exigences

Avant d'installer DataGrip, votre machine de développement locale doit satisfaire aux exigences suivantes :

  • Un système d'exploitation Linux, macOS ou Windows.
  • Téléchargez le Databricks JDBC Driver sur votre machine de développement locale, en extrayant le fichier DatabricksJDBC42.jar du fichier DatabricksJDBC42-<version>.zip téléchargé.
  • Un cluster ou un SQL Warehouse Databricks à connecter à DataGrip.

Étape 1 : Installez DataGrip

download et installer DataGrip.

  • Linux : download le fichier .zip, extrayez son contenu, puis suivez les instructions du fichier Install-Linux-tar.txt.
  • macOS : download et exécutez le fichier .dmg.
  • Windows : Download et exécutez le fichier .exe.

Pour plus d'informations, voir Installer DataGrip sur le site web de DataGrip.

Étape 2 : Configurez le Driver JDBC Databricks pour DataGrip

Configurez DataGrip avec les informations relatives au Driver JDBC Databricks que vous avez téléchargé précédemment.

  1. Start DataGrip.
  2. Cliquez sur Fichier > Sources de données .
  3. Dans la boîte de dialogue Sources de données et Drivers , cliquez sur l'onglet Drivers .
  4. Cliquez sur le bouton + ( Driver ) pour ajouter un Driver.
  5. Pour **Nom**,Databricks saisissez.
  6. Dans le tab Général, dans la liste Fichiers Driver , cliquez sur le bouton + ( Ajouter ).
  7. Cliquez sur JARs personnalisés .
  8. Recherchez et sélectionnez le fichier DatabricksJDBC42.jar que vous avez extrait précédemment, puis cliquez sur Ouvrir .
  9. Pour la **Classe**, com.databricks.client.jdbc.Driversélectionnez.
  10. Cliquez sur **OK**.

Étape 3 : connecter DataGrip à vos bases de données Databricks

  1. Dans DataGrip, cliquez sur Fichier > Sources de données .

  2. Dans l'onglet Sources de données , cliquez sur le bouton + ( Ajouter ).

  3. Sélectionnez le **driver Databricks** que vous avez ajouté à l'étape précédente.

  4. Sous l'onglet Général , pour URL , saisissez la valeur du champ URL JDBC pour votre ressource Databricks. Pour la syntaxe du champ URL JDBC , consultez Paramètres d'authentification pour le Driver JDBC Databricks (Simba).

remarque

Le ConnCatalog paramètre de capacité du Driver doit être spécifié dans l'URL JDBC, sinon les schémas ne peuvent pas être identifiés.

  1. Cliquez sur Test de la connexion .
astuce

Vous devriez start votre ressource avant de tester votre connexion. Dans le cas contraire, le test pourrait prendre plusieurs minutes pour se terminer pendant que la ressource start.

  1. Si la connexion réussit, dans l'onglet **Schemas tab**, cochez les cases des schémas auxquels vous souhaitez accéder, par exemple **Tous les schémas**.

  2. Cliquez sur **OK**.

Répétez les instructions de cette étape pour chaque ressource à laquelle vous souhaitez que DataGrip accède.

Étape 4 : Utilisez DataGrip pour parcourir les tables

Utilisez DataGrip pour accéder aux tables de votre workspace Databricks.

  1. Dans DataGrip, dans la fenêtre **Base de données**, développez votre nœud de ressources, développez le schéma que vous souhaitez parcourir, puis développez **tables**.
  2. Double-cliquez sur une table. Le premier ensemble de lignes du tableau s'affiche.

Répétez les instructions de cette étape pour accéder à des tables supplémentaires.

Pour accéder aux tables dans d'autres schémas, dans la barre d'outils de la fenêtre Base de données , cliquez sur l'icône Propriétés de la source de données . Dans la boîte de dialogue **Sources de données et Drivers**, dans l'onglet **tab**, cochez la case pour chaque schéma supplémentaire auquel vous souhaitez accéder, puis cliquez sur **OK**.

Étape 5 : utiliser DataGrip pour exécuter des instructions SQL

Utilisez DataGrip pour charger la table d'exemple trips à partir du schéma nyctaxi du catalogue samples.

  1. Dans DataGrip, cliquez sur Fichier > Nouveau > Fichier SQL .

  2. Saisissez un nom pour le fichier, par exemple select_trips.

  3. Dans le select_trips.sql file tab, saisissez l'instruction SQL suivante :

    SQL
    SELECT * FROM samples.nyctaxi.trips;
  4. Sélectionnez l'SELECT instruction.

  5. Dans la barre d’outils de l’onglet du fichier, cliquez sur l’icône **Exécuter**.

Étapes suivantes

Ressources supplémentaires