Connexions au Unity Catalog
Une connexion est un objet sécurisable dans Unity Catalog qui stocke l’endpoint et les identifiants nécessaires pour accéder à un système externe. Une connexion comprend :
- L'endpoint ou l'URL du système externe
- Identifiants d'authentification
- Paramètres de configuration
- Propriétaire et métadonnées
Les connexions ne sont pas les mêmes que les identifiants de stockage (pour le stockage d'objets cloud) ou les identifiants de service (pour les services cloud autres que le stockage). Pour plus d'informations, consultez Qu'est-ce que Unity Catalog ? et Connexion.
Types de connexion
Databricks prend en charge plusieurs types de connexion, chacun étant conçu pour un modèle d'intégration différent. Le type que vous créez détermine la manière dont la connexion est consommée et la gouvernance qu'elle offre.
Connexions d'ingestion gérées
Les connexions d’ingestion managées alimentent les pipelines Lakeflow Connect pour une ingestion entièrement managée et serverless à partir de sources externes vers les tables Delta.
Voir Se connecter aux sources d'ingestion gérées et Connecteurs gérés dans Lakeflow Connect.
Connexions de fédération de query
Les connexions de fédération de query permettent des query en lecture seule sur des bases de données externes sans déplacer les données. Ils utilisent des catalogues étrangers qui reflètent la structure de la base de données externe. Les queries sont poussées vers la base de données externe à l'aide de JDBC.
Voir Qu'est-ce que la fédération de query ?.
Connexions de fédération de catalogues
Les connexions de fédération de catalogues connectent des catalogues externes (un Hive metastore, AWS Glue ou un catalogue Snowflake Horizon) à Databricks. Unity Catalog explore les métadonnées du catalogue externe et remplit automatiquement un catalogue étranger, afin que vous puissiez query les données directement dans le stockage de fichiers source.
Voir Qu'est-ce que la fédération de catalogue ?.
Connexions JDBC
Les connexions JDBC permettent un accès en lecture et en écriture aux bases de données externes en utilisant les JAR des Driver JDBC avec l'API Spark Data Source ou l'API Remote Query SQL.
Consultez la connexion JDBC.
Connexions HTTP
Les connexions HTTP permettent la communication avec des services HTTP externes via un proxy géré par Databricks. Ils alimentent les APIs REST externes, les intégrations MCP et les outils d'agent IA.
Consultez Connecter aux services HTTP externes et Connecter des agents à des outils tiers avec les services MCP.
Choisissez un type de connexion
Le tableau suivant compare les types de connexion pour vous aider à choisir le bon pour votre cas d'utilisation.
Type | Cas d'usage | Lire l'article | Écriture | Niveau de gouvernance |
|---|---|---|---|---|
Ingérez les données des applications SaaS ou des bases de données dans les tables Delta. | Ingestions vers Delta | N/A | Niveau de connexion | |
Interroger une base de données externe sur place sans copier de données | Oui | Non | Au niveau des tables | |
Connecter des catalogues externes pour interroger des données directement dans le stockage de fichiers source | Oui | Non | Au niveau des tables | |
Lisez et écrivez dans une base de données externe avec un Driver JDBC spécifique. | Oui | Oui | Niveau de connexion | |
Connectez-vous aux APIs HTTP externes, aux serveurs MCP ou aux outils d'agent | N/A | N/A | Niveau de connexion |
Créer une connexion
Vous pouvez créer des connexions à l'aide de SQL, de l'interface utilisateur de l'Explorateur de catalogues ( Catalogue > Créer > Créer une connexion ), ou de l'API REST et de la CLI Databricks.
L'instruction SQL CREATE CONNECTION prend en charge les valeurs de TYPE suivantes : DATABRICKS, HTTP, MYSQL, POSTGRESQL, REDSHIFT, SNOWFLAKE, SQLDW, SQLSERVER. Les types d'ingestion SaaS (tels que Salesforce, HubSpot et Jira) peuvent être créés uniquement à l'aide de l'interface utilisateur ou des APIs.
Consultez CREATE CONNECTION dans la référence SQL.
Connexions et politiques de réseau
La sécurité de la connectivité sortante fonctionne dans les couches suivantes :
- Les connexions Unity Catalog régissent les identifiants et la configuration des connexions (URL, hôte, port, options). Ils offrent un moyen sécurisé et régi de stocker et de partager les détails d'authentification et les paramètres de connexion pour les systèmes externes sans intégrer les secrets dans le code.
- Les **politiques de réseau** régissent l'accès réseau. Ils contrôlent à la fois la connectivité sortante du compute Databricks vers les endpoints externes et la connectivité entrante des sources externes vers votre workspace. Les connexions Unity Catalog n'appliquent pas de restrictions réseau. Pour gérer le trafic autorisé dans l'une ou l'autre direction, configurez les règles réseau.