Publier dans le service Power BI depuis Databricks
Publiez des données de Databricks vers le service Microsoft Power BI, une plateforme d'analytique métier basée sur le cloud qui permet aux utilisateurs de se connecter, de visualiser et d'analyser les données. Vous pouvez publier des tables et des schémas Databricks vers des modèles sémantiques Power BI directement depuis l'interface utilisateur Databricks, ou vous connecter manuellement à Databricks en tant que source de données depuis le service Power BI.
Lorsque vous intégrez Databricks en tant que source de données avec le service Power BI, vous offrez le traitement et les performances de données évolutifs de Databricks à tous les utilisateurs.
Si vous souhaitez connecter Power BI pour ordinateur de bureau à Databricks, consultez Connecter Power BI pour ordinateur de bureau à Databricks.
Le connecteur Databricks pour Power BI prend en charge le Driver Arrow Database Connectivity (ADBC). En savoir plus ici.
Exigences
-
Vos données doivent se trouver dans Unity Catalog, et votre compute doit être activé pour Unity Catalog. Hive metastore n'est pas pris en charge actuellement.
-
Vous devez disposer d’une licence Power BI Premium (capacité Premium, Premium par utilisateur (PPU) ou capacité Microsoft Fabric).
-
Vous devez activer la fonction **Lecture/écriture** pour l'**Endpoint XMLA** dans votre capacité Power BI. Veuillez suivre ce Link pour obtenir les instructions.
-
Si vous vous authentifiez à l’aide d’OAuth machine à machine (M2M), assurez-vous d’avoir configuré un Service Principal Databricks. Reportez-vous à Configurer les Service Principal sur Databricks pour Power BI.
-
Si les utilisateurs veulent modifier les modèles sémantiques dans le Service Power BI après publication, vous devez activer **Les utilisateurs peuvent modifier les modèles de données dans le service Power BI (preview)** dans les paramètres du workspace. Vous pouvez également modifier le Modèle Sémantique à l’aide de Tabular Editor en établissant une connexion via l’Endpoint XMLA.
-
Si votre workspace Power BI utilise un Link privé, vous devez mettre à jour les informations d'identification de la source de données du dataset manuellement dans Power BI.
-
Un Databricks SQL warehouse.
Publier les tables Databricks vers un modèle sémantique Power BI
Lorsque vous utilisez Databricks comme source de données avec le service Power BI, vous pouvez créer des modèles sémantiques Power BI à partir de tables ou de schémas directement depuis l'interface utilisateur de Databricks.
-
Connectez-vous à votre workspace Databricks et cliquez sur
Catalogue dans la barre latérale pour ouvrir l'Explorateur de catalogues.
-
Sélectionnez une ressource de compute SQL Warehouse dans la liste déroulante en haut à gauche, sous l'étiquette Catalogue .
-
Ouvrez un catalogue et sélectionnez le schéma ou les tables à publier. Ne sélectionnez pas à partir d'un Hive metastore ou du catalogue d'exemples.
-
En haut à droite, cliquez sur **Utiliser avec les outils BI** pour un schéma ou sur **Ouvrir dans un tableau de bord** pour une table.
-
Sélectionnez **Publier sur un workspace Power BI**.
-
Dans la boîte de dialogue Connecter à des Partenaires , cliquez sur Se connecter à Microsoft Entra ID pour vous authentifier.
-
Databricks exige que les autorisations suivantes soient accordées à l'application Entra ID enregistrée, **Intégration de publication de dataset Databricks** :
-
Content.Create -
Dataset.ReadWrite.All -
Workspace.Read.All

Pour plus d’informations, consultez Autorisations Microsoft Entra.
-
-
Si vous ne pouvez pas accepter ces autorisations, votre organisation pourrait exiger l'approbation de l'administrateur Entra pour ces autorisations. Consultez Examiner les demandes de consentement de l'administrateur pour obtenir des instructions.
-
S’il y a un message « Nécessite l’approbation de l’administrateur », votre administrateur général Power BI devra peut-être activer les demandes de consentement de l’administrateur avant de pouvoir continuer. Consultez Octroyer les autorisations lorsque le consentement de l’administrateur est désactivé.
-
-
Dans le champ **Workspace Power BI**, sélectionnez le Workspace Power BI.
-
En dataset Mode , sélectionnez DirectQuery ou Import.
-
Dans **Méthode d’authentification dans Power BI**, sélectionnez **OAuth** ou **PAT (jeton d’accès personnel)**.
Databricks recommande d'utiliser OAuth, car il permet un contrôle d'accès précis et un audit au niveau de l'utilisateur. Les identifiants OAuth pourraient devoir être configurés sur la page des paramètres du modèle sémantique Power BI sous Identifiants de la source de données . Si vous sélectionnez Jeton d'accès personnel (PAT), un PAT est créé en votre nom pour permettre à Power BI d'accéder au modèle sémantique.
Les jetons d'actualisation à usage unique sont activés par default pour l'OAuth utilisateur à machine (U2M). Pour configurer ces paramètres, consultez Jetons refresh à usage unique.
Si vous souhaitez vous authentifier à l'aide d'OAuth M2M, vous pouvez le configurer sur le service Power BI après la publication. Consultez Configurer OAuth M2M.
-
Dans **Nom du dataset**, sélectionnez **Publier en tant que nouveau dataset** ou **Utiliser un dataset existant**.
Lorsque vous choisissez Utiliser un dataset existant , les éléments suivants sont vrais :
- Si le modèle sémantique existe, il n'est pas remplacé. Les mises à jour ajoutent uniquement de nouveaux enregistrements dans un schéma donné.
- Si la table sélectionnée ne fait pas partie du modèle sémantique existant, elle est ajoutée.
- Si la table figurait déjà dans votre modèle sémantique et que de nouvelles colonnes ont été ajoutées après la dernière mise à jour, ces colonnes sont ajoutées automatiquement.
- Vous pouvez choisir un modèle de stockage différent pour la nouvelle table afin de créer un modèle sémantique composite.
Si vous disposez d'un modèle sémantique existant que vous souhaitez mettre à jour tout en conservant les connexions de données existantes, choisissez Utiliser un dataset existant . Si vous souhaitez en créer un nouveau avec un nouveau modèle sémantique, choisissez Publier en tant que nouveau dataset .
- Si le modèle sémantique existe, il n'est pas remplacé. Les mises à jour ajoutent uniquement de nouveaux enregistrements dans un schéma donné.
-
Cliquez sur Publier vers Power BI .
-
La publication du modèle sémantique peut prendre de 10 à 20 secondes. Lorsque la publication est terminée, cliquez sur Ouvrir Power BI pour ouvrir votre modèle sémantique Power BI dans un nouveau tab.
Connecter manuellement à Databricks comme source de données
Au lieu d'utiliser l'interface utilisateur de Databricks pour publier sur un modèle sémantique Power BI, vous pouvez vous connecter manuellement à Databricks en tant que source de données à partir du service Power BI.
-
Dans la barre latérale du service Power BI, cliquez sur **Créer**.
-
Cliquez sur **Obtenir des données**.
-
Recherchez et sélectionnez la vignette « Databricks ».
-
Saisissez le **Hostname du serveur** de votre warehouse Databricks SQL et le **chemin HTTP**.
-
Spécifiez, en option, les configurations des **options avancées**.
-
Veillez à définir un Nom de connexion unique.
-
Choisissez votre type d'authentification :
- Informations d’identification client Databricks : authentifiez-vous avec un Service Principal Databricks (OAuth de machine à machine). Saisissez l’ID client et le secret client du Service Principal. Consultez Configurer les Service Principals sur Databricks pour Power BI.
- Jeton d'accès personnel : Saisissez votre jeton d'accès personnel Databricks.
- **OAuth (OIDC)** : Cliquez sur **Se connecter** et terminez le processus d'authentification.
- **Service Principal** : Authentifiez-vous avec un Service Principal Microsoft Entra ID. Saisissez les identifiants du Service Principal.
-
Sélectionnez un **niveau de confidentialité**.
-
Choisissez si cette connexion peut être utilisée avec des passerelles de données on-premise et des passerelles de données VNet.
-
Cliquez sur **Suivant** pour créer votre connexion.
-
Sélectionnez les tables à importer dans vos rapports Power BI.
Fonctionnalités et notes
-
Lors de la publication d'un schéma contenant plusieurs tables, toutes les tables avec des colonnes sont publiées. Les tables sans colonnes ne sont pas publiées.
-
Les commentaires sur les colonnes d’une table dans Databricks sont copiés dans les descriptions des colonnes correspondantes dans Power BI.
-
Les relations de clé étrangère sont conservées dans le dataset publié. Cependant, Power BI ne prend en charge qu'un seul chemin de relation actif entre deux tables quelconques. Lorsque plusieurs chemins sont présents dans le schéma de Databricks, certaines des relations correspondantes dans Power BI sont définies comme inactives. Vous pourrez modifier ultérieurement les relations actives ou inactives dans la vue du modèle de données dans Power BI.
-
Lors de l'utilisation d'OAuth ou d'une passerelle de données on-premise, les identifiants devront peut-être être configurés dans « Identifiants de la source de données » sur la page des paramètres du dataset Power BI.
-
Actuellement, les utilisateurs peuvent uniquement publier directement dans les Workspace Power BI de leur tenant d'origine. La publication dans les tenants où ils sont des utilisateurs invités n'est pas prise en charge.
Accorder les autorisations lorsque le consentement de l'Admin est désactivé
Lorsque le consentement de l'administrateur est désactivé, les utilisateurs ne peuvent pas demander l'approbation des applications nécessitant des autorisations. Cela peut se produire si le consentement de l'utilisateur est bloqué ou limité aux éditeurs vérifiés dans le centre d'administration Microsoft Entra, et que les demandes de consentement de l'administrateur ne sont pas autorisées.
Pour permettre aux utilisateurs de demander l'autorisation de publier vers le service Power BI, vous devez être un *administrateur global* ou un *administrateur d'applications cloud* pour activer et approuver les demandes de consentement.
Étape 1 : Activer les demandes de consentement de l'administrateur
Un administrateur général ou un administrateur d'application cloud doit d'abord activer les demandes de consentement de l'administrateur :
- Dans le centre d'administration Microsoft Entra, accédez à Consentement et autorisations .
- Cliquez sur **Paramètres de consentement de l'administrateur** depuis la barre latérale.
- Basculez Demandes de consentement de l'administrateur sur Oui .
- (Facultatif) Pour désigner les réviseurs qui peuvent aider à évaluer les demandes de consentement, sélectionnez Ajouter des utilisateurs sous Réviseurs . Notez que si les réviseurs peuvent évaluer les demandes, seul un administrateur global peut accorder le consentement d’administrateur final.
- Configurez **Les demandes de consentement expirent après (jours)** pour définir la durée de validité des demandes de consentement avant leur expiration.
- Les utilisateurs peuvent désormais soumettre des demandes de consentement pour le service Power BI.
Étape 2 : Approuver la demande de consentement de l’utilisateur
Une fois qu’un utilisateur soumet une demande de consentement, un administrateur général ou un administrateur d’application cloud doit approuver la demande :
- Dans le centre d'administration Microsoft Entra, cliquez sur Demandes de consentement administrateur dans la barre latérale.
- Sélectionnez la demande d' Intégration de publication de jeux de données Databricks .
- Cliquez sur **Vérifier les autorisations et le consentement**.
- Connectez-vous avec votre Microsoft Entra ID et cliquez sur **Accepter**.
L'utilisateur qui demande l'accès à Power BI peut maintenant publier sur le service Power BI.
Configurez M2M OAuth.
Après avoir publié sur le service Power BI à partir de Databricks, vous pouvez configurer OAuth M2M sur le service Power BI. Assurez-vous d'avoir un Service Principal configuré sur Databricks. Consultez Configurer les Service Principal sur Databricks pour Power BI.
Vous pouvez configurer l'OAuth M2M à partir d'un modèle sémantique ou d'une passerelle de service.
Utiliser un modèle sémantique pour OAuth M2M
Configurez votre connexion Databricks pour l’OAuth M2M sur le service Power BI à l’aide d’un modèle sémantique. Pour en savoir plus sur les modèles sémantiques, consultez les modèles sémantiques dans le service Power BI.
Pour configurer les identifiants :
- Dans Power BI, accédez au workspace qui contient le modèle sémantique.
- Cliquez sur Plus d'options (menu kebab horizontal) > Paramètres .
- Accédez aux Identifiants de la source de données et cliquez sur Modifier les identifiants .
- Dans **Méthode d'authentification**, choisissez **De base**.
- Dans **Nom d'utilisateur**, saisissez l'ID d'application de votre Service Principal.
- Dans **Mot de passe**, entrez votre secret de service principal.
- Sélectionnez le paramètre de niveau de confidentialité approprié pour votre source de données.
- Si vous souhaitez activer la SSO, activez la dernière option.
- Cliquez sur Se connecter .
Utiliser une passerelle de service pour OAuth M2M
Vous pouvez configurer votre connexion Databricks pour M2M OAuth sur le service Power BI à partir d'un VNet Power BI ou d'une passerelle de données on-premise. Les identifiants client Databricks pour une passerelle on-premise nécessitent la passerelle Power BI v3000.270.10 ou supérieure. Pour en savoir plus sur les passerelles Power BI, consultez le site officiel de Microsoft.
Power BI ne prend pas entièrement en charge les passerelles de données VNet dans ses API REST. Par conséquent, vous devez mettre à jour manuellement les connexions aux sources de données pour utiliser les informations d'identification du client Databricks dans l'interface utilisateur.
Pour configurer les identifiants :
-
Dans Power BI, cliquez sur l'icône d'engrenage en haut à droite pour accéder aux paramètres.
-
Cliquez sur Gérer les connexions et les passerelles .
-
Cliquez sur **+ Nouveau** pour créer une nouvelle connexion.
-
Sélectionnez **on-premise** ou **Réseau virtuel**. Les identifiants requis sont les mêmes pour les deux passerelles.
-
Dans Nom du cluster de passerelle , sélectionnez la passerelle appropriée.
-
Dans Nom de la connexion , saisissez votre nom de connexion.
-
Dans Type de connexion , sélectionnez Azure Databricks .
-
Dans **Server Hostname**, saisissez le hostname du Databricks SQL warehouse.
-
Dans **Chemin HTTP**, saisissez le chemin HTTP du SQL Warehouse.
-
Sous Authentification , spécifiez vos identifiants d’authentification.
- Dans Méthode d’authentification , sélectionnez Informations d’identification client Databricks .
- Dans **l'ID client Databricks**, saisissez l'ID client de votre Service Principal.
- Dans **Databricks Client Secret**, saisissez le secret client du Service Principal.
-
Dans **Niveau de confidentialité**, sélectionnez **Organisationnel**.
-
Cliquez sur Créer .