Aller au contenu principal

Guide de l'utilisateur SAP Databricks

Les articles de ce guide d'utilisateur expliquent comment démarrer avec Unity Catalog, Databricks SQL, les Notebooks et le Machine Learning dans SAP Databricks.

Gouvernance des données avec Unity Catalog

Unity Catalog est une solution de gouvernance granulaire pour les données et l'IA sur la plateforme Databricks. Il contribue à simplifier la sécurité et la gouvernance de vos données et assets d'IA. Vous pouvez parcourir vos assets de données via l'Explorateur de catalogues, recevoir des partages OpenSharing et accéder aux données tierces via des emplacements externes.

Pour commencer, consultez Gouvernance des données avec Unity Catalog.

Business intelligence avec Databricks SQL

Dans SAP Databricks, les utilisateurs peuvent utiliser l'éditeur SQL pour se connecter aux SQL warehouses serverless configurés par les administrateurs afin d'exécuter efficacement des requêtes SQL sur les données de votre lakehouse. L'interface utilisateur SAP Databricks inclut un éditeur SQL que vous pouvez utiliser pour créer des requêtes, parcourir les données disponibles et créer des visualisations.

Pour en savoir plus, consultez Business Intelligence avec Databricks SQL.

Business Intelligence avec Power BI

Microsoft Power BI est un service d'analytique métier qui fournit des visualisations interactives. Connectez Power BI Desktop ou le service Power BI à vos Databricks SQL warehouse et configurez des méthodes d'authentification sécurisées pour les déploiements d'entreprise afin de créer des rapports et des tableaux de bord dans Power BI.

Pour start, consultez Power BI avec SAP Databricks.

Analyse des données avec des Notebooks

Les Notebooks sont un outil courant en Data Science et Machine Learning pour développer du code et présenter des résultats. Dans SAP Databricks, les Notebooks sont l'outil principal pour écrire du code, créer des workflows de Data Science et collaborer avec des collègues. Les Notebooks Databricks offrent une co-édition en temps réel dans plusieurs langues, une gestion automatique des versions et des visualisations de données intégrées.

Pour commencer, consultez Analyse des données avec des Notebooks.

Machine Learning

SAP Databricks fournit divers produits pour vous aider à implémenter vos flux de travail de bout en bout afin de créer et de déployer des systèmes d'IA et de ML. Les fonctionnalités de Databricks AI unifient le cycle de vie de l'IA, de la collecte et de la préparation des données au développement de modèles et au LLMOps, en passant par la mise à disposition et le monitoring. Avec SAP Databricks, une plateforme unique prend en charge chaque étape du développement et du déploiement de ML, des données brutes aux tables d'inférence qui sauvegardent chaque requête et réponse pour un modèle servi. Les data scientists, les data engineers, les ML engineers et le DevOps peuvent faire leur travail en utilisant le même ensemble d'outils et une source unique de vérité pour les données.

Pour commencer, consultez l'IA et le machine learning.

Compute serverless

Vous pouvez vous connecter rapidement au compute serverless pour exécuter vos requêtes et votre code. Avec le compute serverless, SAP Databricks alloue et gère automatiquement les ressources de compute nécessaires. Cela vous permet de vous concentrer sur l'écriture de code et l'analyse de données, sans vous soucier de la gestion du compute ou de l'utilisation des ressources.

Le compute Serverless offre les avantages suivants :

  • Les ressources cloud sont gérées par Databricks, ce qui réduit les frais généraux de gestion et fournit un compute instantané pour améliorer la productivité des utilisateurs.
  • Les temps de start-up et de scaling rapides pour les ressources de compute Serverless minimisent le temps d'inactivité et vous garantissent de ne payer que le compute que vous utilisez.
  • Étant donné que la gestion des capacités, la sécurité, l’application des correctifs et les mises à niveau sont gérées automatiquement, vous pouvez moins vous soucier de la fiabilité, des politiques de sécurité et des pénuries de capacité.

SAP Databricks propose actuellement les types suivants de compute serverless :

  • Compute serverless pour les notebooks: Compute évolutif à la demande utilisé pour exécuter du code SQL et Python dans les notebooks.
  • SQL Warehouse Serverless: compute élastique à la demande utilisé pour exécuter des commandes SQL sur des objets de données dans l'éditeur SQL ou les Notebooks interactifs.