Aller au contenu principal

Connecteur SharePoint

info

Bêta

Cette fonctionnalité est en Bêta. Les administrateurs du Workspace peuvent contrôler l'accès à cette fonctionnalité à partir de la page Previews . Consultez Gérer les aperçus Databricks.

Le connecteur SharePoint géré dans Lakeflow Connect vous permet d’ingérer des fichiers de SharePoint dans Databricks. Ingérez des fichiers non structurés en tant que données binaires, analysez les formats structurés (CSV, JSON, XML, EXCEL, et plus encore) dans des tables Delta, ou capturez les métadonnées des fichiers sans charger leur contenu.

Disponibilité des fonctionnalités

Fonctionnalité

Disponibilité

Conception de pipelines via l'interface utilisateur

Icône X rouge Non pris en charge

Création de pipeline par API

Icône de coche verte Pris en charge

Declarative Automation Bundles

Icône de coche verte Pris en charge

Ingestion incrémentielle

Icône de coche verte Pris en charge

Gouvernance Unity Catalog

Icône de coche verte Pris en charge

Orchestration à l'aide de Databricks Workflows

Icône de coche verte Pris en charge

SCD de type 2

Icône X rouge Non pris en charge

évolution des schémas

Icône de coche verte Pris en charge

Configurable via schema_evolution_mode. Consultez la référence du connecteur Microsoft SharePoint.

Sélection et désélection de colonnes via API

Icône X rouge Non pris en charge

Filtrage des lignes basé sur l'API

Icône X rouge Non pris en charge

Fonctionnalité

Disponibilité

Conception de pipelines via l'interface utilisateur

Icône X rouge Non pris en charge

Création de pipeline par API

Icône de coche verte Pris en charge

Declarative Automation Bundles

Icône de coche verte Pris en charge

Ingestion incrémentielle

Icône de coche verte Pris en charge

Gouvernance Unity Catalog

Icône de coche verte Pris en charge

Orchestration à l'aide de Databricks Workflows

Icône de coche verte Pris en charge

SCD de type 2

Icône X rouge Non pris en charge

évolution des schémas

Icône de coche verte Pris en charge

Configurable via schema_evolution_mode. Consultez la référence du connecteur Microsoft SharePoint.

Sélection et désélection de colonnes via API

Icône X rouge Non pris en charge

Filtrage des lignes basé sur l'API

Icône X rouge Non pris en charge

Méthodes d'authentification

Méthode d'authentification

Disponibilité

OAuth U2M

Icône de coche verte Pris en charge

OAuth M2M

Icône de coche verte Pris en charge

OAuth (jeton de refresh manuel)

Icône de coche verte Pris en charge

Authentification de base (nom d’utilisateur/mot de passe)

Icône X rouge Non pris en charge

Authentification de base (clé API)

Icône X rouge Non pris en charge

Authentification de base (clé JSON du compte de service)

Icône X rouge Non pris en charge

Méthode d'authentification

Disponibilité

OAuth U2M

Icône de coche verte Pris en charge

OAuth M2M

Icône de coche verte Pris en charge

OAuth (jeton de refresh manuel)

Icône de coche verte Pris en charge

Authentification de base (nom d’utilisateur/mot de passe)

Icône X rouge Non pris en charge

Authentification de base (clé API)

Icône X rouge Non pris en charge

Authentification de base (clé JSON du compte de service)

Icône X rouge Non pris en charge

Ce qu'il faut savoir avant de start

Sujet

Pourquoi c'est important

Profil d'utilisateur Databricks

Le workflow dépend de votre persona utilisateur Databricks :

  • Mono-utilisateur : un utilisateur administrateur crée une connexion Unity Catalog et un pipeline d'ingestion.
  • Multi-utilisateur : un utilisateur administrateur crée une connexion pour les utilisateurs non-administrateurs afin qu’ils puissent créer des pipelines.

Méthode d'authentification

Les étapes de création d’une connexion dépendent de la méthode d’authentification que vous choisissez.

Interface

Les étapes de création d'un pipeline dépendent de l'interface.

Fréquence d'ingestion

La planification du pipeline dépend de vos exigences en matière de latence et de coût.

Modèles courants

Selon vos besoins d'ingestion, le pipeline peut utiliser des configurations comme le suivi de l'historique, la sélection de colonnes et le filtrage de lignes. Les configurations prises en charge varient selon le connecteur. Voir Disponibilité des fonctionnalités.

Sujet

Pourquoi c'est important

Profil d'utilisateur Databricks

Le workflow dépend de votre persona utilisateur Databricks :

  • Mono-utilisateur : un utilisateur administrateur crée une connexion Unity Catalog et un pipeline d'ingestion.
  • Multi-utilisateur : un utilisateur administrateur crée une connexion pour les utilisateurs non-administrateurs afin qu’ils puissent créer des pipelines.

Méthode d'authentification

Les étapes de création d’une connexion dépendent de la méthode d’authentification que vous choisissez.

Interface

Les étapes de création d'un pipeline dépendent de l'interface.

Fréquence d'ingestion

La planification du pipeline dépend de vos exigences en matière de latence et de coût.

Modèles courants

Selon vos besoins d'ingestion, le pipeline peut utiliser des configurations comme le suivi de l'historique, la sélection de colonnes et le filtrage de lignes. Les configurations prises en charge varient selon le connecteur. Voir Disponibilité des fonctionnalités.

start ingesting from SharePoint

Le tableau suivant fournit une vue d'ensemble du flux d'ingestion SharePoint de bout en bout, en fonction du type d'utilisateur :

Utilisateur

Étapes

Admin

  1. Configurez l'authentification SharePoint. Consultez l'aperçu de la configuration de l'ingestion SharePoint.
  2. Utilisez Catalog Explorer pour créer une connexion à SharePoint afin que les non-administrateurs puissent créer des pipelines. Voir Créer une connexion SharePoint.

Non-administrateur

Utilisez toute interface prise en charge pour créer un pipeline à partir d'une connexion existante. Voir Ingérer des données depuis SharePoint.

Utilisateur

Étapes

Admin

  1. Configurez l'authentification SharePoint. Consultez l'aperçu de la configuration de l'ingestion SharePoint.
  2. Utilisez Catalog Explorer pour créer une connexion à SharePoint afin que les non-administrateurs puissent créer des pipelines. Voir Créer une connexion SharePoint.

Non-administrateur

Utilisez toute interface prise en charge pour créer un pipeline à partir d'une connexion existante. Voir Ingérer des données depuis SharePoint.