Aller au contenu principal

Vue d'ensemble de la configuration d'ingestion SharePoint

Découvrez les méthodes d'authentification prises en charge pour le connecteur SharePoint géré dans Lakeflow Connect. Le connecteur SharePoint géré prend en charge l'ingestion de fichiers non structurés (tels que les PDF et les DOCX) ainsi que de formats structurés (tels que CSV, JSON et Excel) dans les tables Delta. Pour les pipelines personnalisés utilisant les API Spark et SQL avec un contrôle total sur l'analyse et les transformations, consultez Ingérer des fichiers depuis SharePoint.

info

Bêta

Cette fonctionnalité est en Bêta. Les administrateurs du Workspace peuvent contrôler l'accès à cette fonctionnalité à partir de la page Previews . Consultez Gérer les aperçus Databricks.

Choisissez votre connecteur SharePoint

Lakeflow Connect propose deux connecteurs SharePoint. Ils accèdent tous deux aux données dans SharePoint, mais diffèrent par leur niveau de gestion.

Connecteur

Description

Connecteur SharePoint géré

Un connecteur entièrement managé. Connecteur simple et à faible maintenance pour les applications d'entreprise qui ingère des données dans les tables Delta et les maintient synchronisées avec la source.

Connecteur SharePoint standard

Créez des pipelines d'ingestion personnalisés avec SQL, PySpark ou des LakeFlow Pipelines utilisant des APIs batch et de streaming, tels que read_files, spark.read, COPY INTO et Auto Loader. Offre la flexibilité d'effectuer des transformations complexes pendant l'ingestion, tout en vous donnant une plus grande responsabilité dans la gestion et la maintenance de vos pipelines.

Connecteur

Description

Connecteur SharePoint géré

Un connecteur entièrement managé. Connecteur simple et à faible maintenance pour les applications d'entreprise qui ingère des données dans les tables Delta et les maintient synchronisées avec la source.

Connecteur SharePoint standard

Créez des pipelines d'ingestion personnalisés avec SQL, PySpark ou des LakeFlow Pipelines utilisant des APIs batch et de streaming, tels que read_files, spark.read, COPY INTO et Auto Loader. Offre la flexibilité d'effectuer des transformations complexes pendant l'ingestion, tout en vous donnant une plus grande responsabilité dans la gestion et la maintenance de vos pipelines.

astuce

Databricks recommande le connecteur SharePoint géré pour la plupart des cas d'usage.

Quelle méthode d'authentification dois-je choisir ?

Le connecteur SharePoint géré prend en charge les méthodes d'authentification suivantes :

  • OAuth U2M : géré par Databricks (Recommandé)

    • Databricks gère l’application OAuth et le refresh du jeton. Aucune inscription d’application Azure requise. Recommandé pour la plupart des utilisateurs.
  • OAuth U2M : géré par le client

    • Utilisez votre propre enregistrement d'application Azure . À utiliser lorsque votre organisation requiert un contrôle sur la propriété de l'application ou la limitation de débit de l'API.
  • OAuth M2M

    • Pour les pipelines de production entièrement automatisés qui s’exécutent sans interaction de l’utilisateur.
  • OAuth avec refresh manuelle des jetons

    • Une méthode héritée. Non recommandé pour les nouvelles implémentations.

Configurer OAuth U2M : géré par Databricks (recommandé)

Cette méthode ne nécessite aucun enregistrement d'application Azure. Databricks gère automatiquement la configuration OAuth et le refresh des jetons. Pour connaître toutes les étapes de configuration, consultez Configurer OAuth U2M : gestion par Databricks pour l'ingestion Microsoft SharePoint.