FAQ du connecteur Microsoft SharePoint
Bêta
Cette fonctionnalité est en Bêta. Les administrateurs du Workspace peuvent contrôler l'accès à cette fonctionnalité à partir de la page Previews . Consultez Gérer les aperçus Databricks.
Cette page répond aux questions fréquentes sur le connecteur Microsoft SharePoint dans Databricks Lakeflow Connect.
FAQ générales sur les connecteurs gérés
Les réponses dans les FAQ sur les connecteurs gérés s'appliquent à tous les connecteurs gérés dans Lakeflow Connect. Continuez à lire pour les FAQ spécifiques au connecteur.
Comment le connecteur gère-t-il les mises à jour dans SharePoint ?
Lors des exécutions ultérieures du pipeline, le connecteur ne réingère que les fichiers qui ont été mis à jour depuis la dernière exécution. Il ne met pas à jour de manière incrémentielle au sein de ces fichiers (par exemple, seules les données Excel qui ont changé dans un fichier spécifique).
Quelles APIs le connecteur utilise-t-il ?
Le connecteur utilise l'API Microsoft Graph.
Le jeton de refresh expire-t-il ?
Oui. Par default, le token refresh expire après 90 jours. Ceci est valable pour toutes les méthodes d'authentification prises en charge.
L'authentification M2M est-elle prise en charge ?
Oui. Le connecteur prend en charge l'accès délégué (U2M OAuth) et l'accès réservé aux applications (M2M OAuth). Pour obtenir les instructions de configuration, consultez Configure OAuth M2M for SharePoint ingestion.
Quels modes de stockage sont pris en charge ?
L'ingestion non structurée (BINARYFILE) prend en charge le mode de stockage SCD_TYPE_1. L'ingestion structurée (CSV, JSON, XML, EXCEL et d'autres formats) prend en charge le mode de stockage APPEND_ONLY. Le SCD de type 2 n'est pas pris en charge actuellement.
Étant donné que SCD_TYPE_1 et APPEND_ONLY sont les options default pour leurs types de format respectifs et également les seules options actuellement prises en charge, la définition explicite de storage_mode dans table_configuration est facultative.
Quels formats de fichier sont pris en charge ?
Le connecteur prend en charge l'ingestion de fichiers non structurés et structurés :
-
Non structuré :
BINARYFILE- Les fichiers sont ingérés sous forme de lignes avec une colonne
contentet des colonnes de métadonnées. À utiliser pour les fichiers PDF, les images, les fichiers Office et les autres fichiers que vous souhaitez traiter en aval.
- Les fichiers sont ingérés sous forme de lignes avec une colonne
-
Structuré :
CSV,JSON,XML,EXCEL,PARQUET,AVRO,ORC- Les fichiers sont analysés et chaque ligne du fichier devient une ligne dans la table de destination.