Limitations du connecteur Google Search Console
info
Bêta
Cette fonctionnalité est en version bêta. Les administrateurs de Workspace peuvent contrôler l’accès à cette fonctionnalité depuis la page Aperçus . Consultez Gérer les aperçus Databricks.
Cette page contient des informations sur les limitations connues du connecteur géré Google Search Console dans Lakeflow Connect.
Limitations générales des connecteurs SaaS (outil/solution/technologie/plateforme as a Service)
Les limitations de cette section s'appliquent à tous les connecteurs SaaS dans LakeFlow Connect.
- Lorsque vous exécutez un pipeline planifié, les alertes ne se trigger pas immédiatement. Au lieu de cela, elles se Trigger lors de la prochaine exécution de la mise à jour.
- Lorsqu'une table source est supprimée, la table de destination n'est pas automatiquement supprimée. Vous devez supprimer manuellement la table de destination. Ce comportement n'est pas cohérent avec le comportement des Spark Declarative Pipelines sur Lakeflow.
- Pendant les périodes de maintenance de la source, Databricks pourrait ne pas être en mesure d’accéder à vos données.
- Si un nom de table source est en conflit avec un nom de table de destination existant, la mise à jour du pipeline échoue.
- La prise en charge des pipelines multi-destinations est disponible uniquement via API.
- Vous pouvez éventuellement renommer une table que vous ingérez. Si vous renommez une table dans votre pipeline, celui-ci devient un pipeline accessible uniquement via l'API et vous ne pouvez plus le modifier dans l'interface utilisateur.
- Si vous sélectionnez une colonne après le start d'un pipeline, le connecteur ne remplit pas automatiquement les données pour la nouvelle colonne. Pour ingérer des données historiques, exécutez manuellement un refresh complet sur la table.
- Databricks ne peut pas ingérer deux tables ou plus portant le même nom dans le même pipeline, même si elles proviennent de schémas sources différents.
- Le système source suppose que les colonnes de curseur augmentent de façon monotone.
- Le connecteur ingère des données brutes sans transformations. Utilisez des Spark Declarative Pipelines en aval sur les LakeFlow Pipelines pour les Transformations.
Limitations spécifiques au connecteur
Les limitations de cette section s'appliquent au connecteur Google Search Console.
- Les tables
sitesetsitemapsne prennent pas en charge l'ingestion incrémentielle. Le connecteur effectue un refresh complet à chaque mise à jour du pipeline. - Les données d'analytique de recherche de Google Search Console présentent un délai approximatif de deux à quatre jours. Les données relatives aux dates récentes peuvent ne pas apparaître lors de la première synchronisation après la création du pipeline.
- L’option de connecteur
data_states’applique uniquement aux tables d’analytique de recherche quotidiennes. Les tables horaires utilisent toujours l’état de donnéeshourly_all. - Les données analytiques de recherche horaires ne sont disponibles que pour les propriétés utilisant les types de recherche
webetgoogleNews. Les types de recherchenews,imageetvideone sont pas pris en charge pour les tables horaires. - Le connecteur ingère jusqu’à 500 jours de données historiques lors de la première synchronisation, mesurés à partir de la date d’exécution de la première mise à jour du pipeline. Utilisez l’option de connecteur
start_datepour limiter la fenêtre rétrospective initiale.