FAQ du connecteur Google Search Console
Bêta
Cette fonctionnalité est en version bêta. Les administrateurs de Workspace peuvent contrôler l’accès à cette fonctionnalité depuis la page Aperçus . Consultez Gérer les aperçus Databricks.
Cette page répond aux questions fréquemment posées sur le connecteur d’ingestion géré Google Search Console dans Lakeflow Connect. Pour les FAQ qui s’appliquent à tous les connecteurs gérés, consultez FAQ sur les connecteurs gérés.
Quelles tables le connecteur prend-il en charge ?
Le connecteur prend en charge 14 tables sources : sites, sitemaps, search_analytics_all_fields, search_analytics_by_country, search_analytics_by_date, search_analytics_by_device, search_analytics_by_page, search_analytics_by_query, search_analytics_page_report, search_analytics_site_report_by_page, search_analytics_site_report_by_site, hourly_search_analytics_page_report, hourly_search_analytics_site_report_by_page et hourly_search_analytics_site_report_by_site.
Pour plus de détails sur le schéma, consultez Schémas de table de destination.
Jusqu’à quelle période le connecteur peut-il ingérer des données ?
Pour les tables incrémentielles, la première synchronisation ingère les enregistrements des 500 derniers jours, et chaque synchronisation ultérieure ingère les enregistrements postérieurs à la dernière exécution. Les tables sites et sitemaps réingèrent tous les enregistrements disponibles à chaque exécution.
Pour limiter la fenêtre rétrospective initiale, définissez l'option de connecteur start_date dans la définition de votre pipeline. Voir Options du connecteur.
Quelles méthodes d’authentification le connecteur prend-il en charge ?
Le connecteur prend en charge l’authentification OAuth 2.0 utilisateur à machine (U2M) et compte de service (OAuth 2.0 machine à machine, ou M2M). L’authentification de base (nom d’utilisateur/mot de passe ou clé API) n’est pas prise en charge.
Utilisez l'authentification par Service Account pour les pipelines automatisés et sans surveillance, ou pour les environnements Google Workspace qui utilisent la délégation à l'échelle du domaine pour usurper l'identité d'un utilisateur spécifique. Utilisez OAuth U2M pour vous authentifier de manière interactive en tant que votre propre identité Google.
Pour obtenir les instructions de configuration, consultez Configurer l’authentification à Google Search Console.
Le connecteur peut-il ingérer des données provenant de plusieurs URL de site dans un seul pipeline ?
Oui. Spécifiez plusieurs valeurs dans l’option de connecteur site_urls. Le connecteur crée une partition pour chaque URL de site et ingère toutes les tables pour chaque propriété. Toutes les tables de destination incluent une colonne site_url pour identifier la propriété source.
Quels types de recherche le connecteur ingère-t-il ?
Les types de recherche ingérés dépendent de la table :
- Tables
search_analytics_all_fieldsetsearch_analytics_by_queryquotidiennes :web,news,image,video. - Tables quotidiennes
search_analytics_by_country,search_analytics_by_date,search_analytics_by_pageetsearch_analytics_site_report_by_site:web,news,image,video,discover,googleNews. - Tables quotidiennes
search_analytics_by_device,search_analytics_page_reportetsearch_analytics_site_report_by_page:web,news,image,video,googleNews. - Tables horaires : les données sont disponibles uniquement pour les types de recherche
webetgoogleNews.
Pourquoi le connecteur n'ingère-t-il pas les données pour les dates récentes ?
Les données d'analytique de recherche Google Search Console présentent un délai approximatif de deux à quatre jours. Les mesures de clics, d'impressions, de CTR et de position pour les dates récentes apparaissent dans l'API après ce délai. Le connecteur ingère les données dès qu'elles deviennent disponibles lors des exécutions ultérieures du pipeline.