Aller au contenu principal

FAQ du connecteur Google Search Console

info

Bêta

Cette fonctionnalité est en version bêta. Les administrateurs de Workspace peuvent contrôler l’accès à cette fonctionnalité depuis la page Aperçus . Consultez Gérer les aperçus Databricks.

Cette page répond aux questions fréquemment posées sur le connecteur d’ingestion géré Google Search Console dans Lakeflow Connect. Pour les FAQ qui s’appliquent à tous les connecteurs gérés, consultez FAQ sur les connecteurs gérés.

Quelles tables le connecteur prend-il en charge ?

Le connecteur prend en charge 14 tables sources : sites, sitemaps, search_analytics_all_fields, search_analytics_by_country, search_analytics_by_date, search_analytics_by_device, search_analytics_by_page, search_analytics_by_query, search_analytics_page_report, search_analytics_site_report_by_page, search_analytics_site_report_by_site, hourly_search_analytics_page_report, hourly_search_analytics_site_report_by_page et hourly_search_analytics_site_report_by_site.

Pour plus de détails sur le schéma, consultez Schémas de table de destination.

Jusqu’à quelle période le connecteur peut-il ingérer des données ?

Pour les tables incrémentielles, la première synchronisation ingère les enregistrements des 500 derniers jours, et chaque synchronisation ultérieure ingère les enregistrements postérieurs à la dernière exécution. Les tables sites et sitemaps réingèrent tous les enregistrements disponibles à chaque exécution.

Pour limiter la fenêtre rétrospective initiale, définissez l'option de connecteur start_date dans la définition de votre pipeline. Voir Options du connecteur.

Quelles méthodes d’authentification le connecteur prend-il en charge ?

Le connecteur prend en charge l’authentification OAuth 2.0 utilisateur à machine (U2M) et compte de service (OAuth 2.0 machine à machine, ou M2M). L’authentification de base (nom d’utilisateur/mot de passe ou clé API) n’est pas prise en charge.

Utilisez l'authentification par Service Account pour les pipelines automatisés et sans surveillance, ou pour les environnements Google Workspace qui utilisent la délégation à l'échelle du domaine pour usurper l'identité d'un utilisateur spécifique. Utilisez OAuth U2M pour vous authentifier de manière interactive en tant que votre propre identité Google.

Pour obtenir les instructions de configuration, consultez Configurer l’authentification à Google Search Console.

Le connecteur peut-il ingérer des données provenant de plusieurs URL de site dans un seul pipeline ?

Oui. Spécifiez plusieurs valeurs dans l’option de connecteur site_urls. Le connecteur crée une partition pour chaque URL de site et ingère toutes les tables pour chaque propriété. Toutes les tables de destination incluent une colonne site_url pour identifier la propriété source.

Quels types de recherche le connecteur ingère-t-il ?

Les types de recherche ingérés dépendent de la table :

  • Tables search_analytics_all_fields et search_analytics_by_query quotidiennes : web, news, image, video.
  • Tables quotidiennes search_analytics_by_country, search_analytics_by_date, search_analytics_by_page et search_analytics_site_report_by_site : web, news, image, video, discover, googleNews.
  • Tables quotidiennes search_analytics_by_device, search_analytics_page_report et search_analytics_site_report_by_page : web, news, image, video, googleNews.
  • Tables horaires : les données sont disponibles uniquement pour les types de recherche web et googleNews.

Pourquoi le connecteur n'ingère-t-il pas les données pour les dates récentes ?

Les données d'analytique de recherche Google Search Console présentent un délai approximatif de deux à quatre jours. Les mesures de clics, d'impressions, de CTR et de position pour les dates récentes apparaissent dans l'API après ce délai. Le connecteur ingère les données dès qu'elles deviennent disponibles lors des exécutions ultérieures du pipeline.