Pular para o conteúdo principal

Perguntas frequentes sobre o conector do Google Search Console

info

Beta

Esse recurso está em Beta. Os administradores do workspace podem controlar o acesso a esse recurso na página Pré-visualizações . Consulte Gerenciar prévias do Databricks.

Esta página responde a perguntas frequentes sobre o conector de ingestão gerenciado do Google Search Console no Lakeflow Connect. Para perguntas frequentes aplicáveis a todos os conectores gerenciados, consulte Perguntas frequentes sobre conectores gerenciados.

Quais tabelas o conector suporta?

O conector oferece suporte a 14 tabelas de origem: sites, sitemaps, search_analytics_all_fields, search_analytics_by_country, search_analytics_by_date, search_analytics_by_device, search_analytics_by_page, search_analytics_by_query, search_analytics_page_report, search_analytics_site_report_by_page, search_analytics_site_report_by_site, hourly_search_analytics_page_report, hourly_search_analytics_site_report_by_page e hourly_search_analytics_site_report_by_site.

Para detalhes completos do esquema, consulte Esquemas de tabela de destino.

Até que ponto o conector pode ingerir dados?

Para tabelas incrementais, a primeira sincronização ingere registros dos últimos 500 dias, e cada sincronização posterior ingere registros após a última execução. As tabelas sites e sitemaps reingerem todos os registros disponíveis a cada execução.

Para limitar a janela de retrospectiva inicial, defina a opção de conector start_date na definição do seu pipeline. Consulte Opções do conector.

Quais métodos de autenticação o conector suporta?

O conector oferece suporte à autenticação OAuth 2.0 user-to-machine (U2M) e Service Account (OAuth 2.0 machine-to-machine, ou M2M). A autenticação Basic (nome de usuário/senha ou key de API) não é suportada.

Use a autenticação de account de serviço para pipeline automatizados e autônomos ou para ambientes do Google Workspace que usam delegação em todo o domínio para representar um usuário específico. Use o OAuth U2M para autenticar-se como sua própria identidade Google de forma interativa.

Para obter instruções de configuração, consulte Configurar a autenticação no Google Search Console.

O conector pode ingerir dados de várias URLs de site em um único pipeline?

Sim. Especifique vários valores na opção de conector site_urls. O conector cria uma partição para cada URL de site e ingere todas as tabelas para cada propriedade. Todas as tabelas de destino incluem uma coluna site_url para identificar a propriedade de origem.

Quais tipos de pesquisa o conector ingere?

Os tipos de pesquisa ingeridos dependem da tabela:

  • Tabelas diárias search_analytics_all_fields e search_analytics_by_query: web, news, image, video.
  • Tabelas diárias search_analytics_by_country, search_analytics_by_date, search_analytics_by_page e search_analytics_site_report_by_site: web, news, image, video, discover, googleNews.
  • Tabelas diárias de search_analytics_by_device, search_analytics_page_report e search_analytics_site_report_by_page: web, news, image, video, googleNews.
  • Tabelas horárias: os dados só estão disponíveis para os tipos de busca web e googleNews.

Por que o conector não ingere dados de datas recentes?

Os dados do Search Analytics do Google Search Console têm um atraso aproximado de dois a quatro dias. As métricas de cliques, impressões, CTR e posição para datas recentes aparecem na API após esse atraso. O conector ingere dados à medida que ficam disponíveis em execuções subsequentes do pipeline.