Aller au contenu principal

Concepts du connecteur LinkedIn Ads

info

Bêta

Cette fonctionnalité est en version bêta. Les administrateurs de Workspace peuvent contrôler l’accès à cette fonctionnalité depuis la page Aperçus . Consultez Gérer les aperçus Databricks.

Découvrez comment fonctionne le connecteur géré LinkedIn Ads dans Lakeflow Connect.

Comment fonctionne le connecteur

Le connecteur LinkedIn Ads ingère les données de LinkedIn Ads dans Databricks en utilisant l'API LinkedIn Marketing, pin à la version d'API 202604. Le connecteur prend en charge deux types de tables :

  • Tables d’entités : ces tables contiennent des données de configuration sur vos comptes publicitaires, telles que les campagnes, les créations et les utilisateurs du compte. Les tables d’entités sont entièrement actualisées à chaque mise à jour du pipeline. Elles ne prennent pas en charge l’ingestion incrémentielle ni le suivi de l’historique (SCD de type 2).
  • Tables de rapport prédéfinies : ces tables contiennent des métriques de performance et démographiques, telles que les impressions, les clics et les dépenses. Les tables de rapport prennent en charge l'importation incrémentielle avec une fenêtre rétrospective configurable qui capture les révisions arrivant tardivement.

Pour obtenir une liste des tables prises en charge et de leurs schémas, consultez la référence du connecteur LinkedIn Ads.

Espaces de noms sources

Le connecteur expose les tables sources sous deux types d’espaces de noms. Lorsque vous définissez un objet pipeline, le source_schema que vous spécifiez détermine de quel espace de noms provient la table :

  • default: Contient la table unique à l’échelle de la source, account_history, qui couvre tous les comptes publicitaires accessibles par le jeton d’autorisation.
  • Espaces de noms par compte : un espace de noms pour chaque compte publicitaire sponsorisé, nommé d'après l'ID du compte publicitaire sponsorisé. Ce nom d'espace de noms est la valeur que vous définissez comme source_schema dans votre spécification de pipeline. Les quatre tables d'entités restantes et les sept tables de rapport se trouvent ici.

Comme onze des douze tables sont par compte, un pipeline qui intègre plus d’un compte publicitaire répète ces définitions de table une fois par compte, avec un source_schema différent à chaque fois.

Pour trouver un ID de compte publicitaire sponsorisé, ouvrez le compte dans LinkedIn Campaign Manager. L’ID numérique s’affiche sous le nom du compte et dans l’URL de la page, après /accounts/ (par exemple, https://www.linkedin.com/campaignmanager/accounts/512345678/).

Fenêtres d’ingestion et de rétrospection progressives

LinkedIn révise les métriques d’une journée en place au fur et à mesure que les conversions tardives et les mises à jour d’attribution arrivent, afin qu’une ligne déjà utilisée par le connecteur puisse changer par la suite. Pour capturer ces révisions, chaque mise à jour incrémentale relit une fenêtre de fin de dates déjà synchronisées au lieu de seulement en récupérer de nouvelles.

Lors de la première mise à jour, un rapport est lu depuis sa date de start jusqu'à hier. À chaque mise à jour ultérieure, chaque grain (un compte publicitaire ou une campagne, selon le rapport) reprend à partir de son dernier curseur validé moins lookback_window_days, avec pour valeur plancher la date de start du rapport. La fenêtre rétrospective default est de 7 jours, et vous pouvez définir n'importe quelle valeur de 0 à 365. Définissez-la au moins sur la durée de la fenêtre d'attribution des conversions de votre organisation afin que les conversions tardives soient intégrées dans vos tables.

L’avancement est suivi par grain plutôt que par tableau, ce qui signifie qu’une défaillance en cours de mise à jour conserve les grains déjà terminés au lieu de recommencer tout le rapport :

  • ad_analytics_by_campaign_report suit la progression par compte publicitaire.
  • Le rapport de création et les cinq rapports démographiques suivent la progression par campagne.

Comme la progression est définie par grain, la réduction de sync_start_date après la première mise à jour ne permet pas de remplir un rapport déjà synchronisé. Seuls les comptes ou les campagnes qui apparaissent pour la première fois start à partir de la nouvelle date. Pour réingérer l'historique antérieur, exécutez un refresh complet sur la table.

Familles de rapports

Les sept rapports prédéfinis se répartissent en deux familles aux formes différentes :

  • Les rapports de performance quotidiens produisent une ligne par entité pivot par jour. La colonne day contient une date ISO et la colonne d'entité est nommée d'après le pivot du rapport ; ainsi, le rapport de campagne est indexé par campaign_id et le rapport de création par creative_id.
  • Les rapports mensuels sur la démographie des membres produisent une ligne par campagne par valeur démographique et par mois. Les réponses démographiques de LinkedIn ne diffusent pas la campagne, donc les attributs du connecteur campaign_id de la campagne interrogée.

Les rapports mensuels ne peuvent pas être restreints à une période inférieure à un mois civil. LinkedIn ne renvoie aucune ligne pour une plage inférieure au mois à une granularité mensuelle ; ainsi, un sync_start_date qui tombe au milieu du mois est réaligné sur le premier jour de ce mois, et la ligne renvoyée pour ce mois est un agrégat sur le mois complet.

Horizons de conservation des données

LinkedIn limite la profondeur historique de lecture pour chaque famille de rapports. Il s'agit des limites de LinkedIn, et non de celles du connecteur :

  • Les données de performance quotidiennes sont conservées pendant 10 ans.
  • Les données démographiques professionnelles sont conservées pendant 2 ans.

Un sync_start_date plus ancien que l’horizon applicable au rapport échoue à la lecture, car les données antérieures ne peuvent pas être récupérées depuis l’API. Le message d’erreur indique la date la plus ancienne que vous pouvez utiliser.

Fuseau horaire

Le connecteur évalue toutes les limites de date des rapports en UTC plutôt que dans le fuseau horaire du compte publicitaire, et vous ne pouvez pas remplacer ce paramètre. Si votre compte publicitaire génère des rapports dans un fuseau horaire autre qu'UTC, attendez-vous à ce que les totaux quotidiens diffèrent de ce que l'interface utilisateur de LinkedIn Campaign Manager affiche pour le même jour civil.