Aller au contenu principal

FAQ du connecteur d’ingestion Reddit Ads

info

Bêta

Cette fonctionnalité est en Bêta. Les administrateurs du Workspace peuvent contrôler l'accès à cette fonctionnalité à partir de la page Previews . Consultez Gérer les aperçus Databricks.

Cette page répond aux questions fréquemment posées sur le connecteur d'ingestion Reddit Ads dans Databricks Lakeflow Connect.

FAQ générale sur les connecteurs gérés

Les réponses dans les FAQ sur les connecteurs gérés s'appliquent à tous les connecteurs gérés dans Lakeflow Connect. Continuez à lire pour les FAQ spécifiques à Reddit Ads.

Comment Databricks se connecte-t-il à Reddit Ads ?

Databricks se connecte à l'API Reddit Ads en utilisant l'authentification OAuth 2.0 d'utilisateur à machine (U2M) avec PKCE. La portée adsread est définie automatiquement par Databricks. Les identifiants de connexion sont stockés en toute sécurité dans Unity Catalog et ne peuvent être récupérés que si l'utilisateur exécutant le flux d'ingestion dispose des autorisations appropriées.

Quels types de tables le connecteur peut-il ingérer ?

Le connecteur prend en charge deux types de tables :

  • Tables d'entités (ad_account, campaign, ad_group, ad) : données de configuration de votre compte. Les tables d'entités sont entièrement actualisées à chaque exécution de pipeline et ne prennent pas en charge le suivi de l'historique (SCD de type 2).
  • Tables de rapport : Métriques de performance telles que les impressions, les clics et les dépenses. Les tables de rapport prennent en charge l'ingestion incrémentielle avec une fenêtre de rétrospection configurable.

Pour la liste complète des tables prises en charge et de leurs schémas, consultez la référence du connecteur Reddit Ads.

Comment le connecteur extrait-il les mises à jour de manière incrémentielle ?

Les tables de rapports utilisent l'ingestion incrémentielle. Étant donné que les métriques Reddit Ads peuvent changer après leur première déclaration (par exemple, lorsque les conversions ou l'attribution sont recalculées), le connecteur relit les données des jours les plus récents à chaque synchronisation. By default, il relit les 30 derniers jours. Vous pouvez modifier cela avec le paramètre lookback_window_days (n'importe quelle valeur de 1 à 30). Les tables d'entité sont entièrement actualisées à chaque exécution.

Comment puis-je définir la fenêtre rétrospective pour qu'elle corresponde à ma fenêtre d'attribution ?

Définissez lookback_window_days pour correspondre à la fenêtre d'attribution de conversion de votre organisation. Par exemple, si votre organisation utilise une fenêtre d'attribution de 14 jours, définissez lookback_window_days: 14. Consultez Fenêtres d'attribution et de rétrospection.

Combien de données historiques le connecteur ingère-t-il ?

Par default, le connecteur ingère deux ans de données historiques pour les tables de rapports. Vous pouvez configurer cela avec le paramètre sync_start_date (une date au format YYYY-MM-DD). Ce paramètre s'applique uniquement à la première exécution — après le premier point de contrôle, le modifier n'a aucun effet sans une refresh complète.

Pourquoi les données de mon rapport ne contiennent-elles pas les dates antérieures ?

L'API de création de rapports Reddit Ads fournit des données de rapport sur environ les 24 derniers mois. Indépendamment de sync_start_date, les tables de rapport ne peuvent pas récupérer les données antérieures à cette fenêtre — les demandes de données plus anciennes sont rejetées par Reddit. Cette limite s'applique uniquement aux tables de rapport, et non aux tables d'entité. Consultez la conservation des données de rapport.

Comment puis-je définir un rapport personnalisé ?

Définissez source_table sur custom_report, indiquez un nom destination_table et spécifiez la configuration du rapport sous connector_options.reddit_ads_options.custom_report_options. La liste breakdowns doit inclure au moins une dimension temporelle (DATE ou HOUR), qui devient le curseur incrémentiel de la table. Les répartitions et les valeurs de champ doivent provenir des listes prises en charge. Voir Répartitions et champs de rapport personnalisés.

Dans quel fuseau horaire les dates des rapports sont-elles ?

Les limites de date du rapport sont interprétées dans le fuseau horaire du compte publicitaire lui-même. Le connecteur lit cela automatiquement à partir du compte. Vous ne définissez pas de fuseau horaire dans la spécification de pipeline.

Dans quelle devise les colonnes monétaires sont-elles ?

Les colonnes monétaires (par exemple, spend, cpc, bid_value) sont stockées dans la devise du compte publicitaire sous forme de montants décimaux (par exemple, 12.34), et non en micros. Le code de devise du compte est disponible dans la colonne ad_account.currency et dans la colonne currency du rapport.

Un seul pipeline peut-il importer des données de plusieurs comptes publicitaires ?

Oui. Un pipeline peut ingérer des données provenant de plusieurs schémas de compte publicitaire, et chaque entrée source_schema dans un pipeline correspond à un compte publicitaire. Voir les schémas sources.

Le connecteur détecte-t-il les suppressions ?

Les tables d'entités sont entièrement refresh à chaque exécution, de sorte que leur état actuel reflète toujours la source. Les tables de rapports utilisent l'ingestion incrémentielle dans la fenêtre de rétention. Pour resynchroniser entièrement une table, effectuez un refresh complet.