Limitations du connecteur Reddit Ads
Bêta
Cette fonctionnalité est en Bêta. Les administrateurs du Workspace peuvent contrôler l'accès à cette fonctionnalité à partir de la page Previews . Consultez Gérer les aperçus Databricks.
Découvrez les limites connues lors de l'utilisation du connecteur Reddit Ads géré dans Lakeflow Connect.
Limitations générales des connecteurs SaaS
- Lorsque vous exécutez un pipeline planifié, les alertes ne se Trigger pas immédiatement. Au lieu de cela, ils Trigger lors de l’exécution de la prochaine mise à jour.
- Lorsqu’une table source est supprimée, la table de destination n’est pas automatiquement supprimée. Vous devez supprimer la table de destination manuellement. Ce comportement n'est pas cohérent avec le comportement de Spark Declarative Pipelines sur Lakeflow.
- Pendant les périodes de maintenance de la source, Databricks pourrait ne pas être en mesure d'accéder à vos données.
- Si un nom de table source entre en conflit avec un nom de table de destination existant, la mise à jour du pipeline échoue.
- La prise en charge des pipelines multi-destination est uniquement via l'API.
- Vous pouvez éventuellement renommer une table que vous ingérez. Si vous renommez une table dans votre pipeline, il devient un pipeline API uniquement, et vous ne pouvez plus modifier le pipeline dans l'interface utilisateur.
- Si vous sélectionnez une colonne après qu'un pipeline a déjà start, le connecteur ne renseigne pas automatiquement les données historiques pour la nouvelle colonne. Pour ingérer des données historiques, exécutez manuellement un refresh complet sur la table.
- Databricks ne peut pas ingérer deux tables ou plus portant le même nom dans le même pipeline, même si elles proviennent de schémas sources différents.
- Le système source suppose que les colonnes du curseur augmentent de façon monotone.
- Le connecteur ingère des données brutes sans transformations. Utilisez les Spark Declarative Pipelines en aval sur les Lakeflow Pipelines pour les transformations.
Tables prises en charge
Le connecteur ne prend en charge que les tables d'entités et de rapports prédéfinies listées dans Reddit Ads connector reference, ainsi que les rapports personnalisés définis par l'utilisateur. L'ensemble des tables d'entités et de rapports est fixe.
Ingestion incrémentielle
- Les tables d'entités (
ad_account,campaign,ad_group,ad) sont entièrement refresh à chaque mise à jour du pipeline. Seules les tables de rapport prennent en charge l'ingestion incrémentielle. - Les tables d'entités ne prennent pas en charge le suivi de l'historique (SCD de type 2). Seul l'état actuel de chaque entité est stocké.
Rétention des données de rapport
L'API de reporting Reddit Ads ne fournit des données de rapport que sur les 24 derniers mois environ. Quel que soit le sync_start_date parameter, les tables de rapport ne peuvent pas récupérer de données plus anciennes que cette fenêtre. Les demandes de données plus anciennes sont rejetées par Reddit. Pour plus d'informations, consultez Obtenir un rapport dans la documentation de l'API Reddit Ads.
Fenêtre de rétrospection
Le paramètre lookback_window_days accepte des valeurs de 1 à 30. Vous ne pouvez pas définir une fenêtre de rétrospection plus longue que 30 jours.
Rapports personnalisés
- Les rapports personnalisés exigent que
destination_tablesoit défini — le connecteur ne peut pas déduire de nom. - La liste
breakdownsdoit inclure au moins une dimension temporelle (DATEouHOUR). L'omission d'une dimension temporelle entraîne l'échec du pipeline au moment de la planification. - Les valeurs de répartition et de champ doivent provenir des listes prises en charge dans Custom report breakdowns and fields.