Reddit Ads コネクタの制限事項
備考
ベータ版
この機能はベータ版です。ワークスペース管理者は、 プレビュー ページからこの機能へのアクセスを制御できます。Databricksのプレビューを管理するを参照してください。
Lakeflow Connect で管理された Reddit Ads コネクタを使用する際の既知の制限事項について学習します。
一般的な SaaS コネクタの制限事項
- スケジュールされたパイプラインをランすると、アラートはすぐに Trigger されません。代わりに、次の更新がランしたときに Trigger されます。
- ソーステーブルが削除されても、宛先テーブルは自動的に削除されません。宛先テーブルは手動で削除する必要があります。この動作は、LakeflowでのSpark宣言型パイプラインの動作と一貫性がありません。
- ソースメンテナンス期間中は、Databricks がデータにアクセスできない場合があります。
- ソーステーブル名が既存の宛先テーブル名と競合する場合、パイプラインの更新は失敗します。
- 複数宛先パイプラインのサポートはAPIのみです。
- オプションで、取り込んだテーブルの名前を変更できます。パイプライン内のテーブルの名前を変更すると、API 専用パイプラインになり、UI でパイプラインを編集できなくなります。
- パイプラインの起動後に列を選択した場合、コネクタは新しい列のデータを自動的にバックフィルしません。ヒストリカルデータを取り込むには、テーブルで完全更新を手動でランしてください。
- Databricksでは、異なるソーススキーマからであっても、同じパイプライン内で同じ名前のテーブルを2つ以上取り込むことはできません。
- ソースシステムは、カーソル列が単調に増加すると想定しています。
- コネクタは、変換なしで生データを取り込みます。LakeFlow Pipelinesで下流のSpark宣言型パイプラインを変換に使用します。
サポートされているテーブル
このコネクタは、Reddit Adsコネクタのリファレンスにリストされている事前定義されたエンティティおよびレポート テーブルと、ユーザー定義のカスタム レポートのみをサポートしています。エンティティおよびレポートテーブルのセットは固定されています。
増分取り込み
- エンティティテーブル (
ad_account、campaign、ad_group、ad) は、各パイプラインの更新時に完全に更新されます。レポートテーブルのみが増分取り込みをサポートしています。 - エンティティテーブルは履歴追跡(SCDタイプ2)をサポートしていません。各エンティティの現在の状態のみが保存されます。
レポートデータ保持
Reddit AdsレポートAPIは、過去約24か月分のレポートデータのみを提供します。sync_start_dateパラメーターにかかわらず、レポートテーブルは、この期間より古いデータを取得できません。古いデータの要求はRedditによって拒否されます。詳細については、Reddit Ads APIドキュメントの「レポートの取得」を参照してください。
ルックバック期間
lookback_window_daysパラメーターは1から30までの値を受け入れます。ルックバックウィンドウを30日より長く設定することはできません。
カスタムレポート
- カスタムレポートでは
destination_tableの設定が必要です。コネクタは名前を推測できません。 breakdownsリストには、少なくとも1つの時間ディメンション(DATEまたはHOUR)を含める必要があります。時間ディメンションを省略すると、計画段階でパイプラインが失敗します。- 内訳とフィールド値は、カスタムレポートの内訳とフィールドでサポートされているリストから取得する必要があります。