メインコンテンツまでスキップ

Google アナリティクス 未加工データコネクターのFAQ

このページでは、 Databricks Lakeflowコネクトの Google アナリティクス 未加工 コネクタに関するよくある質問とその回答をご覧いただけます。

一般的なマネージド コネクタに関する FAQ​

マネージドコネクタの FAQ の回答は、Lakeflowコネクトのすべてのマネージド コネクタに適用されます。GA4 固有の FAQ については、引き続きお読みください。

GA4コネクタはどのように機能しますか?​

まず、ユーザーはBigQuery Google が提供するAPI または UI を使用して GA4 データを にエクスポートする必要があります。そこから、Databricks BigQueryAPIは次の を使用して からのデータを使用します。

  • メタデータ オペレーション(テーブルやスキーマのリスト作成など)用の BigQuery API
  • データ取り込み用の BigQuery Storage API
  • スキーマ探索のための Cloud リソース マネージャー API

コネクタに BigQuery が必要なのはなぜですか?​

GA4 データを抽出するには、次の 2 つの方法があります。

  • GA4から直接
  • BigQuery を間接的に使用する

GA4 からの直接インジェストは、集計データに限定されます。BigQuery を使用した間接的な取り込みにより、コネクタはイベントレベルの未加工データを取得できます。

このコネクタにはどの Google ライセンスと権限が必要ですか?​

コネクタには次のものが必要です。

  • BigQuery API と BigQuery Storage API が有効になっている Google Cloud Platform(GCP)プロジェクト。

  • 次のロールを持つ GCP サービス アカウント。

    • BigQuery データビューア
    • BigQuery ジョブ ユーザー
    • BigQuery 読み取りセッション ユーザー
  • BigQuery にデータをエクスポートする Google アナリティクス プロパティ

パイプラインはどのくらいの頻度で実行できますか?​

インジェスト パイプラインは、必要な頻度で実行できます。ただし、Databricks では、高頻度のスケジュールを events_intraday テーブル (頻繁に更新される) と events_fresh テーブル (60 分ごとに更新される) に制限することをお勧めします。その他のテーブルは毎日更新されます。