メインコンテンツまでスキップ

Google Search Consoleコネクタの制限事項

備考

ベータ版

この機能はベータ版です。ワークスペース管理者は、 プレビュー ページからこの機能へのアクセスを制御できます。Databricksのプレビューを管理するを参照してください。

このページには、Lakeflow Connect におけるマネージド Google Search Console コネクタの既知の制限事項に関する情報が含まれています。

一般的な ソフトウェア as a サービス(SaaS)コネクタの制限事項

このセクションの制限事項は、Lakeflowコネクト のすべてのSaaS コネクタに適用されます。

  • スケジュールされたパイプラインをRunする場合、アラートはすぐにTriggerされません。その代わりに、次の更新がTriggerされます。
  • ソーステーブルを削除しても、宛先テーブルは自動的に削除されません。宛先テーブルは手動で削除する必要があります。この動作は、Lakeflow上のSpark宣言型パイプラインの動作と一致しません。
  • ソースのメンテナンス期間中は、Databricksがデータにアクセスできない場合があります。
  • ソーステーブル名が既存の宛先テーブル名と競合する場合、パイプラインの更新は失敗します。
  • マルチ送信先パイプラインのサポートはAPIのみです。
  • オプションで、取り込むテーブルの名前を変更できます。パイプライン内のテーブルの名前を変更すると、そのテーブルは API 専用パイプラインになり、UI でパイプラインを編集できなくなります。
  • パイプラインがすでに起動した後に列を選択した場合、コネクタはその新しい列のデータを自動的にバックフィルしません。ヒストリカルデータを取り込むには、テーブルで完全更新を手動でランします。
  • Databricksでは、異なるソーススキーマからのテーブルであっても、同じパイプライン内で同じ名前のテーブルを2つ以上取り込むことはできません。
  • ソースシステムは、カーソル列が単調に増加することを前提としています。
  • このコネクタは、変換を行わずに生データを取り込みます。変換には、LakeFlow Pipelines上のダウンストリームのSpark宣言型パイプラインを使用します。

コネクタ固有の制限事項

このセクションの制限事項は、Google Search Consoleコネクタに適用されます。

  • sites テーブルと sitemaps テーブルは、増分取り込みをサポートしていません。このコネクタは、パイプラインが更新されるたびに完全な更新(フルリフレッシュ)を実行します。
  • Google Search Console の検索アナリティクスデータには、約2~4日の遅延があります。パイプライン作成後の最初の同期では、最近の日付のデータが表示されない場合があります。
  • data_state コネクターオプションは、日次検索アナリティクス テーブルにのみ適用されます。時間単位のテーブルでは、常に hourly_all データ状態が使用されます。
  • 時間単位の検索アナリティクスデータは、web および googleNews 検索タイプを使用しているプロパティでのみ利用可能です。newsimage、および video 検索タイプは、時間単位のテーブルではサポートされていません。
  • コネクタは、最初の同期時に最大500日分のヒストリカルデータを取り込みます。これは、最初のパイプライン更新がランが実行された日から測定されます。start_date コネクタオプションを使用して、初期ルックバック期間を制限します。