Aller au contenu principal

Ingérer des données depuis Monday.com

info

Bêta

This feature is in Beta. To use it, a workspace admin must turn on Lakeflow Connect for Monday.com from the Previews page. See Manage Databricks previews.

Cette page montre comment créer un pipeline d'ingestion Monday.com géré à l'aide de Lakeflow Connect.

Exigences​

  • Pour créer un pipeline d'ingestion, respectez d'abord les exigences suivantes :

    • Votre workspace doit être activé pour Unity Catalog.

    • Le compute Serverless doit être activé pour votre Workspace. Consultez les exigences du compute Serverless.

    • Pour créer une nouvelle connexion, vous devez disposer des privilèges CREATE CONNECTION sur le métastore. Voir Gérer les privilèges dans Unity Catalog.

      Si le connecteur prend en charge la création de pipelines basée sur l'interface utilisateur, un administrateur peut créer la connexion et le pipeline en même temps en suivant les étapes décrites sur cette page. Cependant, si les utilisateurs qui créent des pipelines utilisent la création de pipelines basée sur l'API ou ne sont pas des utilisateurs administrateurs, un administrateur doit d'abord créer la connexion dans l'Explorateur de catalogues. Voir Connexion aux sources d'ingestion gérées.

    • Pour utiliser une connexion existante, vous devez avoir les privilèges USE CONNECTION ou ALL PRIVILEGES sur l'objet de connexion.

    • Vous devez disposer de privilèges USE CATALOG sur le catalogue cible.

    • Vous devez disposer des privilèges USE SCHEMA et CREATE TABLE sur un schéma existant ou des privilèges CREATE SCHEMA sur le catalogue cible.

  • Pour ingérer depuis Monday.com, vous devez d'abord configurer l'authentification depuis Databricks et créer une connexion. Consultez Configurer l'authentification pour Monday.com et Créer une connexion Monday.com.

Options du connecteur​

Le connecteur Monday.com prend en charge les options au niveau du pipeline et de la table. Définissez les options au niveau du pipeline dans le bloc source_configurations et les options au niveau de la table dans le bloc connector_options de chaque table dans votre définition de pipeline. Voir la rubrique Exemples pour plus d’informations sur l’utilisation.

Option

Périmètre

Obligatoire

S'applique à

Description

start_datetime

Pipeline

Non

activity_logs Table

Timestamp le plus ancien à partir duquel ingérer les logs d'activité, au format ISO 8601 UTC (par exemple, 2026-01-01T00:00:00Z). Default à l'époque Unix, de sorte que la première synchronisation intègre tout l'historique disponible. N'a aucun effet sur les tables batch en full-refresh.

board_ids

Table

Non

boards et activity_logs tables

ID de boards à ingérer, spécifiés sous forme de tableau JSON de chaînes d’ID (par exemple, ["1234567890","1234567891"]). Lorsqu’il est défini, le connecteur ingère uniquement les boards spécifiés et les Logs d’activité de ces boards. Lorsqu’il est omis, le connecteur ingère tous les boards du compte. Définissez cette option sur les deux tables afin que chacune couvre les mêmes boards.

Option

Périmètre

Obligatoire

S'applique à

Description

start_datetime

Pipeline

Non

activity_logs Table

Timestamp le plus ancien à partir duquel ingérer les logs d'activité, au format ISO 8601 UTC (par exemple, 2026-01-01T00:00:00Z). Default à l'époque Unix, de sorte que la première synchronisation intègre tout l'historique disponible. N'a aucun effet sur les tables batch en full-refresh.

board_ids

Table

Non

boards et activity_logs tables

ID de boards à ingérer, spécifiés sous forme de tableau JSON de chaînes d’ID (par exemple, ["1234567890","1234567891"]). Lorsqu’il est défini, le connecteur ingère uniquement les boards spécifiés et les Logs d’activité de ces boards. Lorsqu’il est omis, le connecteur ingère tous les boards du compte. Définissez cette option sur les deux tables afin que chacune couvre les mêmes boards.

Créez un pipeline d'ingestion​

Pour la liste des tables source prises en charge, consultez Tables source prises en charge.

  1. Dans la barre latérale du workspace Databricks, cliquez sur Ingestion de données .
  2. Sur la page Ajouter des données , sous Connecteurs Databricks , cliquez sur Monday.com .
  3. Sur la page Connexion de l'assistant d'ingestion, sélectionnez la connexion qui stocke vos identifiants Monday.com. Si vous disposez du privilège CREATE CONNECTION sur le metastore, cliquez sur Icône Plus. Créer une connexion pour créer une connexion avec les informations d’identification de Configurer l’authentification à Monday.com.
  4. Cliquez sur Suivant .
  5. Sur la page Configuration de l'ingestion , saisissez un nom pour le pipeline.
  6. Sélectionnez un catalogue et un schéma pour écrire les Logs d'événements. Si vous disposez des privilèges USE CATALOG et CREATE SCHEMA sur le catalogue, cliquez sur Icône Plus. Créer un schéma dans le menu déroulant pour créer un schéma.
  7. Cliquez sur Créer un pipeline et continuer .
  8. Sur la page Source , sélectionnez les tables à ingérer.
  9. Cliquez sur Enregistrer et continuer .
  10. Sur la page Destination , sélectionnez un catalogue et un schéma dans lesquels charger des données. Si vous avez les privilèges USE CATALOG et CREATE SCHEMA sur le catalogue, cliquez sur Icône Plus. Créer un schéma dans le menu déroulant pour créer un schéma.
  11. Cliquez sur Enregistrer et continuer .
  12. (Facultatif) Sur la page Schedules and notifications , cliquez sur Icône Plus. Créer un calendrier . Définissez la fréquence pour refresh les tables de destination.
  13. (Facultatif) Cliquez sur Icône Plus. Ajouter une notification pour définir les notifications par e-mail en cas de succès ou d'échec de l'opération du pipeline, puis cliquez sur Enregistrer et exécuter le pipeline .

Exemples​

Le connecteur Monday.com met à disposition 7 tables source dans le schéma source default. Ingérez des tables individuelles ou l’intégralité du schéma.

Ingérer des tables spécifiques​

Utilisez cette option pour ingérer un sous-ensemble spécifique de tables, ou pour personnaliser le nommage de la destination par table.

Le fichier de définition de pipeline suivant ingère les tables Monday.com individuelles :

YAML
resources:
pipelines:
monday_com_pipeline:
name: monday_com_pipeline
catalog: 'main'
target: 'monday_com_data'
ingestion_definition:
connection_name: monday_com_connection
objects:
- table:
source_schema: 'default'
source_table: 'boards'
destination_catalog: 'main'
destination_schema: 'monday_com_data'
destination_table: 'boards'
- table:
source_schema: 'default'
source_table: 'activity_logs'
destination_catalog: 'main'
destination_schema: 'monday_com_data'
destination_table: 'activity_logs'
- table:
source_schema: 'default'
source_table: 'users'
destination_catalog: 'main'
destination_schema: 'monday_com_data'
destination_table: 'users'

Ingérer des tableaux spécifiques​

Utilisez l’option de connecteur board_ids pour limiter l’ingestion à un sous-ensemble de tableaux. Définissez-le à la fois sur la table boards et sur la table activity_logs afin que chaque table couvre les mêmes tableaux.

Le fichier de définition de pipeline suivant ingère uniquement les tableaux Monday.com spécifiés :

YAML
resources:
pipelines:
monday_com_pipeline:
name: monday_com_pipeline
catalog: 'main'
target: 'monday_com_data'
ingestion_definition:
connection_name: monday_com_connection
objects:
- table:
source_schema: 'default'
source_table: 'boards'
destination_catalog: 'main'
destination_schema: 'monday_com_data'
destination_table: 'boards'
connector_options:
api_source_connector_options:
options:
board_ids: '["<board-id-1>","<board-id-2>"]'
- table:
source_schema: 'default'
source_table: 'activity_logs'
destination_catalog: 'main'
destination_schema: 'monday_com_data'
destination_table: 'activity_logs'
connector_options:
api_source_connector_options:
options:
board_ids: '["<board-id-1>","<board-id-2>"]'

Définir une date de start de log d’activité​

Utilisez la configuration du connecteur start_datetime pour définir le timestamp le plus ancien à partir duquel la table activity_logs effectue l'ingestion. Il est défini au niveau du pipeline. Configurez-le donc dans source_configurations plutôt que sur une table individuelle. Lorsqu'il est omis, la première synchronisation importe tout l'historique des activity logs disponibles.

Le fichier de définition de pipeline suivant ingère les activity logs de Monday.com à partir de l’heure de start spécifiée :

YAML
resources:
pipelines:
monday_com_pipeline:
name: monday_com_pipeline
catalog: 'main'
target: 'monday_com_data'
ingestion_definition:
connection_name: monday_com_connection
source_configurations:
- api_source_connector_config:
configs:
start_datetime: '2026-01-01T00:00:00Z'
objects:
- table:
source_schema: 'default'
source_table: 'activity_logs'
destination_catalog: 'main'
destination_schema: 'monday_com_data'
destination_table: 'activity_logs'

Ingérez l'intégralité du schéma​

Utilisez cette option pour ingérer toutes les tables sources de Monday.com dans un schéma de destination unique avec une seule déclaration.

Le fichier de définition du pipeline suivant ingère toutes les tables Monday.com prises en charge dans un schéma de destination.

YAML
resources:
pipelines:
monday_com_pipeline:
name: monday_com_pipeline
catalog: 'main'
target: 'monday_com_data'
ingestion_definition:
connection_name: monday_com_connection
objects:
- schema:
source_schema: 'default'
destination_catalog: 'main'
destination_schema: 'monday_com_data'

Fichier de définition de job Declarative Automation Bundles​

Voici un exemple de fichier de définition de Job à utiliser avec les Declarative Automation Bundles. Le Job s'exécute quotidiennement.

YAML
resources:
jobs:
monday_com_job:
name: monday_com_job
schedule:
quartz_cron_expression: '0 0 0 * * ?'
timezone_id: 'UTC'
tasks:
- task_key: monday_com_ingestion
pipeline_task:
pipeline_id: ${resources.pipelines.monday_com_pipeline.id}

Modèles courants​

Pour les configurations de pipeline avancées, consultez Modèles courants pour les pipelines d'ingestion gérés.

Étapes suivantes​

start, planifiez et configurez des alertes sur votre pipeline. Consultez les Tâches de maintenance courantes du pipeline.

Ressources supplémentaires​