Aller au contenu principal

Connecteur d'ingestion Salesforce

Databricks Lakeflow Connect fournit un connecteur intégré pour ingérer des données directement depuis la plateforme Salesforce dans Databricks. Les équipes de données peuvent facilement créer des pipelines efficaces et incrémentiels à l'échelle, et les entreprises peuvent obtenir des insights riches en unifiant toutes leurs données et leurs assets d'IA sur la Data Intelligence Platform.

Une organisation peut vouloir utiliser les données Salesforce pour prédire l'attrition des clients. La vidéo suivante montre comment un détaillant peut y parvenir en ingérant ses données de commande client, en les analysant, puis en les combinant avec les interactions client sur d'autres canaux de distribution pour une vue client holistique.

Disponibilité des fonctionnalités

Fonctionnalité

Disponibilité

Conception de pipelines via l'interface utilisateur

Icône de coche verte Pris en charge

Création de pipeline par API

Icône de coche verte Pris en charge

Declarative Automation Bundles

Icône de coche verte Pris en charge

Ingestion incrémentielle

Icône de coche verte Pris en charge

By default, les champs de formule nécessitent des instantanés complets. Pour activer l'ingestion incrémentielle des champs de formule, consultez Ingérer les champs de formule Salesforce de manière incrémentielle.

Gouvernance Unity Catalog

Icône de coche verte Pris en charge

Orchestration à l'aide de Databricks Workflows

Icône de coche verte Pris en charge

SCD de type 2

Icône de coche verte Pris en charge

Sélection et désélection de colonnes via API

Icône de coche verte Pris en charge

Filtrage des lignes basé sur l'API

Icône de coche verte Pris en charge

Évolution automatique des schémas : Nouvelles colonnes et colonnes supprimées

Icône de coche verte Pris en charge

Évolution automatisée des schémas : changements de type de données

Icône X rouge Non pris en charge

évolution des schémas automatisée : Renommage de colonnes

Icône de coche verte Pris en charge

Considéré comme une nouvelle colonne (nouveau nom) et une colonne supprimée (ancien nom).

Évolution des schémas automatisée : nouvelles tables

N/A

Nombre maximum de tables par pipeline

250

Fonctionnalité

Disponibilité

Conception de pipelines via l'interface utilisateur

Icône de coche verte Pris en charge

Création de pipeline par API

Icône de coche verte Pris en charge

Declarative Automation Bundles

Icône de coche verte Pris en charge

Ingestion incrémentielle

Icône de coche verte Pris en charge

By default, les champs de formule nécessitent des instantanés complets. Pour activer l'ingestion incrémentielle des champs de formule, consultez Ingérer les champs de formule Salesforce de manière incrémentielle.

Gouvernance Unity Catalog

Icône de coche verte Pris en charge

Orchestration à l'aide de Databricks Workflows

Icône de coche verte Pris en charge

SCD de type 2

Icône de coche verte Pris en charge

Sélection et désélection de colonnes via API

Icône de coche verte Pris en charge

Filtrage des lignes basé sur l'API

Icône de coche verte Pris en charge

Évolution automatique des schémas : Nouvelles colonnes et colonnes supprimées

Icône de coche verte Pris en charge

Évolution automatisée des schémas : changements de type de données

Icône X rouge Non pris en charge

évolution des schémas automatisée : Renommage de colonnes

Icône de coche verte Pris en charge

Considéré comme une nouvelle colonne (nouveau nom) et une colonne supprimée (ancien nom).

Évolution des schémas automatisée : nouvelles tables

N/A

Nombre maximum de tables par pipeline

250

Méthodes d'authentification

Méthode d'authentification

Disponibilité

OAuth U2M

Icône de coche verte Pris en charge

OAuth M2M

Icône X rouge Non pris en charge

OAuth (jeton de refresh manuel)

Icône X rouge Non pris en charge

Authentification de base (nom d’utilisateur/mot de passe)

Icône X rouge Non pris en charge

Authentification de base (clé API)

Icône X rouge Non pris en charge

Authentification de base (clé JSON du compte de service)

Icône X rouge Non pris en charge

Méthode d'authentification

Disponibilité

OAuth U2M

Icône de coche verte Pris en charge

OAuth M2M

Icône X rouge Non pris en charge

OAuth (jeton de refresh manuel)

Icône X rouge Non pris en charge

Authentification de base (nom d’utilisateur/mot de passe)

Icône X rouge Non pris en charge

Authentification de base (clé API)

Icône X rouge Non pris en charge

Authentification de base (clé JSON du compte de service)

Icône X rouge Non pris en charge

Ce qu'il faut savoir avant de start

Sujet

Pourquoi c'est important

Profil d'utilisateur Databricks

Le workflow dépend de votre persona utilisateur Databricks :

  • Mono-utilisateur : un utilisateur administrateur crée une connexion Unity Catalog et un pipeline d'ingestion.
  • Multi-utilisateur : un utilisateur administrateur crée une connexion pour les utilisateurs non-administrateurs afin qu’ils puissent créer des pipelines.

Méthode d'authentification

Les étapes de création d’une connexion dépendent de la méthode d’authentification que vous choisissez.

Interface

Les étapes de création d'un pipeline dépendent de l'interface.

Fréquence d'ingestion

La planification du pipeline dépend de vos exigences en matière de latence et de coût.

Modèles courants

Selon vos besoins d'ingestion, le pipeline peut utiliser des configurations comme le suivi de l'historique, la sélection de colonnes et le filtrage de lignes. Les configurations prises en charge varient selon le connecteur. Voir Disponibilité des fonctionnalités.

Sujet

Pourquoi c'est important

Profil d'utilisateur Databricks

Le workflow dépend de votre persona utilisateur Databricks :

  • Mono-utilisateur : un utilisateur administrateur crée une connexion Unity Catalog et un pipeline d'ingestion.
  • Multi-utilisateur : un utilisateur administrateur crée une connexion pour les utilisateurs non-administrateurs afin qu’ils puissent créer des pipelines.

Méthode d'authentification

Les étapes de création d’une connexion dépendent de la méthode d’authentification que vous choisissez.

Interface

Les étapes de création d'un pipeline dépendent de l'interface.

Fréquence d'ingestion

La planification du pipeline dépend de vos exigences en matière de latence et de coût.

Modèles courants

Selon vos besoins d'ingestion, le pipeline peut utiliser des configurations comme le suivi de l'historique, la sélection de colonnes et le filtrage de lignes. Les configurations prises en charge varient selon le connecteur. Voir Disponibilité des fonctionnalités.

Start l'ingestion depuis Salesforce

Le tableau suivant fournit un aperçu du flux d'ingestion Salesforce de bout en bout, basé sur le type d'utilisateur :

Utilisateur

Étapes

Admin

Soit :

Non-administrateur

Utilisez toute interface prise en charge pour créer un pipeline à partir d'une connexion existante. Consultez Ingérer des données depuis Salesforce.

Utilisateur

Étapes

Admin

Soit :

Non-administrateur

Utilisez toute interface prise en charge pour créer un pipeline à partir d'une connexion existante. Consultez Ingérer des données depuis Salesforce.