Connecteur OpenAI
Bêta
Cette fonctionnalité est en bêta. Les administrateurs de Workspace peuvent contrôler l'accès à cette fonctionnalité à partir de la page Aperçus . Voir Gérer les prévisualisations Databricks.
Le connecteur OpenAI géré dans Lakeflow Connect ingère les données d'administration de l'organisation, telles que les utilisateurs, les projets, les clés API, l'utilisation, les coûts et les logs d'audit, depuis OpenAI vers Databricks.
Disponibilité des fonctionnalités
Fonctionnalité | Disponibilité |
|---|---|
Création de pipeline via l'interface utilisateur |
|
Création de pipeline basée sur une API |
|
Declarative Automation Bundles |
|
Ingestion incrémentielle |
|
Gouvernance avec Unity Catalog |
|
Orchestration à l'aide de Databricks Workflows |
|
Sélection et désélection de colonnes basées sur l'API |
|
Filtrage de ligne basé sur l'API |
|
SCD de type 2 |
S'applique aux tables d'entités mutables. Les tables |
Évolution automatisée des schémas : nouvelles colonnes et colonnes supprimées |
|
Évolution automatisée des schémas : changements de type de données |
|
Évolution automatisée des schémas : renommages de colonnes |
Nécessite une refresh complète. |
Méthodes d'authentification
Méthode d’authentification | Disponibilité |
|---|---|
OAuth U2M |
|
OAuth M2M |
|
Authentification de base (nom d’utilisateur/mot de passe) |
|
Authentification de base (clé API) |
Clé API d'administration OpenAI. |
Ce qu’il faut savoir avant de start
Sujet | Pourquoi est-ce important |
|---|---|
Le workflow dépend de votre persona utilisateur Databricks :
| |
Les étapes de création d'une connexion dépendent de la méthode d'authentification que vous choisissez. | |
Les étapes de création d’un pipeline dépendent de l’interface. | |
La programmation du pipeline dépend de vos critères de latence et de coût. | |
Selon vos besoins d'ingestion, le pipeline peut utiliser des configurations telles que le suivi de l'historique, la sélection de colonnes et le filtrage de lignes. Les configurations prises en charge varient selon le connecteur. Voir Disponibilité des fonctionnalités. |
Ingérer depuis OpenAI en 3 étapes
- Configurer OpenAI pour l'ingestion (Administrateurs) — Configurez OpenAI pour l'authentification avec Databricks.
- Créer une connexion au Unity Catalog (Administrateurs) — Créez une connexion dans Catalog Explorer pour stocker les informations d'identification permettant à Databricks de s'authentifier auprès d'OpenAI.
- Créer un pipeline d'ingestion (administrateurs ou non-administrateurs) — Sélectionnez n'importe quelle interface prise en charge et créez un pipeline à partir d'une connexion existante.