Aller au contenu principal

Lakebase provisionnée

info

Lakebase Provisioned est l'offre originale de Lakebase qui utilise un compute provisionné que vous mettez à l'échelle manuellement. Pour les régions prises en charge, consultez la disponibilité des régions. Pour la dernière version de Lakebase, avec compute à dimensionnement automatique, mise à l'échelle jusqu'à zéro, création de branches et restauration instantanée, consultez Lakebase Autoscaling.

Depuis le 12 mars 2026, les nouvelles instances Lakebase sont créées en tant que projets de dimensionnement automatique. Les instances provisionnées existantes sont mises à niveau automatiquement vers la mise à l'échelle automatique, à compter de juin 2026. Pour plus de détails, consultez Mise à niveau vers le dimensionnement automatique Lakebase.

Lakebase est un moteur de base de données de traitement transactionnel en ligne (OLTP) Postgres entièrement managé intégré à la Databricks Data Intelligence Platform. Lakebase vous permet de créer et de gérer des bases de données OLTP stockées dans le stockage géré par Databricks, en les intégrant à votre Lakehouse pour des charges de travail transactionnelles en temps réel.

Architecture d'instance de base de données

Une instance de base de données gère le stockage et les ressources de compute et fournit les endpoints auxquels les utilisateurs se connectent.

  • Compute nodes : un nœud est le principal et gère les opérations d’écriture. Les nœuds secondaires sont facultatifs, séparés entre les zones pour une haute disponibilité. Les nœuds de compute peuvent être mis en pause, conservant le stockage tout en arrêtant les Ressources de compute.
  • **Endpoints :** L'Endpoint par default achemine les requêtes de lecture et d'écriture vers le principal. Les Endpoint facultatifs en lecture seule acheminent vers les nœuds secondaires.
  • Gestion des défaillances : si le nœud principal échoue et que la haute disponibilité est configurée, un nœud secondaire prend automatiquement le relais.

Limitations

  • Un Workspace autorise un maximum de dix instances.
  • Chaque instance prend en charge jusqu’à 1 000 connexions simultanées.
  • La limite de taille logique de toutes les bases de données d'une instance est de 2 To.
  • Les instances de base de données sont limitées à un seul workspace et ne prennent pas en charge l'accès inter-workspace.
  • Databricks recommande de configurer le Private Link comme bonne pratique de sécurité.

En savoir plus sur Lakebase Provisioned

Sujet

Description

Mise à niveau vers l'autoscaling

Découvrez comment mettre à niveau les instances provisionnées de Lakebase vers la plateforme de mise à l'échelle automatique, y compris les modifications et les actions (le cas échéant) que vous devez entreprendre.

rôles Postgres

Comprendre les rôles prédéfinis et comment gérer les rôles pour les identités Databricks.

Compatibilité PostgreSQL

Découvrez la compatibilité, les limitations et les conseils d'optimisation de PostgreSQL.

Sujet

Description

Mise à niveau vers l'autoscaling

Découvrez comment mettre à niveau les instances provisionnées de Lakebase vers la plateforme de mise à l'échelle automatique, y compris les modifications et les actions (le cas échéant) que vous devez entreprendre.

rôles Postgres

Comprendre les rôles prédéfinis et comment gérer les rôles pour les identités Databricks.

Compatibilité PostgreSQL

Découvrez la compatibilité, les limitations et les conseils d'optimisation de PostgreSQL.

Get start with Lakebase Provisionnée

Pour les propriétaires et administrateurs de bases de données

Si vous configurez une nouvelle base de données Lakebase pour votre équipe :

Tâche

Description

Créer une instance de base de données

Configurez votre première base de données Lakebase provisionnée.

Ajouter des utilisateurs et définir les autorisations

Donnez accès à votre base de données à d'autres utilisateurs et contrôlez ce qu'ils peuvent faire.

Tâche

Description

Créer une instance de base de données

Configurez votre première base de données Lakebase provisionnée.

Ajouter des utilisateurs et définir les autorisations

Donnez accès à votre base de données à d'autres utilisateurs et contrôlez ce qu'ils peuvent faire.

Pour les utilisateurs de bases de données

Si vous avez besoin d'accéder à une base de données Lakebase existante :

Tâche

Description

Connectez-vous à votre base de données

Obtenez les informations d'identification dont vous avez besoin pour accéder à votre base de données Lakebase.

Interrogez vos données

Utilisez divers outils pour interroger vos données PostgreSQL, y compris l'éditeur SQL, les notebooks et le client psql.

Tâche

Description

Connectez-vous à votre base de données

Obtenez les informations d'identification dont vous avez besoin pour accéder à votre base de données Lakebase.

Interrogez vos données

Utilisez divers outils pour interroger vos données PostgreSQL, y compris l'éditeur SQL, les notebooks et le client psql.

Intégration et synchronisation des données

Connectez Lakebase à vos données et workflows Databricks existants.

Sujet

Description

S'enregistrer auprès de Unity Catalog

Enregistrez facultativement votre base de données PostgreSQL en tant que catalogue dans Unity Catalog pour les requêtes fédérées.

Servez les données lakehouse avec des tables synchronisées.

Créez des tables synchronisées pour servir les données Unity Catalog via votre instance de base de données Lakebase pour les applications opérationnelles.

Sujet

Description

S'enregistrer auprès de Unity Catalog

Enregistrez facultativement votre base de données PostgreSQL en tant que catalogue dans Unity Catalog pour les requêtes fédérées.

Servez les données lakehouse avec des tables synchronisées.

Créez des tables synchronisées pour servir les données Unity Catalog via votre instance de base de données Lakebase pour les applications opérationnelles.

Fonctionnalités avancées

Explorez les fonctionnalités avancées pour les charges de travail de production et les cas d'usage d'entreprise.

Sujet

Description

Restaurer les données et time travel

Utilisez des instances enfants pour effectuer du time travel et restaurer les données à des moments précis pour la récupération des données, l'audit de conformité et les environnements de développement.

Monitoring et observabilité

Surveillez les performances et la santé de votre base de données à l'aide de métriques et de journaux intégrés.

Sujet

Description

Restaurer les données et time travel

Utilisez des instances enfants pour effectuer du time travel et restaurer les données à des moments précis pour la récupération des données, l'audit de conformité et les environnements de développement.

Monitoring et observabilité

Surveillez les performances et la santé de votre base de données à l'aide de métriques et de journaux intégrés.

Configuration avancée

Explorez les fonctionnalités avancées pour les charges de travail de production et les cas d'usage d'entreprise.

Sujet

Description

Haute disponibilité

Configurez la haute disponibilité pour vos instances de base de données afin d'assurer la continuité des activités.

Restaurer la fenêtre

Définissez la fenêtre de restauration pour votre instance de base de données pour la restauration à un instant T.

Sujet

Description

Haute disponibilité

Configurez la haute disponibilité pour vos instances de base de données afin d'assurer la continuité des activités.

Restaurer la fenêtre

Définissez la fenêtre de restauration pour votre instance de base de données pour la restauration à un instant T.

Disponibilité régionale

Régions prises en charge :

  • us-east-1
  • us-east-2
  • us-west-2
  • eu-central-1
  • eu-west-1
  • ap-south-1
  • ap-southeast-1
  • ap-southeast-2

Comparaison des fonctionnalités

Le tableau suivant compare les capacités de Lakebase Autoscaling et de Lakebase Provisioned.

remarque

Lakebase Autoscaling est la nouvelle version de Lakebase. Le développement de nouvelles fonctionnalités est axé sur Lakebase Autoscaling.

Les nouvelles instances Lakebase seront créées en tant que projets de dimensionnement automatique. Le déploiement start le 12 mars 2026. Pour plus de détails, consultez Mise à l'échelle automatique par default.

Fonctionnalité

Dimensionnement automatique

provisionnement

Fonctionnalités de base

Compute provisionné (taille fixe)

Dimensionnement automatique

Monter en charge à zéro

Création de branches

Restauration instantanée

Restauration à un instant T

Réplicas en lecture/secondaires lisibles

✓ (Réplicas en lecture, secondaires lisibles)

✓ (Secondaires lisibles)

Haute disponibilité

Link privé entrant

Inbound Private Link pour les services à forte intensité de performance.

Profil de sécurité de la conformité

✓ (défini sur HIPAA, C5, TISAX ou Aucun)

Clés gérées par le client (CMK)

Intégration des données

Enregistrement dans Unity Catalog

Tables synchronisées (servent les données du lakehouse avec Lakebase)

Lakehouse Sync (synchronisation des tables Lakebase avec les tables Delta/Iceberg)

✓ Aperçu public

Query federation

Intégrations d'applications

Databricks Apps

Feature Store

Notebooks

Agents IA avec état

Contrôle d'accès

Interface utilisateur pour la gestion des rôles Postgres

ACLs de Workspace

Outils de développement

Infrastructure en tant que code (Bundles d'actifs, Terraform)

✓ (bêta)

Accès programmatique (API REST, CLI, SDK)

✓ (bêta)

Prise en charge de l’API PostgREST

✓ (compatible avec PostgREST API de données)

✓ (Aperçu privé)

Gestion des coûts

Tags et politiques d’utilisation Serverless

Fonctionnalité

Dimensionnement automatique

provisionnement

Fonctionnalités de base

Compute provisionné (taille fixe)

Dimensionnement automatique

Monter en charge à zéro

Création de branches

Restauration instantanée

Restauration à un instant T

Réplicas en lecture/secondaires lisibles

✓ (Réplicas en lecture, secondaires lisibles)

✓ (Secondaires lisibles)

Haute disponibilité

Link privé entrant

Inbound Private Link pour les services à forte intensité de performance.

Profil de sécurité de la conformité

✓ (défini sur HIPAA, C5, TISAX ou Aucun)

Clés gérées par le client (CMK)

Intégration des données

Enregistrement dans Unity Catalog

Tables synchronisées (servent les données du lakehouse avec Lakebase)

Lakehouse Sync (synchronisation des tables Lakebase avec les tables Delta/Iceberg)

✓ Aperçu public

Query federation

Intégrations d'applications

Databricks Apps

Feature Store

Notebooks

Agents IA avec état

Contrôle d'accès

Interface utilisateur pour la gestion des rôles Postgres

ACLs de Workspace

Outils de développement

Infrastructure en tant que code (Bundles d'actifs, Terraform)

✓ (bêta)

Accès programmatique (API REST, CLI, SDK)

✓ (bêta)

Prise en charge de l’API PostgREST

✓ (compatible avec PostgREST API de données)

✓ (Aperçu privé)

Gestion des coûts

Tags et politiques d’utilisation Serverless