Configurer des SQL Warehouse Serverless
Cette page explique comment configurer des SQL Warehouses Serverless pour votre Workspace.
Les Serverless SQL Warehouse n'ont pas d'adresses IP publiques. Pour plus d'informations architecturales, consultez l'architecture de haut niveau.
Architecture de calcul Serverless
Les SQL Warehouse Serverless s'exécutent sur une infrastructure gérée par Databricks. L’architecture CPU sous-jacente n’est pas sélectionnable par les clients et peut varier. Pour maintenir la disponibilité en cas de contraintes de capacité, Databricks peut modifier l’architecture CPU qui prend en charge un SQL Warehouse Serverless entre les redémarrages, sans préavis.
Cela peut affecter les charges de travail qui dépendent d'une architecture de processeur spécifique. Par exemple, les UDF Python d'Unity Catalog qui installent des wheels Python spécifiques à la plateforme avec des extensions natives (C) peuvent échouer si une wheel a été conçue pour une architecture différente de celle qui exécute la requête. Regroupez ces wheels pour les deux architectures. Consultez Étendre les UDF à l'aide de dépendances personnalisées.
Aperçu de l'activation serverless
Le Serverless est activé par default dans la plupart des comptes. Le Serverless pourrait ne pas être activé dans les scénarios suivants :
- Le Workspace ne répond pas aux exigences : le Workspace doit respecter toutes les exigences énumérées sur cette page. Les Workspace inéligibles affichent Serverless comme désactivé avec une info-bulle expliquant la raison.
- **Le compte dispose d'un report accordé** : Si un compte dispose d'un report accordé, Serverless n'est pas activé par default et les nouveaux Workspace de ce compte héritent du statut de report. Vous pouvez demander l'activation au niveau du workspace sans activer l'ensemble du compte. Contactez l'équipe de votre compte Databricks pour lever une suspension.
- Le compte n'a pas accepté les Conditions d'utilisation : Serverless requiert l'acceptation de conditions supplémentaires dans la console du compte. Consultez Activer le compute serverless dans votre compte.
Exigences
- Votre compte Databricks ne doit pas être en essai gratuit.
- Votre workspace Databricks doit être sur le plan Premium ou supérieur.
- Les SQL Warehouse Serverless sont pris en charge dans toutes les régions AWS. Consultez la disponibilité Serverless.
- Votre Workspace ne doit pas utiliser les politiques d’accès S3.
- Votre workspace ne doit pas utiliser un métastore Hive hérité externe. Consultez Supprimer les informations d'identification du Hive metastore pour activer le Serverless.
Votre workspace peut utiliser AWS Glue comme métastore hérité du workspace. Consultez Utiliser AWS Glue Data Catalog comme métastore (hérité).
Activer le compute Serverless dans votre compte
- Accédez à l’ tab d’activation des fonctionnalités de la page des paramètres de la console de compte.
- Une bannière en haut de la page vous invite à accepter les conditions supplémentaires. Lisez les conditions, puis cliquez sur Accepter . Si vous ne voyez pas la bannière, cette étape a déjà été réalisée.
Après avoir accepté les conditions, votre compte est activé pour Serverless.
Mettre à jour le profil d'instance pour le compute Serverless (facultatif)
Si votre workspace utilise un profil d'instance pour l'accès aux données, vous devrez peut-être mettre à jour la relation de confiance du profil d'instance pour activer le serverless. Voir Confirmer ou configurer un profil d'instance AWS à utiliser avec vos SQL Warehouse Serverless.
Vous n'avez pas besoin de compléter cette étape si vous utilisez Unity Catalog pour la gouvernance des données.
Supprimez les identifiants du Hive metastore pour activer le serverless
Vous ne pouvez pas déployer de SQL Warehouse Serverless si les identifiants du Hive metastore sont définis au niveau du Workspace. Pour supprimer les identifiants du Hive metastore hérité :
- Cliquez sur votre nom d'utilisateur dans la barre supérieure du workspace et sélectionnez Paramètres dans le menu déroulant.
- Cliquez sur l'onglet Compute .
- Cliquez sur **Gérer** à côté de **SQL Warehouses**.
- Dans le champ Configuration de l'accès aux données , localisez et supprimez les informations d'identification du Hive metastore.
- Cliquez sur Enregistrer les modifications .
Surveiller l'utilisation avec des tags
Comme toute autre ressource de compute dans Databricks, vous pouvez appliquer des tags aux SQL Warehouses serverless pour surveiller l'utilisation et le coût. Vous pouvez consulter l'utilisation dans la console du compte ou accéder aux logs téléchargeables. Voir les tableaux de bord d'utilisation.
Limitations
Le warehouse Serverless présente les limitations suivantes :
- Les règles de cluster, y compris les politiques d'instances ponctuelles, ne sont pas prises en charge. Consultez Créer et gérer des politiques de compute.
- Les VPC gérés par le client ne sont pas applicables aux ressources de compute pour les Serverless SQL Warehouse. Consultez Configurer un VPC géré par le client.
- Les SQL Warehouse Serverless utilisent une connectivité privée entre le plan de contrôle Databricks et le plan de compute serverless dans presque tous les cas. Certains workspaces de région
us-east-1hérités utilisent une connexion réseau sécurisée alternative. - Bien que le plan de compute serverless n'utilise pas le relais de connectivité de cluster sécurisé pour le plan de compute classique, les SQL Warehouses serverless n'ont pas d'adresses IP publiques.
- Les SQL Warehouses Serverless n'utilisent pas de clés gérées par les clients pour le chiffrement du stockage EBS. Voir Compute Serverless et clés gérées par le client.