Présentation du compute standard
Cette page fournit un aperçu du compute standard.
Qu'est-ce que le compute standard ?
Le compute standard est un compute configuré avec le mode d'accès standard. Les ressources de compute standard peuvent être utilisées par tout utilisateur disposant de l'autorisation nécessaire.
Le compute Standard est recommandé pour la plupart des charges de travail. Le compute standard permet à un nombre illimité d'utilisateurs de se connecter et d'exécuter simultanément des charges de travail sur la même ressource de compute, offrant des économies de coûts et une gestion simplifiée du compute. Le compute Standard exécute le code utilisateur en totale isolation, sans accès aux ressources de niveau inférieur.
Sélection du mode d'accès
Le mode d'accès est configuré lors de la création d'une ressource de compute polyvalente ou de Job. Le paramètre du mode d'accès se trouve sous la section Avancé dans l'interface utilisateur de compute et est représenté par data_security_mode dans l'API.
Par default dans l'interface utilisateur, le mode d'accès est défini sur Auto , ce qui signifie que le mode d'accès est automatiquement choisi pour vous en fonction de votre Databricks Runtime sélectionné. Auto correspond par défaut à **Standard**, sauf si un runtime de Machine Learning, un type d'instance GPU ou un Databricks Runtime inférieur à 14.3 est sélectionné, auquel cas **Dedicated** est utilisé.
Quand utiliser un compute standard
Le compute standard est recommandé pour la plupart des workloads, notamment :
- Pipelines généraux de data engineering et d'ETL : La plupart des charges de travail de traitement des données
- Projets de Data Science collaboratifs : équipes collaborant sur l'analyse et le développement de modèles
- Exploration interactive des données : analyse ad hoc et développement basé sur des Notebooks
- Optimisation des coûts : Lorsque vous souhaitez partager des ressources de compute entre plusieurs utilisateurs
Choisissez le compute dédié uniquement pour les charges de travail spécialisées nécessitant un accès machine privilégié, des API RDD, le ML distribué, des GPU ou R. Pour une liste des limitations du compute standard, consultez Exigences et limitations du compute standard.
Prise en charge du langage et de l'environnement d'exécution
Le compute standard prend en charge les langages de programmation suivants :
- Python : Prise en charge complète pour toutes les versions de Databricks Runtime
- SQL : prise en charge complète pour toutes les versions de Databricks Runtime.
- Scala : Pris en charge sur Databricks Runtime 13.3 LTS et versions ultérieures avec Unity Catalog
- R : Non pris en charge sur le compute standard
Lakeguard pour l’isolement des utilisateurs
Le compute standard utilise Databricks Lakeguard pour offrir une isolation sécurisée des utilisateurs et la gouvernance des données. Lakeguard utilise des techniques avancées d'isolation de code qui séparent le code utilisateur de l'infrastructure Spark sous-jacente.
Pour plus d'informations, consultez Comment Databricks applique-t-il l'isolation des utilisateurs ?.