Databricks Sandbox
Bêta
Cette fonctionnalité est en Bêta. Pour vérifier que cet aperçu de fonctionnalité est activé dans le workspace, consultez Gérer les aperçus Databricks.
Actuellement, Databricks ne facture pas l'utilisation de cette fonctionnalité.
Databricks Sandbox est un environnement de calcul pour les humains et les agents, accessible via SSH, fonctionnant dans le plan de calcul serverless de Databricks.
The sandbox allows you to:
-
Créez un sandbox de développement persistant auquel vous pouvez accéder via SSH. Exécutez des tâches d’agent plus longues sans que votre machine locale n’ait besoin d’être active.
-
Exécutez un agent de codage dans un environnement sécurisé et cloisonné :
- Pilotez votre agent de codage directement depuis la CLI Databricks via SSH.
- Connectez-vous à un IDE de bureau ou à un outil d'agent comme Cursor, Claude ou Codex.
-
Créez des environnements éphémères pour les sous-agents, les expérimentations ou les programmes créés par l'agent. Utilisez ceci avec MCP, ou lors de la création d'agents personnalisés avec l'API Supervisor ou les agents personnalisés sur les applications.
Pourquoi utiliser Databricks Sandbox ?
-
Gouvernance native Databricks
- S'exécute dans le plan de compute serverless Databricks. Les données de votre Databricks Sandbox restent dans la limite de gouvernance de votre Workspace.
- Intégration transparente avec AI Gateway pour l'inférence LLM gouvernée et les appels MCP.
-
Conçu pour l'exécution d'agents
- start en quelques secondes. Créez des environnements vierges pour les expérimentations, les sous-agents ou les tâches isolées, et supprimez-les lorsque vous avez terminé.
- Le stockage persiste entre les sessions. Installez vos outils et votre configuration une seule fois, arrêtez le Databricks Sandbox, puis reconnectez-vous au même système de fichiers et au même état.
- Exécutez des sessions concurrentes sur une seule instance. Ouvrez plusieurs sessions SSH vers un Databricks Sandbox sur un système de fichiers partagé. Un agent peut travailler sur une tâche dans une session pendant que vous suivez les logs ou modifiez les fichiers dans une autre, le tout sur la même instance.
Prérequis (CLI)
Pour créer et utiliser un Databricks Sandbox avec la CLI Databricks, vous devez :
-
Installez la CLI Databricks sur votre machine locale.
-
Authentifiez la CLI Databricks à l'aide de
databricks auth login:
databricks auth login # authenticate to a Databricks workspace
Les sandboxes peuvent être lancées automatiquement par d'autres produits, y compris l'API Superviseur.
Créer un sandbox (CLI)
Pour créer un Databricks Sandbox à l'aide de la CLI Databricks, exécutez les commandes suivantes :
databricks sandbox create # create your sandbox
databricks sandbox register # optional: register SSH keys
databricks sandbox ssh # SSH to your default sandbox
Lorsque vous vous connectez en SSH à votre sandbox, le CLI Databricks est installé et authentifié auprès de l'espace de travail Databricks où votre sandbox est en cours d'exécution. Vous pouvez également configurer les identifiants Git. Voir Connecter votre fournisseur Git à Databricks.
Pour une aide détaillée sur les commandes, exécutez databricks sandbox -h ou consultez le groupe de commandessandbox.
Exécuter un agent de codage
Lorsque vous vous connectez pour la première fois à votre sandbox via SSH, Databricks configure automatiquement des harnais de codage courants tels que Claude et Codex pour utiliser la passerelle IA si celle-ci a été configurée pour votre workspace.
Pour information sur la configuration de AI Gateway, consultez Create and manage model services.
Persistance des données
Le stockage pendant la version Bêta n'est pas persistant et peut être supprimé.
Databricks Sandbox est livré avec un stockage en réseau. Les performances sont similaires à celles des offres cloud typiques.
- Vous pouvez start plusieurs sessions SSH concurrentes vers un Databricks Sandbox, et elles voient toutes le même système de fichiers.
- Les données de votre répertoire personnel (
/home/sandbox-agent) persistent pendant toute la durée de vie de votre Databricks Sandbox. Même après avoir arrêté votre Databricks Sandbox, les données de votre répertoire personnel sont disponibles lorsque vous démarrez votre prochaine session. - Votre répertoire personnel peut stocker jusqu'à 100 Go. Pour le moment, cela ne peut pas être modifié.
- Les données en dehors de votre répertoire d'accueil sont supprimées si vous arrêtez votre sandbox. Vous pouvez stocker jusqu'à 10 Go en dehors de votre répertoire personnel.
Coûts d'utilisation
Pour des information complètes sur l'utilisation de la facturation, consultez Tarifs Databricks. Databricks prévoit de facturer l'utilisation du sandbox :
-
Compute Runtime , facturé à l'heure tant que votre Databricks Sandbox est en cours d'exécution. Les taux exacts sont à déterminer.
- Le stockage en dehors de votre répertoire de base est inclus dans le coût de calcul d'exécution du Databricks Sandbox.
-
Stockage persistant dans votre répertoire de base, à des tarifs similaires à ceux du stockage default.
- Vous êtes facturé pour les données stockées dans votre répertoire d'accueil jusqu'à ce que votre Databricks Sandbox soit supprimé.
- Le stockage entraîne une facturation tant que l'instance Databricks Sandbox existe. L'arrêt de votre Databricks Sandbox n'arrête pas la facturation du stockage.
-
Transfert de données aux taux existants.
Limitations
-
Ne s'intègre pas encore aux contrôles de sortie serverless. N'utilisez pas Databricks Sandbox dans un workspace avec (SEG) activé. Pour plus d'information sur les contrôles de sortie serverless, consultez Qu'est-ce que le contrôle de sortie serverless ?.
-
Spécifications techniques : 4 cœurs, 16 Go de RAM, jusqu'à 100 Go de stockage. Ceci ne peut pas être modifié actuellement, mais Databricks prévoit d'offrir des types d'instance plus grands à l'avenir.
-
Maximum 40 sandbox par utilisateur. Maximum 100 sandbox par Workspace.
-
Disponible uniquement dans les régions suivantes :
- AWS
us-east-1 - AWS
us-west-2 - AWS
eu-west-1 - AWS
ap-southeast-1 - AWS
ap-south-1
- AWS
-
Les adresses IP publiques de votre Databricks Sandbox peuvent changer à tout moment.
-
Ceci est une version bêta. Les données stockées dans votre répertoire personnel seront supprimées une fois la période bêta terminée. Ne stockez rien que vous ne puissiez pas vous permettre de perdre.
-
Il n'existe pas de moyen natif de rendre les environnements persistants en dehors du répertoire de base, ou de personnaliser votre environnement au moment du Startup. Cependant, vous pouvez conserver les packages nécessaires ou la configuration dans votre répertoire personnel.