Aller au contenu principal

Machine learning sur Databricks

Créer, déployer et gérer des applications Machine Learning sur Databricks. La plateforme intégrée unifie l'ensemble du cycle de vie du ML, de la préparation des données au monitoring de production.

Vous recherchez l'IA générative et les agents IA ? Consultez Créer des agents IA sur Databricks.

Get start

Essayez un démarrage rapide, programmez un modèle et utilisez des Notebooks.

Entraîner des Modèles de machine learning classiques

Concevoir des fonctionnalités, créer des modèles de machine learning et suivre les expérimentations.

    • Feature Store
    • Effectuez le Feature Engineering, gérez les fonctionnalités dans Unity Catalog et servez les fonctionnalités en production.
    • Runtime Databricks pour le ML
    • Clusters préconfigurés avec scikit-learn, XGBoost, MLflow et d'autres bibliothèques ML, ainsi que la prise en charge des frameworks d'apprentissage profond.
    • Suivi MLflow
    • Suivre les expérimentations, comparer les performances des modèles et gérer le cycle de vie complet du développement de modèles.

Entraîner des modèles de deep learning

Utilisez des compute gérés et des frameworks intégrés pour développer des modèles de deep learning.

    • AI Runtime
    • Utilisez le GPU compute Serverless pour les charges de travail d'entraînement et d'inférence de deep learning personnalisées.
    • DL : meilleures pratiques
    • Découvrez le choix du framework, le chargement des données, la mise à l'échelle distribuée et la gestion du cycle de vie des modèles de deep learning.
    • Ray sur Databricks
    • Monter en charge les charges de travail ML avec le calcul distribué pour l'entraînement et l'inférence de modèles à grande échelle.

Déployer et servir des modèles

Déployez des modèles en production avec des Endpoints évolutifs pour l'inférence en temps réel, en streaming ou par batch.

    • Mise à disposition de modèles
    • Déployez des modèles personnalisés et des LLM comme Endpoint REST avec mise à l'échelle automatique et prise en charge GPU.
    • Passerelle IA
    • Gérez et surveillez l'accès aux modèles servis sur Databricks avec le suivi d'utilisation, la journalisation des charges utiles et les contrôles de sécurité.
    • Inférence par batch
    • Déployer des modèles pour l’inférence et la prédiction par batch et en streaming sur de grands datasets.
    • API Foundation Model
    • Accédez et interrogez les modèles GenAI de pointe hébergés par Databricks.

Superviser et gérer les systèmes de ML

Garantissez la qualité des modèles, l'intégrité des données et la conformité grâce à des outils complets de monitoring et de gouvernance.

    • Unity Catalog
    • Gouvernez les données, les fonctionnalités, les modèles et les fonctions avec un contrôle d'accès unifié, un suivi de la traçabilité et la découverte.
    • MLflow pour les modèles
    • Gérez l'ensemble du cycle de vie ML, des expérimentations et des modèles à l'évaluation et au déploiement.
    • profilage des données
    • Surveiller la qualité des données, la performance des modèles et la drift de prédiction avec des alertes automatisées et une analyse des causes profondes.

Mettre en production les workflows ML

Faites monter en charge les Opérations Machine Learning avec des workflows automatisés, l'intégration CI/CD et des pipelines prêts pour la production.

    • Modèles dans Unity Catalog
    • Utilisez le registre de modèles dans Unity Catalog pour une gouvernance centralisée et pour gérer le cycle de vie du modèle, y compris les déploiements.
    • flux de travail MLOps
    • Découvrez les MLOps de bout en bout avec des pipelines d'entraînement, de test et de déploiement automatisés.