Aller au contenu principal

Créer et gérer des APIs de modèle (services de modèle)

Créez, partagez et gérez vos propres APIs de modèle (services de modèle) dans Unity Catalog.

astuce

Les APIs de modèle fournies par le système dans le schéma system.ai sont prêtes à être query sans aucune configuration. Créez votre propre API de modèle uniquement lorsque vous souhaitez gouverner des modèles supplémentaires ou exposer un endpoint personnalisé.

Exigences

  • Un Databricks workspace dans une région prise en charge par Unity AI Gateway.
  • Unity Catalog activé pour votre workspace. Consultez Activer un workspace pour Unity Catalog.
  • Pour créer un service de modèle, vous devez disposer des éléments suivants :
    • USE CATALOG, USE SCHEMA et CREATE SERVICE sur le catalogue et le schéma où vous créez le service de modèle.
    • EXECUTE sur chaque modèle que le service de modèle référence comme destination.
    • EXECUTE, USE CATALOG et USE SCHEMA sur chaque service de fournisseur de modèle que le service de modèle référence comme destination.
    • USE CATALOG, USE SCHEMA et CREATE TABLE sur le catalogue et le schéma où la table d'inférence est créée, si vous activez la journalisation de l'inférence.

Créer un service de modèle

Vous pouvez créer un service de modèle dans l’interface utilisateur de Unity AI Gateway ou dans Catalog Explorer, ou par programmation avec l’API REST, les SDK Databricks, la CLI Databricks ou Terraform.

Les services de modèle et les services de fournisseur de modèle partagent un espace de noms unique au sein d'un schéma Unity Catalog. Vous ne pouvez pas utiliser un nom pour un service de modèle si un service de fournisseur de modèle dans le schéma l'utilise déjà, et inversement.

  1. Effectuez l'une des actions suivantes :

    • Dans la barre latérale du Workspace, cliquez sur AI Gateway , puis sur Créer .
    • Dans l'Explorateur de catalogues, accédez au schéma dans lequel vous souhaitez créer le service de modèle, puis cliquez sur Créer > Service > Service de modèle .
  2. Saisissez un nom pour le service de modèle, et sélectionnez le catalogue et le schéma dans lequel le créer. Si vous start à partir de l'Explorateur de catalogue, l'Explorateur de catalogue préremplit le catalogue et le schéma.

  3. Sélectionnez la destination principale à servir. Cette destination peut être un modèle hébergé sur Databricks sur lequel vous avez EXECUTE et que Unity AI Gateway peut servir, ou un service de fournisseur de modèles sur lequel vous avez EXECUTE, USE CATALOG et USE SCHEMA.

  4. Cliquez sur Créer .

Après avoir créé le service de modèle, Databricks ouvre sa page d’aperçu, où vous pouvez commencer ou configurer des fonctionnalités supplémentaires telles que la journalisation de l’inférence.

Accorder l'accès à un service de modèle

Par default, seul le propriétaire du service de modèle peut effectuer une query dessus. Pour permettre à d'autres personnes d'effectuer une query sur un service de modèle, accordez-leur EXECUTE sur celui-ci, ainsi que USE CATALOG et USE SCHEMA sur son catalogue et son schéma. Si le service de modèle enregistre des logs dans une table d'inférence, accordez SELECT sur la table pour leur permettre de lire les requêtes et les réponses enregistrées.

  1. Ouvrez le service de modèle dans Catalog Explorer, ou accédez à AI Gateway et sélectionnez le service.
  2. Accédez à l'onglet tab .
  3. Cliquez sur Accorder .
  4. Sélectionnez les utilisateurs, les groupes ou les Service Principal auxquels accorder l'accès.
  5. Sélectionnez le privilège EXECUTE .
  6. Cliquez sur Accorder .

Pour en savoir plus sur l’octroi et la découverte d’accès, consultez Découvrir et gouverner l’accès aux APIs de modèle (services de modèle).

Configurer les fonctionnalités d'un service de modèle

Vous configurez des fonctionnalités telles que les limites de taux, la journalisation de l'inférence et les garde-fous sur le service de modèle à partir de l'interface utilisateur de Unity AI Gateway, de la même manière que vous les configurez sur un Endpoint Unity AI Gateway. Voir :

Journalisation des inférences

Lorsque vous activez la journalisation des inférences, Databricks crée une nouvelle table Unity Catalog vide avec un schéma prédéfini à l'emplacement que vous spécifiez. Notez ce qui suit :

  • Vous devez disposer de USE CATALOG, USE SCHEMA et CREATE TABLE sur le catalogue et le schéma cibles.
  • Le créateur du service de modèle est le propriétaire de la table d’inférence. Aucun autre utilisateur n’y a accès, sauf si vous l’y autorisez.
  • Si une table existe déjà à l'emplacement spécifié, la création du service de modèle échoue.
  • La table d’inférence a un cycle de vie indépendant du service de modèle. Si vous supprimez la table, le service de modèle continue de fonctionner mais arrête l'enregistrement.

Pour en savoir plus sur les tables d’inférence, consultez Logs les requêtes et les réponses dans des tables d’inférence.

Mettre à jour un service de modèle

Vous devez être propriétaire ou disposer de MANAGE.

Modifiez la configuration du service de modèle depuis l'interface utilisateur de Unity AI Gateway ou l'Explorateur de catalogues. Les modifications s’appliquent sur place.

Supprimer un service de modèle

Vous devez être propriétaire ou disposer de MANAGE. Les services de fournisseur de modèles fournis par le système dans system.ai ne peuvent pas être supprimés.

Ouvrez le service de modèle dans l’interface utilisateur Unity AI Gateway ou dans l’Explorateur de catalogues et sélectionnez Supprimer dans le menu kebab.

Étapes suivantes