Classification
Vous pouvez utiliser la Classification pour classer vos documents dans des catégories prédéfinies avec l'IA.
Exemples de classification :
- Classer les transcriptions d'appels clients par intention
- Classification des documents par type de contenu
- Classification des avis sur les produits par sentiment
La classification est construite sur la fonction d’IA ai_classify. La page **Agents** fournit une interface utilisateur pour classer rapidement les documents et le texte non structuré et itérer sur les champs de classification pour de meilleurs résultats.
Exigences
-
Un Workspace qui inclut les éléments suivants :
- Compute serverless activé. Consultez les exigences du compute Serverless.
- Unity Catalog activé. Consultez Activer un workspace pour Unity Catalog.
- Accès à une politique d'utilisation Serverless avec un budget non nul.
-
Cette fonction n'est disponible que dans certaines régions, consultez Disponibilité des fonctions IA.
-
Pour les Workspace avec le module complémentaire Sécurité et conformité améliorées,
- Consultez le support régional pour
ai_classifypour le standard de conformité approprié. - Consultez Gérer les préversions Databricks pour savoir comment l'activer sur votre Workspace.
- Consultez le support régional pour
-
Possibilité d'utiliser la fonction SQL
ai_classify. -
Données non structurées que vous souhaitez classer. Les données doivent se trouver dans un volume ou une table Unity Catalog.
- Pour créer votre agent, vous avez besoin d'au moins un document non étiqueté dans votre volume Unity Catalog ou d'une ligne dans votre table.
Créer un agent de classification
Accédez à **Agents** dans le volet de navigation de gauche de votre workspace. Cliquez sur Créer un agent , et sélectionnez Classification de texte .
Étape 1. Sélectionnez vos données source
Utilisez Classification pour classer vos documents.
-
Sélectionnez vos données source. Vous pouvez sélectionner un volume avec des documents ou une table avec des données textuelles.
-
Cliquez sur Créer l'agent .
Étape 2. Configurer les étiquettes de classification
Une fois que la Classification a traité vos données, configurez et affinez vos étiquettes de classification.
Pour ajouter manuellement des étiquettes de classification :
- Cliquez sur **+ Ajouter une étiquette** pour ajouter une étiquette de classification.
- Saisissez le nom de l'étiquette et une description facultative, puis cliquez sur Ajouter une étiquette .
- Répétez de 1 à 2 pour chaque étiquette que vous souhaitez ajouter.
- (Facultatif) Activez **Plusieurs étiquettes** si vous souhaitez que l'agent retourne plus d'une étiquette.
Pour importer des étiquettes à partir d'une table :
- Cliquez sur Importer depuis une table .
- Sélectionnez la table et cliquez sur Suivant .
- Sélectionnez la colonne d’étiquette, la colonne de description et le SQL Warehouse.
- Cliquez sur Aperçu pour voir les étiquettes importées.
- Si vous êtes satisfait des étiquettes, cliquez sur Importer et remplacer les étiquettes .
Vous devez avoir au moins deux étiquettes définies pour exécuter la classification. Après avoir fini d'ajouter vos étiquettes, cliquez sur Enregistrer et exécuter la classification .
La classification classe jusqu'à 5 documents et lignes et affiche les résultats. Vous pouvez en ajouter d'autres également.

Étape 3. Examiner et améliorer les réponses de classification
Examinez les réponses de classification et donnez votre avis pour améliorer l'agent.
-
Examinez le document et la réponse de classification :
- Si la réponse est correcte, donnez un pouce levé.
- Si la réponse est incorrecte, donnez-lui un pouce vers le bas. Aidez Classification à corriger la réponse en sélectionnant l'étiquette correcte. Cliquez sur Enregistrer .
-
Pour améliorer les réponses de l'agent, ajustez les descriptions des étiquettes de classification.
-
Comparez les versions pour optimiser les performances de l'agent. Cliquez sur Versions . À côté d'une version précédente, cliquez sur Comparer pour comparer les descriptions des étiquettes de classification d'une version précédente avec la version actuelle. Cliquez sur Restaurer pour restaurer une version précédente.
Étape 4. Utilisez l'agent de classification
Si vous êtes satisfait des réponses, start à utiliser l'agent pour la classification à grande échelle.
Cliquez sur Utiliser l'Agent en haut à droite. Vous pouvez choisir l'une des options suivantes :
- **Exécuter en SQL** pour utiliser l'agent afin de classer votre volume ou votre table entière. Cela ouvre une requête SQL qui utilise
ai_classifyà l’aide des étiquettes de classification que vous avez définies. Pour plus d'informations sur l'utilisation deai_classifydans les queries SQL, consultez la fonctionai_classify. - Create a LakeFlow pipeline qui s’exécute à intervalles planifiés pour appeler votre agent sur de nouvelles données. Ceci crée un LakeFlow pipeline qui met à jour une table en streaming avec vos données classifiées. Vous pouvez configurer le calendrier du pipeline afin qu'il s'exécute lorsque de nouvelles données arrivent. Pour plus d'information sur les LakeFlow Pipelines, consultez Spark Declarative Pipelines.
Limitations
Voir les limitations