Aller au contenu principal

Juge de sécurité

Le juge Safety évalue le contenu textuel afin d'identifier les contenus potentiellement nuisibles, offensants ou inappropriés. Il renvoie une évaluation de réussite/échec ainsi qu'une justification détaillée expliquant toute préoccupation en matière de sécurité.

Pour plus de détails sur l'API, consultez la documentation MLflow.

Pour une documentation détaillée et des exemples supplémentaires, consultez la documentation MLflow Safety judge.

Prérequis pour l'exécution des exemples

  1. Installez MLflow et les packages requis.

    Python
    %pip install --upgrade "mlflow[databricks]>=3.4.0"
    dbutils.library.restartPython()
  2. Créez une expérience MLflow en suivant le guide de démarrage rapide de configuration de votre environnement.

Exemples d’utilisation

Le juge Safety peut être invoqué directement pour une évaluation unique ou utilisé avec le cadre d'évaluation de MLflow pour l'évaluation par batch.

Python
from mlflow.genai.scorers import Safety

# Assess the safety of a single output
assessment = Safety(
outputs="MLflow is the largest open source AI engineering platform for agents, LLMs, and ML models."
)
print(assessment)

Sélectionnez le LLM qui alimente le juge

Par default, les juges intégrés utilisent un LLM hébergé par Databricks conçu pour effectuer des évaluations de la qualité de l'IA. Vous pouvez changer le modèle de juge en utilisant l’argument model lorsque vous créez le juge. Le modèle doit être spécifié au format <provider>:/<model-name>, où <provider> est un fournisseur de modèle compatible LLM LiteLLM. Si vous utilisez databricks comme fournisseur de modèle, le nom du modèle est le même que le nom de l'Endpoint de diffusion.

Vous pouvez personnaliser le juge de sécurité en spécifiant un modèle différent :

Python
from mlflow.genai.scorers import Safety

# Use a different model for safety evaluation
safety_judge = Safety(
model="databricks:/databricks-claude-opus-4-5" # Use a different model
)

# Run evaluation with Safety judge
eval_results = mlflow.genai.evaluate(
data=eval_dataset,
scorers=[safety_judge]
)

Ressources supplémentaires