Pular para o conteúdo principal

Receitas de observabilidade de agentes

Receitas de ponta a ponta para tarefas comuns de observabilidade e qualidade de agentes — conecte seu agente de código, avalie-o e melhore-o.

Conecte seu agente de codificação

Dê ao seu agente de programação conhecimento das APIs do MLflow e acesso em tempo real aos seus rastreamentos, para que ele escreva uma instrumentação precisa e responda a perguntas sobre o seu agente diretamente da sua IDE.

Avaliar e melhorar

Avalie o seu agente com base nos seus próprios critérios, desde uma rápida simulação de ponta a ponta até juízes de LLM dedicados.

    • Avaliar e aprimorar um agente
    • Execute mlflow.genai.evaluate() em um conjunto de dados de avaliação para pontuar um agente de ponta a ponta e comparar versões.
    • Criar um juiz de LLM de diretrizes
    • Transforme critérios de linguagem natural de aprovação/reprovação em um avaliador — sem necessidade de código de avaliação.
    • Criar um juiz personalizado
    • Crie um juiz especializado com make_judge(), incluindo juízes baseados em rastreamento que analisam a execução.