Pular para o conteúdo principal

Criar e gerenciar APIs de modelo (serviços de modelo)

Crie, compartilhe e gerencie suas próprias APIs de modelo (serviços de modelo) no Unity Catalog.

dica

As APIs de modelo fornecidas pelo sistema no esquema system.ai estão prontas para query sem necessidade de configuração. Crie sua própria API de modelo apenas quando desejar governar modelos adicionais ou expor um endpoint personalizado.

Requisitos

  • Um workspace do Databricks em uma região com suporte ao Unity Gateway.
  • Unity Catalog habilitado para seu workspace. Consulte Ativar um workspace para o Unity Catalog.
  • Para criar um serviço de modelo, você deve ter:
    • USE CATALOG, USE SCHEMA e CREATE SERVICE no catálogo e esquema onde você cria o serviço de modelo.
    • EXECUTE em cada modelo que o serviço de modelo referencia como destino.
    • EXECUTE, USE CATALOG e USE SCHEMA em cada serviço de provedor de modelo que o serviço de modelo referencia como destino.
    • USE CATALOG, USE SCHEMA, e CREATE TABLE no catálogo e esquema onde a tabela de inferência é criada, se você habilitar o log de inferência.

Criar um serviço de modelo

Crie um serviço de modelo na interface de usuário do Unity Gateway ou no Explorador de Catálogos. Para criar um programaticamente, use a API REST, os Databricks SDKs, a CLI do Databricks, o Terraform ou os Declarative Automation Bundles (DABs).

Os serviços de modelo e os serviços de provedor de modelo compartilham um único namespace de nome dentro de um esquema do Unity Catalog. Não é possível usar um nome para um serviço de modelo se um serviço de provedor de modelo no esquema já o usa, e vice-versa.

  1. Siga um destes procedimentos:

    • Na barra lateral do workspace, clique em AI Gateway e, em seguida, em Criar .
    • No Catalog Explorer, vá para o esquema onde você deseja criar o serviço de modelo e, em seguida, clique em **Criar** > **Serviço** > **Serviço de modelo**.
  2. Insira um nome para o serviço de modelo e selecione o catálogo e o esquema para criá-lo. Se você começar do Catalog Explorer, o Catalog Explorer preencherá automaticamente o catálogo e o esquema.

  3. Selecione o destino principal para atender. Este destino pode ser um modelo hospedado no Databricks no qual você tem EXECUTE e que o Unity Gateway pode atender, ou um serviço de provedor de modelo no qual você tem EXECUTE, USE CATALOG e USE SCHEMA.

  4. Clique em Criar .

Após criar o serviço de modelo, o Databricks abrirá sua página de visão geral, onde você poderá começar ou configurar recursos adicionais, como o registro de inferência.

Conceda acesso a um serviço de modelo

Por default, apenas o proprietário do serviço de modelo pode fazer query nele. Para permitir que outros façam query em um serviço de modelo, conceda a eles EXECUTE nele, além de USE CATALOG e USE SCHEMA no catálogo e no esquema correspondentes. Se o serviço de modelo fizer Logs em uma tabela de inferência, conceda SELECT na tabela para permitir que eles leiam as solicitações e respostas registradas.

  1. Abra o serviço de modelo no Catalog Explorer ou vá para o AI Gateway e selecione o serviço.
  2. Vá para a tab Permissões.
  3. Clique em Conceder .
  4. Selecione os usuários, grupos ou Service Principal aos quais deseja conceder acesso.
  5. Selecione o privilégio EXECUTE .
  6. Clique em Conceder .

Para saber mais sobre como conceder e descobrir acesso, consulte Descobrir e governar o acesso a APIs de modelo (serviços de modelo).

Configurar recursos em um serviço de modelo

Você configura recursos como limites de taxa, log de inferência e guardrails no serviço de modelo a partir da interface do usuário do Unity Gateway, da mesma forma que os configura em um endpoint do Unity Gateway. Consulte:

Log de inferência

Ao habilitar o registro de inferência, a Databricks cria uma nova tabela vazia do Unity Catalog com um esquema predefinido no local que você especificar. Observe o seguinte:

  • Você deve ter USE CATALOG, USE SCHEMA e CREATE TABLE no catálogo e esquema de destino.
  • O criador do serviço de modelo é o proprietário da tabela de inferência. Nenhum outro usuário tem acesso, a menos que você o conceda.
  • Se uma tabela já existir no local especificado, a criação do serviço de modelo falhará.
  • A tabela de inferência tem um ciclo de vida independente do serviço de modelo. Se você remover a tabela, o serviço de modelo continua funcionando, mas para de registrar.

Para saber mais sobre tabelas de inferência, consulte Logs solicitações e respostas em tabelas de inferência.

Atualizar um serviço de modelo

Você deve ser um proprietário ou ter MANAGE.

Edite a configuração do serviço de modelo a partir da interface do usuário do Unity Gateway ou do Explorador de Catálogos. As alterações são aplicadas no local.

Excluir um Serviço de Modelo

Você deve ser um proprietário ou ter MANAGE. Os serviços de modelo fornecidos pelo sistema em system.ai não podem ser excluídos.

Abra o serviço de modelo na interface do Unity Gateway ou no Explorador de Catálogos e selecione Excluir no menu kebab.

Próximos os passos