Pular para o conteúdo principal

Inferência hospedada pelo Databricks

Use o Unity Gateway para executar inferência em modelos proprietários de fronteira e de pesos abertos hospedados pelo Databricks. Escolha um modelo e a capacidade de serviço adequada à sua carga de trabalho.

Começar a consultar modelos.

Modelos disponíveis por meio do Databricks​

The following models are hosted by Databricks. Each model name Links to its specifications.

Os ativos de modelo em system.ai são listados globalmente. Ver um modelo lá não significa que ele esteja disponível no seu workspace. A disponibilidade depende da região do seu workspace, das configurações cross-geo e da disponibilidade do modelo. Verifique a interface de usuário do Unity Gateway para ver o serviço de modelo correspondente e confirme se você tem permissão para fazer uma query nele.

Listar um modelo não envia dados do cliente para ele para inferência. Consulte Disponibilidade do modelo por região para obter detalhes regionais.

importante

O DeepSeek V4 Flash (0731) está obsoleto e tem previsão de desativação em 5 de novembro de 2026. Consulte Modelos desativados e obsoletos para ver o modelo de substituição recomendado e orientações sobre como fazer a migração durante a descontinuação.

Para modelos descontinuados e substituições recomendadas, consulte Modelos descontinuados e aposentados.

Usar um modelo​

Sua tarefa

Como usar os modelos

Crie um aplicativo ou agente

Chame um modelo por meio da API do Unity Gateway. Serviços de modelo fornecidos pelo sistema em system.ai permitem começar sem criar um serviço de modelo personalizado. Consulte Query models.

Aplique IA aos seus dados

Use ai_query para enviar prompts para um modelo compatível de SQL, Notebooks ou pipelines em lotes. Consulte Usar ai_query.

Use um agente de programação

Conecte seu agente de programação aos modelos por meio do Unity Gateway. Consulte Agentes de codificação compatíveis.

Sua tarefa

Como usar os modelos

Crie um aplicativo ou agente

Chame um modelo por meio da API do Unity Gateway. Serviços de modelo fornecidos pelo sistema em system.ai permitem começar sem criar um serviço de modelo personalizado. Consulte Query models.

Aplique IA aos seus dados

Use ai_query para enviar prompts para um modelo compatível de SQL, Notebooks ou pipelines em lotes. Consulte Usar ai_query.

Use um agente de programação

Conecte seu agente de programação aos modelos por meio do Unity Gateway. Consulte Agentes de codificação compatíveis.

Os modelos suportados e os identificadores de modelo variam de acordo com a interface. Consulte os guias vinculados para ver os requisitos e exemplos.

Serviços de modelo fornecidos pelo sistema ​

O Databricks fornece serviços de modelo de pagamento por tokens prontos para uso em system.ai, como system.ai.claude-opus-5. Novos serviços são adicionados à medida que os modelos básicos ficam disponíveis.

  • Um usuário do sistema os possui e você não pode excluí-los.
  • Por default, apenas administradores do metastore podem modificá-los. Um administrador do metastore pode delegar o gerenciamento concedendo o privilégio MANAGE.

Para restringir o acesso, consulte Descobrir e governar o acesso a serviços de modelo.

Escolher capacidade de atendimento​

Opção

Recomendado para

Como funciona

Pagamento por token

Cargas de trabalho com uso variável ou intermitente.

Pague pelos tokens usados sem provisionar capacidade de atendimento dedicada.

Throughput provisionado sob demanda

Cargas de trabalho que precisam de capacidade dedicada com flexibilidade para ajustá-la à medida que os requisitos mudam.

Pague pela capacidade alocada sem compromisso de prazo.

Opção

Recomendado para

Como funciona

Pagamento por token

Cargas de trabalho com uso variável ou intermitente.

Pague pelos tokens usados sem provisionar capacidade de atendimento dedicada.

Throughput provisionado sob demanda

Cargas de trabalho que precisam de capacidade dedicada com flexibilidade para ajustá-la à medida que os requisitos mudam.

Pague pela capacidade alocada sem compromisso de prazo.

Os serviços de modelo do Unity Gateway podem direcionar o tráfego para destinos de throughput provisionado. Consulte a documentação de cada opção para verificar os modelos elegíveis e os requisitos de configuração.

Para inferência em lotes com ai_query, use a orientação sobre AI Functions para selecionar os modelos e as opções de disponibilização compatíveis. O suporte a modelos e regiões varia de acordo com a opção de disponibilização.

Conectar outros provedores de modelos​

Você também pode usar o Unity Gateway com sua própria account de provedor de modelo. Conecte o provedor de modelo e governe o acesso usando as credenciais da sua organização.

Consulte Conectar um provedor de modelo externo.

Informações relacionadas​