Inferência hospedada pelo Databricks
Use o Unity Gateway para executar inferência em modelos proprietários de fronteira e de pesos abertos hospedados pelo Databricks. Escolha um modelo e a capacidade de serviço adequada à sua carga de trabalho.
Modelos disponíveis por meio do Databricks
The following models are hosted by Databricks. Each model name Links to its specifications.
Os ativos de modelo em system.ai são listados globalmente. Ver um modelo lá não significa que ele esteja disponível no seu workspace. A disponibilidade depende da região do seu workspace, das configurações cross-geo e da disponibilidade do modelo. Verifique a interface de usuário do Unity Gateway para ver o serviço de modelo correspondente e confirme se você tem permissão para fazer uma query nele.
Listar um modelo não envia dados do cliente para ele para inferência. Consulte Disponibilidade do modelo por região para obter detalhes regionais.
O DeepSeek V4 Flash (0731) está obsoleto e tem previsão de desativação em 5 de novembro de 2026. Consulte Modelos desativados e obsoletos para ver o modelo de substituição recomendado e orientações sobre como fazer a migração durante a descontinuação.
Provedor | Família de modelos | Modelos |
|---|---|---|
Anthropic | Claude Haiku | |
Anthropic | Claude Sonnet | Claude Sonnet 5.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5 |
Anthropic | Claude Fable | |
Anthropic | Claude Opus | Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Opus 4.1 |
OpenAI | GPT | GPT-6 Astra, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna, GPT-5.5 Pro, GPT-5.5, GPT-5.4, GPT-5.4 mini, GPT-5.4 nano, GPT-5.2, GPT-5.1, GPT-5, GPT-5 mini, GPT-5 nano |
OpenAI | GPT Codex | |
OpenAI | GPT OSS | |
Gemini Flash | Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite, Gemini 3 Flash | |
Gemini Pro | ||
Geração de imagens do Gemini | ||
Gemma | ||
Meta | Llama | |
Alibaba Cloud | Qwen | OpenJev (Qwen3.5 4B), Qwen3.5 122B A10B, Qwen3-Embedding-0.6B, Qwen3-Next 80B A3B Instruct |
xAI | Grok | |
Moonshot AI | Kimi | |
Zhipu AI | GLM | |
DeepSeek | DeepSeek | |
Thinking Machine Labs | Inkling | |
Alibaba | GTE |
Para modelos descontinuados e substituições recomendadas, consulte Modelos descontinuados e aposentados.
Usar um modelo
Sua tarefa | Como usar os modelos |
|---|---|
Crie um aplicativo ou agente | Chame um modelo por meio da API do Unity Gateway. Serviços de modelo fornecidos pelo sistema em |
Aplique IA aos seus dados | Use |
Use um agente de programação | Conecte seu agente de programação aos modelos por meio do Unity Gateway. Consulte Agentes de codificação compatíveis. |
Os modelos suportados e os identificadores de modelo variam de acordo com a interface. Consulte os guias vinculados para ver os requisitos e exemplos.
Serviços de modelo fornecidos pelo sistema
O Databricks fornece serviços de modelo de pagamento por tokens prontos para uso em system.ai, como system.ai.claude-opus-5. Novos serviços são adicionados à medida que os modelos básicos ficam disponíveis.
- Um usuário do sistema os possui e você não pode excluí-los.
- Por default, apenas administradores do metastore podem modificá-los. Um administrador do metastore pode delegar o gerenciamento concedendo o privilégio
MANAGE.
Para restringir o acesso, consulte Descobrir e governar o acesso a serviços de modelo.
Escolher capacidade de atendimento
Opção | Recomendado para | Como funciona |
|---|---|---|
Pagamento por token | Cargas de trabalho com uso variável ou intermitente. | Pague pelos tokens usados sem provisionar capacidade de atendimento dedicada. |
Cargas de trabalho que precisam de capacidade dedicada com flexibilidade para ajustá-la à medida que os requisitos mudam. | Pague pela capacidade alocada sem compromisso de prazo. |
Os serviços de modelo do Unity Gateway podem direcionar o tráfego para destinos de throughput provisionado. Consulte a documentação de cada opção para verificar os modelos elegíveis e os requisitos de configuração.
Para inferência em lotes com ai_query, use a orientação sobre AI Functions para selecionar os modelos e as opções de disponibilização compatíveis. O suporte a modelos e regiões varia de acordo com a opção de disponibilização.
Conectar outros provedores de modelos
Você também pode usar o Unity Gateway com sua própria account de provedor de modelo. Conecte o provedor de modelo e governe o acesso usando as credenciais da sua organização.
Consulte Conectar um provedor de modelo externo.