Pular para o conteúdo principal

Disponibilidade de modelos por região

Verifique as tabelas para ver o suporte a modelos e famílias de modelos em cada região e opção de serving. Para procurar modelos por provedor, consulte os modelos disponíveis no Unity Gateway.

As tabelas descrevem o suporte a modelos. Para fazer uma query em um modelo por meio do Unity Gateway, verifique se há o serviço de modelo correspondente em seu workspace. A disponibilidade depende da região, das configurações de cross-Geo e da capacidade de serviço disponível. As permissões necessárias ainda se aplicam.

Modelos de fundação hospedados no Databricks​

O Databricks hospeda modelos de base abertos de última geração. Estes modelos são disponibilizados usando as APIs do Foundation Model. Para restringir quais modelos de base hospedados pelo Databricks sua organização pode usar, consulte permissões do Unity Catalog para modelos de base.

A tabela a seguir resume quais modelos e famílias de modelos hospedados no Databricks são compatíveis em cada região com base no recurso de Model Serving.

importante
  • O Google Gemini 3 Flash está hospedado em endpoints globais e requer que o roteamento entre geografias esteja ativado para todas as regiões.

  • O Meta Llama 4 Maverick está disponível para cargas de trabalho de throughput provisionada de APIs do Foundation Model em Visualização Pública.

  • Google Gemini 2.5 Flash and Pro are deprecated and are planned for retirement on October 2, 2026. Consulte Modelos obsoletos e descontinuados para ver o modelo de substituição recomendado e orientações sobre como migrar durante a descontinuação.

  • O Claude Sonnet 4 da Anthropic está descontinuado e tem previsão de encerramento para 9 de outubro de 2026. Consulte Modelos descontinuados e encerrados para ver a data de encerramento, o modelo de substituição recomendado e orientações sobre como migrar durante a descontinuação.

  • Anthropic Claude 3.7 Sonnet não está mais disponível. Consulte Modelos descontinuados e desativados para ver o modelo de substituição recomendado e orientações sobre como migrar durante a descontinuação.

  • Várias famílias de modelos mais antigas foram descontinuadas. Consulte Modelos preteridos e descontinuados para ver a lista completa de modelos descontinuados e as substituições recomendadas.

Região

APIs do Foundation Model pay-per-token

AI Functions (inferência em lotes)

Throughput de APIs do Foundation Model provisionamento

ap-northeast-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
    • Meta Llama 4 Maverick⥂ (preview)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglês)
    • BGE v1.5 (inglês)

ap-northeast-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Meta Llama 4 Maverick⥂ (preview)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglês)
    • BGE v1.5 (inglês)

ap-south-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B⥂
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
    • Meta Llama 4 Maverick⥂ (preview)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1
    • GTE v1.5 (inglês)
    • BGE v1.5 (inglês)

ap-southeast-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B⥂

  • Meta Llama 4 Maverick⥂ (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B⥂

  • Meta Llama 4 Maverick⥂ (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

ap-southeast-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B⥂

  • Meta Llama 4 Maverick⥂ (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick⥂ (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

ca-central-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-central-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-west-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-west-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-west-3

Não suportado

Não suportado

Não suportado

sa-east-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

us-east-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-east-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-gov-west-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

Não suportado

us-west-1

Não suportado

Não suportado

Não suportado

us-west-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
  • Meta Llama 4 Maverick (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

Região

APIs do Foundation Model pay-per-token

AI Functions (inferência em lotes)

Throughput de APIs do Foundation Model provisionamento

ap-northeast-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
    • Meta Llama 4 Maverick⥂ (preview)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglês)
    • BGE v1.5 (inglês)

ap-northeast-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Meta Llama 4 Maverick⥂ (preview)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglês)
    • BGE v1.5 (inglês)

ap-south-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B⥂
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
    • Meta Llama 4 Maverick⥂ (preview)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1
    • GTE v1.5 (inglês)
    • BGE v1.5 (inglês)

ap-southeast-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B⥂

  • Meta Llama 4 Maverick⥂ (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B⥂

  • Meta Llama 4 Maverick⥂ (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

ap-southeast-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B⥂

  • Meta Llama 4 Maverick⥂ (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick⥂ (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

ca-central-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-central-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-west-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-west-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

eu-west-3

Não suportado

Não suportado

Não suportado

sa-east-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

  • As seguintes famílias de modelos são compatíveis e otimizadas para inferência em lotes:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B⥂

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (preview)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (inglês)

  • BGE v1.5 (inglês)

us-east-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-east-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-gov-west-1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

Não suportado

us-west-1

Não suportado

Não suportado

Não suportado

us-west-2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
  • Meta Llama 4 Maverick (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

⥂ Este modelo é compatível com base na disponibilidade de GPU e requer que o roteamento entre geografias esteja ativado.