Pular para o conteúdo principal

Disponibilidade de modelos por região

Verifique as tabelas para ver o suporte a modelos e famílias de modelos em cada região e opção de serving. Para procurar modelos por provedor, consulte os modelos disponíveis no Unity Gateway.

As tabelas descrevem o suporte a modelos. Para fazer uma query em um modelo por meio do Unity Gateway, verifique se há o serviço de modelo correspondente em seu workspace. A disponibilidade depende da região, das configurações de cross-Geo e da capacidade de serviço disponível. As permissões necessárias ainda se aplicam.

Modelos básicos hospedados no Databricks​

O Databricks hospeda modelos de base abertos de última geração. Estes modelos são disponibilizados usando as APIs do Foundation Model. Para restringir quais modelos de base hospedados pelo Databricks sua organização pode usar, consulte permissões do Unity Catalog para modelos de base.

A tabela a seguir resume quais famílias de modelos e modelos hospedados no Databricks são suportados em cada região com base no recurso de Model Serving.

importante
  • O Google Gemini 3 Flash está hospedado em endpoints globais e requer que o roteamento entre geografias esteja ativado para todas as regiões.

  • Google Gemini 2.5 Pro será desativado em 2 de outubro de 2026. Consulte Modelos descontinuados e desativados para ver o modelo de substituição recomendado e orientações sobre como migrar durante a descontinuação.

  • O Google Gemini 2.5 Flash está obsoleto e tem aposentadoria planejada para 2 de outubro de 2026. Consulte Modelos obsoletos e desativados para ver o modelo de substituição recomendado e orientações sobre como migrar durante a descontinuação.

  • O Anthropic Claude Sonnet 4 foi descontinuado. Consulte Modelos descontinuados e aposentados para saber a data de descontinuação, o modelo de substituição recomendado e as orientações sobre como fazer a migração durante a descontinuação.

  • Anthropic Claude 3.7 Sonnet não está mais disponível. Consulte Modelos descontinuados e desativados para ver o modelo de substituição recomendado e orientações sobre como migrar durante a descontinuação.

Região

APIs do Foundation Model pay-per-token

AI Functions (inferência em lotes)

Throughput de APIs do Foundation Model provisionamento

asia-northeast1

Não suportado

Não suportado

Não suportado

asia-south1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B⥂
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

asia-southeast1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B⥂
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

australia-southeast1

Não suportado

Não suportado

Não suportado

europe-west1

Não suportado

Não suportado

Não suportado

europe-west2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

europe-west3

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

northamerica-northeast1

Não suportado

Não suportado

Não suportado

us-central1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-east1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-east4

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-west1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-west4

Não suportado

Não suportado

Não suportado

Região

APIs do Foundation Model pay-per-token

AI Functions (inferência em lotes)

Throughput de APIs do Foundation Model provisionamento

asia-northeast1

Não suportado

Não suportado

Não suportado

asia-south1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B⥂
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

asia-southeast1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B⥂
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

australia-southeast1

Não suportado

Não suportado

Não suportado

europe-west1

Não suportado

Não suportado

Não suportado

europe-west2

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

europe-west3

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B⥂
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B⥂
  • Meta Llama 3.1⥂
  • GTE v1.5 (inglês)⥂
  • BGE v1.5 (inglês)⥂

northamerica-northeast1

Não suportado

Não suportado

Não suportado

us-central1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (versão prévia)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-east1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-east4

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-west1

Os seguintes modelos são compatíveis:

Os seguintes modelos são compatíveis:

As seguintes famílias de modelos são compatíveis com a inferência em tempo real:

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (inglês)
  • BGE v1.5 (inglês)

us-west4

Não suportado

Não suportado

Não suportado

⥂ Este modelo é compatível com base na disponibilidade de GPU e requer que o roteamento entre geografias esteja ativado.