Aller au contenu principal

Disponibilité des modèles par région

Vérifiez les tables pour la prise en charge des modèles et des familles de modèles dans chaque région et option de serving. Pour parcourir les modèles par fournisseur, consultez les modèles disponibles dans Unity Gateway.

Les tables décrivent la prise en charge des modèles. Pour effectuer une query sur un modèle via Unity Gateway, vérifiez la présence du service de modèle correspondant dans votre Workspace. La disponibilité dépend de la région, des paramètres inter-géo et de la capacité de service disponible. Les autorisations requises s’appliquent toujours.

Modèles de fondation hébergés sur Databricks​

Databricks héberge des modèles de fondation ouverts de pointe. Ces modèles sont mis à disposition à l'aide de Foundation Model APIs. Pour restreindre les modèles de fondation hébergés par Databricks que votre organisation peut utiliser, consultez les autorisations Unity Catalog pour les modèles de fondation.

Le tableau suivant résume les modèles hébergés par Databricks et les familles de modèles pris en charge dans chaque région en fonction de la fonctionnalité Model Serving.

important
  • Google Gemini 3 Flash est hébergé sur des endpoints globaux et nécessite l’activation du routage inter-régions pour chaque région.

  • Google Gemini 2.5 Pro sera retiré le 2 octobre 2026. Consultez Modèles obsolètes et retirés pour connaître le modèle de remplacement recommandé et les conseils sur la manière d'effectuer la migration lors de l'obsolescence.

  • Google Gemini 2.5 Flash est obsolète et son retrait est prévu pour le 2 octobre 2026. Consultez la page Modèles obsolètes et retirés pour connaître le modèle de remplacement recommandé et obtenir des conseils sur la migration lors de l’obsolescence.

  • Anthropic Claude Sonnet 4 est déprécié. Consultez Modèles dépréciés et retirés pour connaître sa date de retrait, le modèle de remplacement recommandé et les conseils sur la manière de migrer lors de la dépréciation.

  • Anthropic Claude 3.7 Sonnet n'est plus disponible. Consultez Modèles dépréciés et retirés pour connaître le modèle de remplacement recommandé et obtenir des conseils sur la migration lors de la dépréciation.

Région

Foundation Model APIs pay-per-token

AI Functions (inférence par batch)

APIs de Foundation Model avec throughput provisionné

asia-northeast1

Non pris en charge

Non pris en charge

Non pris en charge

asia-south1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

asia-southeast1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

australia-southeast1

Non pris en charge

Non pris en charge

Non pris en charge

europe-west1

Non pris en charge

Non pris en charge

Non pris en charge

europe-west2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

europe-west3

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

northamerica-northeast1

Non pris en charge

Non pris en charge

Non pris en charge

us-central1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-east1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-east4

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-west1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-west4

Non pris en charge

Non pris en charge

Non pris en charge

Région

Foundation Model APIs pay-per-token

AI Functions (inférence par batch)

APIs de Foundation Model avec throughput provisionné

asia-northeast1

Non pris en charge

Non pris en charge

Non pris en charge

asia-south1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

asia-southeast1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

australia-southeast1

Non pris en charge

Non pris en charge

Non pris en charge

europe-west1

Non pris en charge

Non pris en charge

Non pris en charge

europe-west2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

europe-west3

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B⥂
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (anglais)⥂
  • BGE v1.5 (anglais)⥂

northamerica-northeast1

Non pris en charge

Non pris en charge

Non pris en charge

us-central1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (preview)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-east1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-east4

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-west1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-west4

Non pris en charge

Non pris en charge

Non pris en charge

⥂ Ce modèle est pris en charge en fonction de la disponibilité du GPU et nécessite que le routage inter-régions soit activé.