Aller au contenu principal

Disponibilité des modèles par région

Vérifiez les tables pour la prise en charge des modèles et des familles de modèles dans chaque région et option de serving. Pour parcourir les modèles par fournisseur, consultez les modèles disponibles dans Unity Gateway.

Les tables décrivent la prise en charge des modèles. Pour effectuer une query sur un modèle via Unity Gateway, vérifiez la présence du service de modèle correspondant dans votre Workspace. La disponibilité dépend de la région, des paramètres inter-géo et de la capacité de service disponible. Les autorisations requises s’appliquent toujours.

Modèles de base hébergés sur Databricks​

Databricks héberge des modèles de fondation ouverts de pointe. Ces modèles sont mis à disposition à l'aide de Foundation Model APIs. Pour restreindre les modèles de fondation hébergés par Databricks que votre organisation peut utiliser, consultez les autorisations Unity Catalog pour les modèles de fondation.

Le tableau suivant résume les modèles et familles de modèles hébergés par Databricks pris en charge dans chaque région en fonction de la fonctionnalité Model Serving.

important
  • Google Gemini 3 Flash est hébergé sur des endpoints globaux et nécessite l’activation du routage inter-régions pour chaque région.

  • Meta Llama 4 Maverick est disponible pour les workloads de throughput provisionné des API de modèles de fondation en aperçu public.

  • Google Gemini 2.5 Flash et Pro sont obsolètes et leur retrait est prévu pour le 2 octobre 2026. Consultez la page Modèles obsolètes et retirés pour connaître le modèle de remplacement recommandé et obtenir des conseils sur la migration pendant la période d’obsolescence.

  • Anthropic Claude Sonnet 4 est obsolète et son retrait est prévu pour le 9 octobre 2026. Consultez Modèles obsolètes et retirés pour connaître sa date de retrait, le modèle de remplacement recommandé et les instructions de migration lors de l’obsolescence.

  • Anthropic Claude 3.7 Sonnet n'est plus disponible. Consultez Modèles dépréciés et retirés pour connaître le modèle de remplacement recommandé et obtenir des conseils sur la migration lors de la dépréciation.

  • Plusieurs anciennes familles de modèles ont été retirées. Consultez la page Modèles obsolètes et retirés pour obtenir la liste complète des modèles retirés et des remplacements recommandés.

Région

Foundation Model APIs pay-per-token

AI Functions (inférence par batch)

APIs de Foundation Model avec throughput provisionné

ap-northeast-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (preview)
    • Meta Llama 4 Maverick (aperçu)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (English)
    • BGE v1.5 (anglais)

ap-northeast-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Meta Llama 4 Maverick (aperçu)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (English)
    • BGE v1.5 (anglais)

ap-south-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (preview)
    • Meta Llama 4 Maverick (aperçu)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (English)
    • BGE v1.5 (anglais)

ap-southeast-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

ap-southeast-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

ca-central-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-central-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (preview)

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-west-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (preview)

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-west-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-west-3

Non pris en charge

Non pris en charge

Non pris en charge

sa-east-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

us-east-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (aperçu)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-east-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (aperçu)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-gov-west-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Non pris en charge

us-west-1

Non pris en charge

Non pris en charge

Non pris en charge

us-west-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (preview)
  • Meta Llama 4 Maverick (aperçu)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

Région

Foundation Model APIs pay-per-token

AI Functions (inférence par batch)

APIs de Foundation Model avec throughput provisionné

ap-northeast-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (preview)
    • Meta Llama 4 Maverick (aperçu)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (English)
    • BGE v1.5 (anglais)

ap-northeast-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Meta Llama 4 Maverick (aperçu)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (English)
    • BGE v1.5 (anglais)

ap-south-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (preview)
    • Meta Llama 4 Maverick (aperçu)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (English)
    • BGE v1.5 (anglais)

ap-southeast-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

ap-southeast-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

ca-central-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-central-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (preview)

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-west-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Alibaba Cloud Qwen3.5 122B A10B (preview)

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-west-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

eu-west-3

Non pris en charge

Non pris en charge

Non pris en charge

sa-east-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

  • Les familles de modèles suivantes sont prises en charge et optimisées pour l’inférence par batch :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B⥂

  • OpenAI GPT OSS 20B

  • Google Gemma 3 12B

  • Meta Llama 4 Maverick (aperçu)

  • Meta Llama 3.3

  • Meta Llama 3.2 3B

  • Meta Llama 3.2 1B

  • Meta Llama 3.1

  • GTE v1.5 (English)

  • BGE v1.5 (anglais)

us-east-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (aperçu)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-east-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge pour l’inférence en temps réel :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Meta Llama 4 Maverick (aperçu)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

us-gov-west-1

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Non pris en charge

us-west-1

Non pris en charge

Non pris en charge

Non pris en charge

us-west-2

Les modèles suivants sont pris en charge :

Les modèles suivants sont pris en charge :

Les familles de modèles suivantes sont prises en charge :

  • OpenAI GPT OSS 120B
  • OpenAI GPT OSS 20B
  • Google Gemma 3 12B
  • Alibaba Cloud Qwen3.5 122B A10B (preview)
  • Meta Llama 4 Maverick (aperçu)
  • Meta Llama 3.3
  • Meta Llama 3.2 3B
  • Meta Llama 3.2 1B
  • Meta Llama 3.1
  • GTE v1.5 (English)
  • BGE v1.5 (anglais)

⥂ Ce modèle est pris en charge en fonction de la disponibilité du GPU et nécessite que le routage inter-régions soit activé.