Aller au contenu principal

Query avec l’OpenAI Responses API

important

L'API OpenAI Responses décrite dans cet article est un passe-plat natif pour les modèles de base OpenAI payants par jeton et les modèles externes, et prend en charge l'ensemble complet des paramètres et outils de l'API OpenAI Responses. Pour une API de réponses unifiée pour Anthropic Claude, Google Gemini et les modèles ouverts hébergés par Databricks, consultez Interroger un modèle avec l'API OpenAI Responses. L'API d'achèvement du chat est également disponible chez tous les fournisseurs.

L'OpenAI Responses API est une alternative à l'API Chat Completions qui offre des fonctionnalités supplémentaires pour les modèles OpenAI, notamment des outils personnalisés et des workflows en plusieurs étapes.

Exigences

Exemples de query

Les exemples de cette section montrent comment interroger un Endpoint d'API de modèle de fondation à paiement par jeton à l'aide de l'OpenAI Responses API.

Pour utiliser l'OpenAI Responses API, spécifiez le nom de l'Endpoint de service de modèle comme entrée model.

Python
from databricks_openai import DatabricksOpenAI

client = DatabricksOpenAI()

response = client.responses.create(
model="databricks-gpt-5",
input=[
{
"role": "system",
"content": "You are a helpful assistant."
},
{
"role": "user",
"content": "What is a mixture of experts model?",
}
],
max_output_tokens=256
)

Outils personnalisés

Les outils personnalisés permettent au modèle de renvoyer une sortie de chaîne arbitraire au lieu d'arguments de fonction formatés en JSON. Ceci est utile pour la génération de code, l'application de correctifs ou d'autres cas d'utilisation où le JSON structuré n'est pas requis.

remarque

Les outils personnalisés ne sont pris en charge qu'avec les modèles de la série GPT-5 (databricks-gpt-5, databricks-gpt-5-1, databricks-gpt-5-2, databricks-gpt-5-4, databricks-gpt-5-5, databricks-gpt-5-5-pro) via l'API de réponses.

Python
from databricks_openai import DatabricksOpenAI

client = DatabricksOpenAI()

response = client.responses.create(
model="databricks-gpt-5",
input=[{"role": "user", "content": "Write a Python function to calculate factorial"}],
tools=[
{
"type": "custom",
"name": "code_exec",
"description": "Executes arbitrary Python code. Return only valid Python code."
}
],
max_output_tokens=1024
)

Outils intégrés

Les outils intégrés permettent au modèle d'appeler les capacités fournies par la plateforme sans que vous ayez à implémenter vous-même le backend de l'outil. Ces outils renvoient des sorties structurées et sont entièrement managés par la plateforme.

Python
from databricks_openai import DatabricksOpenAI

client = DatabricksOpenAI()

response = client.responses.create(
model="databricks-gpt-5",
input=[{
"role": "user",
"content": "Add input validation to the factorial function in main.py."
}],
tools=[
{
"type": "apply_patch"
}
],
max_output_tokens=1024
)

print(response.output_text)

Modèles pris en charge

Modèles de fondation hébergés par Databricks

  • databricks-gpt-5-6-sol
  • databricks-gpt-5-6-terra
  • databricks-gpt-5-6-luna
  • databricks-gpt-5-5-pro
  • databricks-gpt-5-5
  • databricks-gpt-5-4
  • databricks-gpt-5-4-mini
  • databricks-gpt-5-4-nano
  • databricks-gpt-5-3-codex
  • databricks-gpt-5-2
  • databricks-gpt-5-1
  • databricks-gpt-5
  • databricks-gpt-5-mini
  • databricks-gpt-5-nano

Modèles externes

  • Fournisseur de modèles OpenAI
  • Fournisseur de modèle Azure OpenAI

Types d'entrée pris en charge

Les modèles GPT OpenAI sur Databricks acceptent les entrées de texte et d'image. Consultez les modèles de vision par query pour connaître les exigences de format et de taille d'image. Pour les types d'entrée par modèle, consultez les modèles de fondation hébergés par Databricks disponibles dans les API de modèle de fondation.

Limitations

Les limitations suivantes s'appliquent uniquement aux modèles de fondation avec paiement par jeton. Les modèles externes prennent en charge tous les paramètres d'API et les outils des réponses.

Les paramètres suivants ne sont pas pris en charge et renvoient une erreur 400 s'ils sont spécifiés :

  • background — Le traitement en arrière-plan n'est pas pris en charge.
  • store — Les réponses stockées ne sont pas prises en charge.
  • previous_response_id — Les réponses stockées ne sont pas prises en charge.
  • service_tier — La sélection du niveau de service est gérée par Databricks.

Les types d'outils suivants sont pris en charge pour les modèles de fondation pay-per-token :

  • function — Appel de fonction structuré traditionnel
  • custom — Outils personnalisés définis par l'utilisateur
  • apply_patch — Opérations de correction du code
  • shell — Exécution de commande Shell
  • image_generation — Génération d'images
  • mcp — Outils Model Context Protocol
  • web_search — Recherche web

Ressources supplémentaires