Databricksホスト型推論
Unity Gatewayを使用して、Databricksがホストする最先端の独自モデルおよびオープンウェイトモデルで推論をランします。ワークロードに適したモデルとサービング容量を選択します。
Databricksで利用可能なモデル
以下のモデルはDatabricksによってホストされています。各モデル名は、その仕様へのLinkです。
system.aiのモデルアセットはグローバルに一覧表示されます。そこにモデルが表示されていても、ワークスペースで利用できるとは限りません。利用可能性は、ワークスペースのリージョン、クロスジオ設定、およびモデルの可用性によって異なります。Unity Gateway UIで対応するモデルサービスを確認し、クエリーを実行する権限があることを確認してください。
モデルを一覧表示しても、推論のために顧客データがそれに送信されることはありません。地域別の詳細については、リージョン別のモデルの可用性を参照してください。
DeepSeek V4 Flash (0731) は非推奨となり、2026年11月5日に廃止される予定です。推奨される代替モデルと廃止期間中の移行方法に関するガイダンスについては、非推奨および廃止されたモデルを参照してください。
プロバイダー | モデルファミリー | モデル |
|---|---|---|
Anthropic | Claude Haiku | |
Anthropic | Claude Sonnet | Claude Sonnet 5.5、Claude Sonnet 5、Claude Sonnet 4.6、Claude Sonnet 4.5 |
Anthropic | Claude Fable | |
Anthropic | Claude Opus | Claude Opus 5、Claude Opus 4.8、Claude Opus 4.7、Claude Opus 4.6、Claude Opus 4.5、Claude Opus 4.1 |
OpenAI | GPT | GPT-6 Astra、GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna、GPT-5.5 Pro、GPT-5.5、GPT-5.4、GPT-5.4 mini、GPT-5.4 nano、GPT-5.2、GPT-5.1、GPT-5、GPT-5 mini、GPT-5 nano |
OpenAI | GPT Codex | |
OpenAI | GPT OSS | |
Gemini Flash | Gemini 3.8 Flash、Gemini 3.7 Flash、Gemini 3.6 Flash、Gemini 3.5 Flash、Gemini 3.5 Flash Lite、Gemini 3.1 Flash Lite、Gemini 3 Flash | |
Gemini Pro | ||
Geminiの画像生成 | ||
Gemini画像生成 | ||
meta | Llama | |
Alibaba Cloud | Qwen | OpenJev (Qwen3.5 4B), Qwen3.5 122B A10B, Qwen3-Embedding-0.6B,Qwen3-Next 80B A3B Instruct |
xAI | Grok | |
Moonshot AI | Kimi | |
Zhipu AI | GLM | |
DeepSeek | DeepSeek | |
Thinking Machine Labs | Inkling | |
Alibaba | GTE |
非推奨モデルおよび推奨される代替モデルについては、非推奨および廃止されたモデルを参照してください。
モデルの使用
タスク | モデルの使用方法 |
|---|---|
アプリケーションまたはエージェントの構築 | Unity Gateway API を介してモデルを呼び出します。 |
データへのAIの適用 | SQL、ノートブック、またはバッチパイプラインからサポートされているモデルにプロンプトを送信するには、 |
コーディングエージェントを使用する | Unity Gatewayを介してコーディングエージェントをモデルに接続します。「サポートされているコーディングエージェント」を参照してください。 |
サポートされるモデルとモデル識別子はインターフェースによって異なります。要件と例については、リンクされているガイドを参照してください。
システム提供のモデルサービス
Databricks は、system.ai において、system.ai.claude-opus-5 などのすぐに使えるトークン単位の従量課金モデルサービスを提供します。基盤モデルが利用可能になると、新しいサービスが追加されます。
- システムユーザーが所有しており、削除することはできません。
- By default、メタストア管理者のみがこれらを変更できます。メタストア管理者は、
MANAGE権限を付与することで管理を委任できます。
アクセスを制限するには、モデルサービスのアクセスの検出とガバナンスを参照してください。
サービングキャパシティの選択
オプション | ~向けに推奨 | 仕組み |
|---|---|---|
トークンごとの従量課金制 | 変動または間欠的な使用状況を持つワークロード。 | 専用のサービング容量をプロビジョニングすることなく、使用したトークンの料金を支払います。 |
要件の変化に合わせて調整できる柔軟性と専用の容量を必要とするワークロード。 | 割り当てられた容量に対して、期間契約なしでお支払いいただけます。 |
Unity Gateway モデルサービスは、provisioned-throughput 送信先にルーティングできます。対象となるモデルとセットアップ要件については、各オプションのドキュメントを参照してください。
ai_query のバッチ推論では、AI Functions のガイダンスを使用して、サポートされているモデルとサービングオプションを選択してください。モデルとリージョンのサポートは、サービングオプションによって異なります。
他のモデルプロバイダーを接続する
独自のモデルプロバイダーアカウントで Unity Gateway を使用することもできます。モデルプロバイダーを接続し、組織の認証情報を使用してアクセスを管理します。
外部モデル プロバイダーの接続を参照してください。