メインコンテンツまでスキップ

AI Runtime

備考

プレビュー

この機能は パブリック プレビュー段階です。

AI ランタイムは、ディープラーニングワークロードを目的としたDatabricksのServerless GPU コンピュートオファリングです。AI ランタイムを使用すると、お気に入りのフレームワークを使用してカスタムモデルをトレーニングおよびファインチューニングし、最先端の効率、パフォーマンス、品質を得ることができます。

使ってみる

クイックスタートガイドを使用して、数分で最初のワークロードを実行します。

    • 🚀 CLI クイックスタート
    • SlurmまたはKubernetesクラスターをお使いですか?ターミナルから数分でAI ランタイム上でトレーニングする。
    • ⚡ Ray
    • Coming from a Ray cluster?ラン Ray on AI ランタイム with dashboard support.
    • 🧭 概要
    • Learn the key things about AI ランタイム in two minutes: available GPUs, how it works, and limitations.

特徴量

AI Runtimeは、GPUへの多数の接続方法、組み込みのオブザーバビリティおよびデバッグツール、事前構築済みの環境を備えたフルスタックGPUプラットフォームです。

Serverless GPUへの接続 :どこからでもServerless GPUにアクセスできます。

    • ノートブック
    • Serverless GPUコンピュートにノートブックをアタッチし、クラスターの設定なしでインタラクティブに開発します。
    • SSH 経由のIDE
    • IDEまたはターミナルからSSHトンネル経由で接続し、GPUノードを直接操作します。
    • AI ランタイム CLI
    • YAMLジョブ構成を使用して、ノートパソコンから分散GPUトレーニングジョブを送信および管理します。
    • Ray
    • ラン Ray Core, Ray Data, Ray トレーニングする, and Ray Tune on Serverless GPU コンピュート.

依存関係の管理 : ワークロードの実行に使用するPythonおよびシステムのライブラリを制御します。

    • Pre-built environments
    • 最小限のStandard環境、または機械学習フレームワークがプリロードされたDatabricks AI環境から開始します。
    • Docker support
    • 独自のコンテナーイメージを持ち込んで、カスタムの依存関係スタックでワークロードを実行します。

GPUへのデータの読み込み :トレーニングデータをGPUに効率的にフィードします。

    • 効率的なデータローダー
    • 高いGPU稼働率を実現するために構築されたフォールトトレラントなローダーを使用して、Unity Catalogボリュームからデータをストリームします。

デバッグとオブザーバビリティ :エクスペリメントの追跡、出力の検査、障害の診断を行います。

    • Logsビューア
    • コードの実行中にトレーニングの出力を確認し、GPUリソースの使用状況を監視します。

スケジュールとリアルタイムサービング :インタラクティブな開発から、スケジュールされたジョブやEndpointへと移行します。

    • ジョブの本番運用
    • 宣言型オートメーションバンドルを使用してトレーニングコードをデプロイし、ランのスケジュールを設定し、マルチタスクのGPUおよびCPUワークフローを構築します。
    • モデルをサービングする
    • Model Serving を使用して、トレーニング済みモデルをスケーラブルな Endpoint の背後にデプロイします。

Clone end-to-end examples and ラン them on AI ランタイム in minutes, from the CLI or in ノートブック.

詳細を表示

役立つコンテンツの検索: 最新の製品アップデートと、AI ランタイム の内部の仕組み。