feature-engineeringコマンドグループ
Databricks CLI使用には、使用状況データ プロビジョニングを含むDatabricksライセンスおよびDatabricksプライバシー通知が適用されます。
Databricks CLI内のfeature-engineeringコマンド グループを使用すると、 Databricks Feature Store の機能を管理できます。
データブリックス 特徴エンジニアリング 特徴作成
フィーチャを作成します。
databricks feature-engineering create-feature FULL_NAME SOURCE INPUTS FUNCTION TIME_WINDOW [flags]
議論
FULL_NAME
フィーチャの完全な 3 つの部分からなる名前 (カタログ、スキーマ、名前)。
SOURCE
機能のデータソース。
INPUTS
特徴量がコンピュートされる入力列。
FUNCTION
特徴はコンピュートな機能。
TIME_WINDOW
機能がコンピュートである時間枠。
オプション
--description string
機能の説明。
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
例
次の例では、フィーチャを作成します。
databricks feature-engineering create-feature my_catalog.my_schema.my_feature my_source my_inputs my_function my_time_window --description "My feature description"
databricks feature-エンジニアリング create-Kafka-config
Kafka構成を作成します。
databricks feature-engineering create-kafka-config NAME BOOTSTRAP_SERVERS SUBSCRIPTION_MODE AUTH_CONFIG [flags]
議論
NAME
メタストア内でこの Kafka 構成を一意に識別する名前。これは、特徴量に関するこれらの構成を参照するために、Feature オブジェクトから使用される識別子となります。トピック名とは異なる場合があります。
BOOTSTRAP_SERVERS
Kafkaクラスターを指すホスト/ポートのペアのカンマ区切りリスト。
SUBSCRIPTION_MODE
データをプルする Kafka トピックを構成するためのオプション。
AUTH_CONFIG
トピックへの接続のための認証構成。
オプション
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
databricks feature-エンジニアリング create-materialized-feature
マテリアライズド特徴量を作成します。
databricks feature-engineering create-materialized-feature FEATURE_NAME [flags]
議論
FEATURE_NAME
Unity Catalog における特徴量のフルネーム。
オプション
--cron-schedule string
マテリアライゼーション パイプラインのスケジュールを定義するQuartz cron式。
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
--materialized-feature-id string
マテリアライズされた特徴量に対してサーバーが割り当てた一意の識別子。
--pipeline-schedule-state MaterializedFeaturePipelineScheduleState
マテリアライズパイプラインのスケジュール状態。サポートされている値: ACTIVE、PAUSED、SNAPSHOT。
databricks feature-エンジニアリング create-ストリーム
ストリームを作成します。
databricks feature-engineering create-stream NAME SOURCE_CONFIG CONNECTION_CONFIG SCHEMA_CONFIG INGESTION_CONFIG [flags]
議論
NAME
完全な3部構成 (catalog.schema.ストリーム)ストリームの名前。
SOURCE_CONFIG
ソース固有の構成。ストリーミングプラットフォームのソースを決定します。
CONNECTION_CONFIG
ストリームプラットフォームへの接続および認証方法を指定します。
SCHEMA_CONFIG
ストリームのスキーマ定義。現在、直接スキーマのみがサポートされています。将来のマイルストーンにおいて、UC接続を通じたスキーマレジストリをサポートする予定です。
INGESTION_CONFIG
ストリーミングデータ取り込みの構成:フォワードフィルデータとオプションのヒストリカルバックフィルのオフラインコピーを格納するマネージドテーブル。
オプション
--description string
ユーザーが提供した説明。
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
データブリックス 機能エンジニアリング 機能削除
フィーチャを削除します。
databricks feature-engineering delete-feature FULL_NAME [flags]
議論
FULL_NAME
削除するフィーチャの名前。
例
次の例では、フィーチャを削除します。
databricks feature-engineering delete-feature my_catalog.my_schema.my_feature
databricks feature-エンジニアリング delete-kafka-config
Kafka 構成を削除します。
databricks feature-engineering delete-kafka-config NAME [flags]
議論
NAME
削除する Kafka 構成の名前。
databricks feature-エンジニアリング delete-materialized-feature
マテリアライズ済みの特徴量を削除します。
databricks feature-engineering delete-materialized-feature MATERIALIZED_FEATURE_ID [flags]
議論
MATERIALIZED_FEATURE_ID
削除するマテリアライズ済み特徴量のID。
databricks feature-エンジニアリング delete-ストリーム
ストリームを削除します。
databricks feature-engineering delete-stream NAME [flags]
議論
NAME
削除するストリームの完全な3部分から構成される名前 (catalog.schema.stream)。
データブリックス 特徴エンジニアリング 特徴取得
機能を取得します。
databricks feature-engineering get-feature FULL_NAME [flags]
議論
FULL_NAME
取得する機能の名前。
例
次の例では、機能を取得します。
databricks feature-engineering get-feature my_catalog.my_schema.my_feature
databricks feature-エンジニアリング get-Kafka-config
Kafka構成を取得します。
databricks feature-engineering get-kafka-config NAME [flags]
議論
NAME
取得するKafka構成の名前。
databricks feature-エンジニアリング get-materialized-feature
マテリアライズされた特徴量を取得します。
databricks feature-engineering get-materialized-feature MATERIALIZED_FEATURE_ID [flags]
議論
MATERIALIZED_FEATURE_ID
マテリアライズされた特徴量のID。
databricks feature-エンジニアリング get-ストリーム
ストリームを取得します。
databricks feature-engineering get-stream NAME [flags]
議論
NAME
取得するストリームの完全な3部分から構成される名前 (catalog.schema.stream)。
Databricks 機能エンジニアリング リスト機能
機能を一覧表示します。
databricks feature-engineering list-features [flags]
オプション
--page-size int
返される結果の最大数。
--page-token string
前のクエリに基づいて次のページに移動するためのページネーション トークン。
例
次の例では、すべての機能を一覧表示します。
databricks feature-engineering list-features
databricks feature-エンジニアリング list-Kafka-configs
Kafka 設定を一覧表示します。
databricks feature-engineering list-kafka-configs [flags]
オプション
--limit int
返される結果の最大数。
--page-size int
返される結果の最大数。
databricks feature-エンジニアリング list-materialized-features
マテリアライズされた特徴量を一覧表示します。
databricks feature-engineering list-materialized-features [flags]
オプション
--feature-name string
特徴量名でフィルタリング。
--limit int
返される結果の最大数。
--page-size int
返される結果の最大数。
databricks feature-エンジニアリング list-ストリーム
ストリームを一覧表示します。
databricks feature-engineering list-streams [flags]
オプション
--limit int
返される結果の最大数。
--page-size int
返される結果の最大数。
--parent string
ストリームを一覧表示する親の2部構成の名前 (catalog.schema)。
データブリックス機能エンジニアリング機能更新
機能の説明を更新します (他のすべてのフィールドは不変です)。
databricks feature-engineering update-feature FULL_NAME UPDATE_MASK SOURCE INPUTS FUNCTION TIME_WINDOW [flags]
議論
FULL_NAME
フィーチャの完全な 3 つの部分からなる名前 (カタログ、スキーマ、名前)。
UPDATE_MASK
更新するフィールドのリスト。
SOURCE
機能のデータソース。
INPUTS
特徴量がコンピュートされる入力列。
FUNCTION
特徴はコンピュートな機能。
TIME_WINDOW
機能がコンピュートである時間枠。
オプション
--description string
機能の説明。
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
例
次の例では、機能の説明を更新します。
databricks feature-engineering update-feature my_catalog.my_schema.my_feature description my_source my_inputs my_function my_time_window --description "Updated description"
databricks feature-エンジニアリング update-Kafka-config
Kafka構成を更新します。
databricks feature-engineering update-kafka-config NAME UPDATE_MASK BOOTSTRAP_SERVERS SUBSCRIPTION_MODE AUTH_CONFIG [flags]
議論
NAME
メタストア内でこの Kafka 構成を一意に識別する名前。これは、特徴量に関するこれらの構成を参照するために、Feature オブジェクトから使用される識別子となります。トピック名とは異なる場合があります。
UPDATE_MASK
更新するフィールドのリスト。
BOOTSTRAP_SERVERS
Kafkaクラスターを指すホスト/ポートのペアのカンマ区切りリスト。
SUBSCRIPTION_MODE
データをプルする Kafka トピックを構成するためのオプション。
AUTH_CONFIG
トピックへの接続のための認証構成。
オプション
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
databricks feature-エンジニアリング update-materialized-feature
マテリアライズされた特徴量を更新します。
databricks feature-engineering update-materialized-feature MATERIALIZED_FEATURE_ID UPDATE_MASK FEATURE_NAME [flags]
議論
MATERIALIZED_FEATURE_ID
マテリアライズされた特徴量に対してサーバーが割り当てた一意の識別子。
UPDATE_MASK
更新する必要があるマテリアライズ特徴量フィールドを指定します。現在、更新できるのは pipeline_state フィールドのみです。
FEATURE_NAME
Unity Catalog における特徴量のフルネーム。
オプション
--cron-schedule string
マテリアライゼーション パイプラインのスケジュールを定義するQuartz cron式。
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
--materialized-feature-id string
マテリアライズされた特徴量に対してサーバーが割り当てた一意の識別子。
--pipeline-schedule-state MaterializedFeaturePipelineScheduleState
マテリアライズパイプラインのスケジュール状態。サポートされている値: ACTIVE、PAUSED、SNAPSHOT。
databricks feature-エンジニアリング update-ストリーム
ストリームを更新します。
databricks feature-engineering update-stream NAME UPDATE_MASK SOURCE_CONFIG CONNECTION_CONFIG SCHEMA_CONFIG INGESTION_CONFIG [flags]
議論
NAME
完全な3部構成 (catalog.schema.ストリーム)ストリームの名前。
UPDATE_MASK
更新するフィールドのリスト。
SOURCE_CONFIG
ソース固有の構成。ストリーミングプラットフォームのソースを決定します。
CONNECTION_CONFIG
ストリームプラットフォームへの接続および認証方法を指定します。
SCHEMA_CONFIG
ストリームのスキーマ定義。現在、直接スキーマのみがサポートされています。将来のマイルストーンにおいて、UC接続を通じたスキーマレジストリをサポートする予定です。
INGESTION_CONFIG
ストリーミングデータ取り込みの構成:フォワードフィルデータとオプションのヒストリカルバックフィルのオフラインコピーを格納するマネージドテーブル。
オプション
--description string
ユーザーが提供した説明。
--json JSON
インライン JSON 文字列またはリクエスト本体を含む JSON ファイルへの @path。
グローバルフラグ
--debug
デバッグ ログを有効にするかどうか。
-h または --help
Databricks CLI または関連コマンド グループまたは関連コマンドのヘルプを表示します。
--log-file string
出力ログを書き込むファイルを表す文字列。このフラグが指定されていない場合、デフォルトでは出力ログは stderr に書き込まれます。
--log-format format
ログ形式のタイプ、 textまたはjson 。デフォルト値はtextです。
--log-level string
ログ形式のレベルを表す文字列。指定しない場合は、ログ形式のレベルは無効になります。
-o, --output タイプ
コマンド出力タイプ、 textまたはjson 。デフォルト値はtextです。
-p, --profile string
コマンドを実行するために使用する~/.databrickscfgファイル内のプロファイルの名前。このフラグが指定されていない場合、存在する場合は、 DEFAULTという名前のプロファイルが使用されます。
--progress-format format
進捗ログを表示する形式: default 、 append 、 inplace 、または json
-t, --target string
該当する場合、使用するバンドルターゲット