Aller au contenu principal

Référence des tables système de réplication

important

Managed DR est en accès limité. Faites une demande d'accès auprès de votre équipe de compte Databricks. Databricks active la reprise après sinistre (DR) gérée sur votre compte une fois que vous avez été accepté.

Cette page fournit une référence pour la table states dans le schéma système replication, qui suit l'état de réplication de la reprise après sinistre (DR) gérée par Databricks. Chaque ligne est un événement de statut pour un groupe de basculement, émis périodiquement et chaque fois que le groupe de basculement change. Utilisez ce tableau pour surveiller l'état de réplication actuel et historique de vos groupes de basculement, y compris le délai de réplication et toute erreur bloquant la réplication d'au moins un asset.

Chemin de la table : system.replication.states

Comment lire le statut de réplication

Les événements de statut sont émis à un intervalle régulier. Chaque événement rapporte l'état agrégé du groupe de basculement, le délai actuel et toute erreur bloquant la réplication d'au moins un asset. Il ne liste pas les objets individuels qui ont été répliqués avec succès.

Lorsque replication_lag_ms n'est pas null, tout ce qui n'est pas couvert par une erreur dans cet événement a été répliqué jusqu'à ce délai. Les autres actifs inclus dans le périmètre continuent d'être répliqués et restent à jour par rapport au délai, même lorsque le tableau errors n'est pas vide. Pendant INITIAL_REPLICATION, avant que tous les actifs inclus dans le périmètre n'aient été répliqués une fois, replication_lag_ms peut être null: l'événement peut toujours lister les erreurs bloquantes, mais il ne mesure pas encore l'exhaustivité.

Les types d'asset que la reprise après sinistre (DR) gérée ne prend pas du tout en charge n'apparaissent pas dans le tableau, ni comme un succès ni comme une erreur. Leur absence ne signifie pas qu'ils ont été répliqués. Voir Limitations. Les actifs inclus dans le périmètre qui utilisent une fonctionnalité non prise en charge, telle que les filtres de lignes, les masques de colonne ou le contrôle d'accès basé sur les attributs (ABAC), apparaissent dans le tableau comme des échecs.

Pour confirmer qu'un asset spécifique existe dans la région secondaire, inspectez l'objet à cet emplacement. Comme les catalogues secondaires inclus dans le périmètre sont en lecture seule, Databricks recommande un workspace de surveillance distinct en lecture seule dans la région secondaire. Voir Configurer la réplication.

Référence du schéma de la table des états

La table states utilise le schéma suivant :

Nom de colonne

Type de données

Description

Exemple

event_id

chaîne

Identifiant unique de l'événement d'état.

ca886134-876c-4671-a38b-332edf48c602

event_time

Horodatage

Timestamp auquel l'événement a été émis.

2024-01-05T00:00:00.000+00:00

account_id

chaîne

ID du compte auquel appartient le groupe de basculement.

ca886134-876c-4671-a38b-332edf48c602

failover_group_name

chaîne

Nom complet du groupe de basculement.

accounts/account1/failover-group/group1

replication_state

chaîne

État de la réplication au moment où l'événement a été émis. Les valeurs possibles sont INITIAL_REPLICATION, ACTIVE, CREATED, UPDATED, DELETED, FAILOVER_STARTED, FAILOVER_FINISHED et FAILOVER_ABORTED.

ACTIVE

errors

tableau

Lorsque replication_state est INITIAL_REPLICATION ou ACTIVE, une liste agrégée des erreurs bloquant la réplication d'au moins un asset, incluant le nombre d'assets affectés par chaque erreur. Voir Référence des erreurs.

Voir la référence des erreurs

replication_lag_ms

long

Millisecondes depuis la dernière réplication réussie de tous les assets dans le périmètre lorsque l'événement a été émis. Une valeur null indique qu'au moins un asset n'a jamais été répliqué de la source vers la réplique. « Une valeur croissante signifie que DR n'est pas en mesure de répliquer au moins un asset pertinent, mais les modifications apportées aux autres assets pertinents continuent d'être répliquées. »

2323

effective_primary_region

chaîne

La région principale du groupe de basculement au moment où l'événement a été émis.

us-west-2

managed_assets

structure

Les assets gérés par le groupe de basculement lorsque l'événement a été émis. Voir Référence des assets gérés.

Voir Référence des assets gérés

Nom de colonne

Type de données

Description

Exemple

event_id

chaîne

Identifiant unique de l'événement d'état.

ca886134-876c-4671-a38b-332edf48c602

event_time

Horodatage

Timestamp auquel l'événement a été émis.

2024-01-05T00:00:00.000+00:00

account_id

chaîne

ID du compte auquel appartient le groupe de basculement.

ca886134-876c-4671-a38b-332edf48c602

failover_group_name

chaîne

Nom complet du groupe de basculement.

accounts/account1/failover-group/group1

replication_state

chaîne

État de la réplication au moment où l'événement a été émis. Les valeurs possibles sont INITIAL_REPLICATION, ACTIVE, CREATED, UPDATED, DELETED, FAILOVER_STARTED, FAILOVER_FINISHED et FAILOVER_ABORTED.

ACTIVE

errors

tableau

Lorsque replication_state est INITIAL_REPLICATION ou ACTIVE, une liste agrégée des erreurs bloquant la réplication d'au moins un asset, incluant le nombre d'assets affectés par chaque erreur. Voir Référence des erreurs.

Voir la référence des erreurs

replication_lag_ms

long

Millisecondes depuis la dernière réplication réussie de tous les assets dans le périmètre lorsque l'événement a été émis. Une valeur null indique qu'au moins un asset n'a jamais été répliqué de la source vers la réplique. « Une valeur croissante signifie que DR n'est pas en mesure de répliquer au moins un asset pertinent, mais les modifications apportées aux autres assets pertinents continuent d'être répliquées. »

2323

effective_primary_region

chaîne

La région principale du groupe de basculement au moment où l'événement a été émis.

us-west-2

managed_assets

structure

Les assets gérés par le groupe de basculement lorsque l'événement a été émis. Voir Référence des assets gérés.

Voir Référence des assets gérés

Référence des erreurs

La colonne errors contient un tableau des erreurs qui bloquent la réplication. Chaque élément du tableau est une structure avec les champs suivants :

Nom du champ

Type de données

Description

error

structure

Détails sur l'erreur. Contient error_class (chaîne), un nom de classe pour l'erreur ; parameters (carte), des paramètres clé-valeur avec des détails sur l'erreur ; et message (chaîne), un message d'erreur lisible par l'homme.

affected_assets_counts

tableau

Une entrée par type d'asset affecté. Chaque entrée contient asset_type (chaîne), le type d’asset affecté, et failing_count (long), le nombre d’assets de ce type qu’affecte l’erreur.

Nom du champ

Type de données

Description

error

structure

Détails sur l'erreur. Contient error_class (chaîne), un nom de classe pour l'erreur ; parameters (carte), des paramètres clé-valeur avec des détails sur l'erreur ; et message (chaîne), un message d'erreur lisible par l'homme.

affected_assets_counts

tableau

Une entrée par type d'asset affecté. Chaque entrée contient asset_type (chaîne), le type d’asset affecté, et failing_count (long), le nombre d’assets de ce type qu’affecte l’erreur.

Référence des assets gérés

La colonne managed_assets est une structure qui décrit les assets gérés par le groupe de basculement lorsque l'événement a été émis. Il contient les champs suivants :

Nom du champ

Type de données

Description

metastore_ids

tableau

Les ID des métastores gérés par le groupe de basculement.

workspace_sets

tableau

Les ensembles de Workspace gérés par le groupe de basculement. Chaque entrée contient name (chaîne) et workspace_ids (tableau).

catalogs

tableau

Les catalogues gérés par le groupe de basculement. Chaque entrée contient name (chaîne de caractères).

Nom du champ

Type de données

Description

metastore_ids

tableau

Les ID des métastores gérés par le groupe de basculement.

workspace_sets

tableau

Les ensembles de Workspace gérés par le groupe de basculement. Chaque entrée contient name (chaîne) et workspace_ids (tableau).

catalogs

tableau

Les catalogues gérés par le groupe de basculement. Chaque entrée contient name (chaîne de caractères).

Considérations lors de la lecture de la table

Prenez note des points suivants lorsque vous analysez la table states :

  • Les données peuvent prendre jusqu'à 3 heures pour être renseignées après qu'un événement se soit produit.
  • Le tableau contient des événements pour tous les groupes de basculement dans le compte Databricks.

Exemples de requêtes

La requête suivante renvoie l’état de réplication le plus récent pour un groupe de basculement donné, y compris son replication_state actuel, le délai de réplication et toutes les erreurs bloquantes :

SQL
SELECT
event_time,
replication_state,
replication_lag_ms,
errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1

La query suivante renvoie la distribution du décalage de réplication pour un groupe de basculement donné :

SQL
SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name