Referência da tabela do sistema de replicação
O Managed DR é restrito. Solicite acesso por meio da sua equipe de account do Databricks. O Databricks habilita o Managed DR em sua account após a sua aceitação.
Esta página fornece uma referência para a tabela states no esquema de sistema replication, que rastreia o status de replicação da recuperação de desastres (DR) gerenciada do Databricks. Cada linha é um evento de status para um grupo de failover, emitido periodicamente e sempre que o grupo de failover é alterado. Use esta tabela para monitorar o status de replicação atual e histórico de seus grupos de failover, incluindo o atraso da replicação e quaisquer erros que estejam bloqueando a replicação de pelo menos um ativo.
Caminho da tabela : system.replication.states
Como ler o status de replicação
Eventos de status são emitidos em um intervalo regular. Cada evento relata o estado agregado do grupo de failover, o atraso atual e quaisquer erros que estejam bloqueando a replicação de pelo menos um ativo. Ele não lista quais objetos individuais foram replicados com sucesso.
Quando replication_lag_ms não é null, tudo o que não está coberto por um erro nesse evento foi replicado até esse atraso. Outros ativos no escopo continuam a replicar e permanecem atualizados em relação ao atraso, mesmo quando a matriz errors não está vazia. Durante INITIAL_REPLICATION, antes que todos os ativos no escopo tenham sido replicados uma vez, replication_lag_ms pode ser null: o evento ainda pode listar erros bloqueadores, mas ainda não mede a integridade.
Tipos de ativos que o DR gerenciado não oferece suporte algum não aparecem na tabela, nem como sucesso nem como erro. A ausência deles não significa que foram replicados. Consulte Limitações. Ativos no escopo que usam um recurso não compatível, como filtros de linha, máscaras de coluna ou controle de acesso baseado em atributos (ABAC), aparecem na tabela como falhas.
Para confirmar que um ativo específico existe no secundário, inspecione o objeto lá. Como os catálogos secundários no escopo são somente leitura, a Databricks recomenda um workspace de monitoramento somente leitura separado na região secundária. Consulte Configurar replicação.
Referência do esquema da tabela de Estados
A tabela states usa o seguinte esquema:
Nome da coluna | Tipo de dados | Descrição | Exemplo |
|---|---|---|---|
| string | Identificador exclusivo para o evento de status. |
|
| carimbo de data/hora | Carimbo de data/hora de quando o evento foi emitido. |
|
| string | ID da account à qual o grupo de failover pertence. |
|
| string | Nome totalmente qualificado do grupo de failover. |
|
| string | Estado da replicação quando o evento foi emitido. Os valores possíveis são |
|
| matriz | Quando | Consulte a referência de erros |
| long | Milissegundos desde a última replicação bem-sucedida de todos os ativos no escopo quando o evento foi emitido. Um valor de |
|
| string | A região primária do grupo de failover no momento em que o evento foi emitido. |
|
| struct | Os ativos gerenciados pelo grupo de failover quando o evento foi emitido. Consulte Referência de ativos gerenciados. | Consulte a referência de ativos gerenciados |
Referência de erros
A coluna errors contém um array dos erros que estão bloqueando a replicação. Cada elemento da matriz é uma estrutura com os seguintes campos:
Nome do campo | Tipo de dados | Descrição |
|---|---|---|
| struct | Detalhes do erro. Contém |
| matriz | Uma entrada por tipo de ativo afetado. Cada entrada contém |
Referência de ativos gerenciados
A coluna managed_assets é uma estrutura que descreve os ativos gerenciados pelo grupo de failover quando o evento foi emitido. Contém os seguintes campos:
Nome do campo | Tipo de dados | Descrição |
|---|---|---|
| matriz | Os IDs dos metastores gerenciados pelo grupo de failover. |
| matriz | Os workspaces gerenciados pelo grupo de failover. Cada entrada contém |
| matriz | Os catálogos gerenciados pelo grupo de failover. Cada entrada contém |
Considerações ao ler a tabela
Observe o seguinte ao analisar a tabela states:
- Os dados podem levar até 3 horas para estarem disponíveis após um evento ocorrer.
- A tabela contém eventos para todos os grupos de failover na conta do Databricks.
Exemplos de consultas
A consulta a seguir retorna o status de replicação mais recente para um determinado grupo de failover, incluindo seu replication_state atual, o atraso de replicação e quaisquer erros de bloqueio:
SELECT
event_time,
replication_state,
replication_lag_ms,
errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1
A consulta a seguir retorna a distribuição do atraso de replicação para um determinado grupo de failover:
SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name