Conector CDC integrado da Oracle
Beta
Este recurso está em Beta. Os administradores do workspace podem controlar o acesso a esse recurso na página Pré-visualizações . Consulte Gerenciar prévias do Databricks.
Esta página ajuda a entender o fluxo de trabalho de ingestão do Oracle, incluindo os fatores que determinam sua abordagem de configuração e os passos envolvidos para diferentes personas de usuário.
O conector CDC integrado do Oracle usa um pipeline CDC integrado : um único pipeline extrai alterações do Oracle usando LogMiner e as aplica a tabelas de transmissão de destino, sem um gateway de ingestão separado. Para o modelo de componente, consulte Componentes do conector.
Antes de criar um pipeline de ingestão de CDC integrado ao Oracle, você deve configurar o banco de dados de origem diretamente no Oracle: habilite o modo de log de arquivo, habilite o log suplementar nas tabelas que você replica e crie um usuário de replicação com os privilégios necessários. Conclua estas tarefas primeiro. Consulte Configurar o Oracle para ingestão no Databricks.
Disponibilidade de recursos
A mesma disponibilidade de recurso se aplica ao Databricks na AWS, Azure e GCP.
Recurso | Disponibilidade |
|---|---|
Criação de pipelines via interface do usuário |
|
Criação de pipelines baseada em API |
|
Pacotes de Automação Declarativa |
|
Ingestão incremental |
|
Governança do Unity Catalog |
|
Orquestração utilizando Jobs do LakeFlow |
|
SCD tipo 2 |
|
Seleção e desseleção de colunas com base em API |
|
Filtragem de linha baseada em API |
|
Evolução automática do esquema: novas e colunas excluídas |
Não é possível adicionar novamente uma coluna excluída com o mesmo nome. |
Evolução do esquema automatizada: Alterações de tipo de dados |
Apenas ampliação de tipo. Uma alteração de tipo não ampliada (estreitamento) exige um refresh completo. |
Evolução do esquema automatizada: Renomeação de colunas |
|
Evolução automatizada do esquema: renomeação de tabelas |
|
Evolução do esquema automatizada: novas tabelas |
Se você ingerir o esquema inteiro. Consulte as limitações sobre o número de tabelas por pipeline. |
Refresh completo automático |
Executa o refresh completo automático das tabelas afetadas para recuperar de alterações de esquema não suportadas. Consulte política de refresh completo automático. |
Número máximo de tabelas por pipeline | 250 |
Métodos de autenticação
O conector oferece suporte à autenticação básica apenas com um nome de usuário e senha Oracle. Consulte Criar uma conexão Oracle.
Ingerir do Oracle em 3 passos
Antes de começar, revise a persona de usuário do Databricks, a variação de banco de dados, os métodos de autenticação, as interfaces compatíveis, a frequência de ingestão e os padrões comuns.
- Configurar o Oracle para ingestão (Administradores) — Habilite o modo de log de arquivo, habilite o log suplementar nas tabelas que você replica e crie um usuário de replicação com os privilégios necessários.
- Criar uma conexão do Unity Catalog (Administradores) — Crie uma conexão no Catalog Explorer para que não administradores possam criar pipelines.
- Criar um pipeline de ingestão (Administradores ou não administradores) — Selecione qualquer interface compatível e crie um pipeline a partir de uma conexão existente.