Limitações do conector Anysphere Organization
info
Beta
Esse recurso está em Beta. Os administradores do Workspace podem controlar o acesso a esse recurso na página Previews . Consulte Gerenciar prévias do Databricks.
Limitações gerais do conector SaaS
As limitações nesta seção se aplicam a todos os conectores SaaS no Lakeflow Connect.
- Quando você executa um pipeline agendado, os alertas não Trigger imediatamente. Em vez disso, eles fazem Trigger quando ocorre a execução da próxima atualização.
- Quando uma tabela de origem é excluída, a tabela de destino não é excluída automaticamente. Você deve excluir a tabela de destino manualmente. Esse comportamento não é consistente com o comportamento do Spark Declarative Pipelines no Lakeflow.
- Durante os períodos de manutenção da origem, o Databricks pode não conseguir acessar seus dados.
- Se o nome de uma tabela de origem entrar em conflito com o nome de uma tabela de destino existente, a atualização do pipeline falhará.
- O suporte a pipelines de destino múltiplo é feito apenas por API.
- Opcionalmente, você pode renomear uma tabela que você ingere. Se você renomear uma tabela em seu pipeline, ele se tornará um pipeline somente de API, e você não poderá mais editar o pipeline na IU.
- Se você selecionar uma coluna após o início de um pipeline, o conector não preencherá automaticamente os dados para a nova coluna. Para ingerir data histórica, execute manualmente um refresh completo na tabela.
- O Databricks não pode ingerir duas ou mais tabelas com o mesmo nome no mesmo pipeline, mesmo que venham de esquemas de origem diferentes.
- O sistema de origem pressupõe que as colunas de cursor aumentam de forma monótona.
- O conector ingere dados brutos sem transformações. Use Spark Declarative Pipelines downstream em LakeFlow Pipelines para transformações.
Limitações específicas do conector
As limitações desta seção aplicam-se ao conector Anysphere Organization.
- O conector não oferece suporte à ingestão incremental. Todas as tabelas são atualizadas com um snapshot completo a cada atualização de pipeline. Todas as tabelas retêm o histórico diário por meio da coluna de partição
snapshot_date(parte da key primária de cada tabela), de modo que os snapshots diários são preservados entre as execuções. - O conector não oferece suporte a SCD tipo 2. Todas as tabelas são ingeridas como snapshots de refresh completo sem acompanhamento de exclusão por captura de dados de alterações (CDC), portanto, o histórico de SCD tipo 2 não está disponível.
- For the list of supported tables, see Supported source tables.