Conceitos básicos
Beta
A partir de 15 de junho, o Lakebase está disponível em Beta no GCP. Consulte Disponibilidade regional para regiões compatíveis.
O Lakebase fornece um conjunto de recursos que permitem desenvolver, testar e escalar seus aplicativos de banco de dados de forma eficiente. Esta seção apresenta os conceitos principais que diferenciam o Lakebase dos sistemas de banco de dados tradicionais.
Arquitetura
O Lakebase separa o compute Postgres stateless de uma camada de armazenamento durável de safekeepers, pageservers e armazenamento de objetos em cloud. Entender essa separação explica por que os conceitos abaixo, desde Branches instantâneas até escala para zero, funcionam da maneira que funcionam.
Saiba mais: Arquitetura
Projetos
Um projeto Lakebase é o contêiner de nível superior para todos os seus recursos de banco de dados. Cada projeto pertence a um workspace Databricks e contém uma ou mais ramificações, cada uma com seus próprios compute e bancos de dados.
Project
└── Branch (e.g., production)
├── Compute (read-write)
└── Database (e.g., databricks_postgres)
Saiba mais: Projetos | gerenciar projetos
escala automática
O Lakebase ajusta automaticamente os recursos compute com base nas demandas da sua carga de trabalho. Conforme o tráfego do seu aplicativo aumenta ou diminui, o recurso compute escala para cima ou para baixo dentro do intervalo configurado, sem intervenção manual ou tempo de inatividade.
Principais benefícios:
- Ajuste automático: recurso escala com base na demanda real.
- Tempo de inatividade zero: O dimensionamento dentro da sua faixa configurada ocorre sem interromper as conexões. No entanto, a alteração da configuração mínima ou máxima da CU pode causar uma breve interrupção.
- Otimização de custos: pague apenas pelo recurso que você realmente utiliza.
- consistência de desempenho: Mantenha o desempenho responsivo durante picos de tráfego.
Saiba mais: dimensionamento automático | Configurar dimensionamento automático
escalar para zero
Quando seu banco de dados está parado, o Lakebase pode reduzir automaticamente os recursos compute a zero, eliminando custos com capacidade não utilizada. Quando a atividade for retomada, seu compute aumentará automaticamente de volta à capacidade máxima em segundos.
Principais benefícios:
- Custos zero de parado: Sem cobranças compute quando seu banco de dados estiver inativo.
- Retomada instantânea: os bancos de dados são ativados automaticamente quando acessados.
- Ideal para desenvolvimento: Perfeito para ambientes de desenvolvimento e teste com uso intermitente.
- Gestão automática: Não requer intervenção manual.
Saiba mais: escalar para zero | Configurar escalar para zero
Ramos do banco de dados
Os branches de banco de dados no Lakebase funcionam de maneira semelhante aos branches do Git para o seu código. Você pode criar ramificações isoladas e instantâneas para desenvolvimento, teste ou experimentação sem duplicar dados ou afetar seu ambiente de produção.
Principais benefícios:
- Criação instantânea: as ramificações são criadas em segundos usando a tecnologia copy-on-write.
- Relação custo-benefício: Somente os dados modificados são armazenados separadamente, minimizando os custos de armazenamento.
- Ambientes isolados: Teste alterações com segurança sem afetar seu banco de dados principal.
- Colaboração: os integrantes da equipe podem trabalhar em ramificações separadas simultaneamente.
Saiba mais: Filiais de banco de dados | Gerenciar filiais
computação e ponto final
Um endpoint do Lakebase é o ponto de conexão estável que seu aplicativo usa para acessar um banco de dados. Por trás de cada endpoint, uma ou mais instâncias compute lidam com o processamento de consultas. Suas strings de conexão permanecem as mesmas mesmo ao aumentar os recursos compute ou adicionar alta disponibilidade.
Normalmente, uma ramificação possui um endpoint de leitura e gravação (seu compute principal) e, opcionalmente, um ou mais pontos de extremidade somente leitura (réplicas de leitura).
Saiba mais: computação e endpoint | gerenciar computação
Arquitetura de armazenamento
Lakebase armazena dados em uma camada de armazenamento distribuída que é separada do compute. Armazenamento é redundante por zona e persiste independentemente do status do compute, esteja o compute em execução, em pausa ou em failover. Essa separação de armazenamento permite ramificações instantâneas, réplicas de leitura e escala até zero sem duplicação de dados.
Principais benefícios:
- Armazenamento altamente disponível: O Databricks mantém o armazenamento altamente disponível independentemente da sua configuração de compute de HA.
- Persiste através de alterações de compute: O armazenamento permanece disponível durante falhas de compute, pausas ou alterações de configuração.
- **Base para ramificações e réplicas:** A criação instantânea de ramificações e as réplicas de leitura dependem de várias instâncias de compute compartilhando a mesma camada de armazenamento.
Saiba mais: arquitetura de armazenamento
Alta disponibilidade
A alta disponibilidade associa um compute primário de leitura/gravação a uma ou mais instâncias de compute secundárias distribuídas por zonas de disponibilidade. Quando o principal se torna indisponível, a Lakebase automaticamente promove um secundário e seu aplicativo continua da última transação confirmada. Sua string de conexão permanece inalterada. O armazenamento já está altamente disponível. Habilitar HA adiciona redundância em nível de compute para failover automático.
Principais benefícios:
- Failover automático: o Lakebase promove uma instância de compute secundária sem intervenção manual.
- Sem perda de dados: o failover preserva todas as transações confirmadas.
- strings de conexão estáveis: Seu aplicativo não precisa alterar a configuração de conexão após uma falha.
Saiba mais: Alta disponibilidade | gerenciar alta disponibilidade
Leia as réplicas
As réplicas de leitura são computes independentes somente leitura que realizam operações de leitura nos mesmos dados que o seu compute principal de leitura e gravação. Ao contrário das réplicas tradicionais, as réplicas de leitura do Lakebase não duplicam dados. Eles leem da mesma camada de armazenamento, permitindo a criação instantânea e eliminando custos adicionais de armazenamento.
Principais benefícios:
- Escalabilidade horizontal: Distribua as solicitações de leitura entre várias réplicas.
- Sem duplicação de dados: Todas as réplicas leem do mesmo armazenamento.
- Criação instantânea: Disponível em segundos, sem necessidade de copiar dados.
- Custo-benefício: Sem custos adicionais de armazenamento, além de suporte para escalonamento automático e redução gradual de custos.
Saiba mais: Leia as réplicas | Gerenciar leia as réplicas
Como eles trabalham juntos
Esses conceitos fundamentais trabalham em conjunto para criar uma plataforma de banco de dados poderosa e flexível:
- Projetos organizam todos os seus recursos de banco de dados e pertencem a um workspace do Databricks.
- O dimensionamento automático garante que cada filial tenha a quantidade certa de compute com base na demanda.
- O recurso escala-to-zero reduz os custos em branches do Parado, suspendendo compute quando não estiver em uso.
- Os branches de banco de dados permitem criar ambientes isolados para desenvolvimento e teste sem duplicar dados.
- Os recursos de computação e endpoint fornecem pontos de conexão estáveis à medida que você expande ou reconfigura sua infraestrutura.
- A arquitetura de armazenamento mantém seus dados com redundância de zona e altamente disponíveis, independentemente do estado do compute.
- Alta disponibilidade adiciona redundância no nível do compute e failover automático entre zonas de disponibilidade para cargas de trabalho de produção.
- As réplicas de leitura distribuem o tráfego de leitura entre instâncias compute adicionais.
Essa arquitetura permite criar e escalar aplicações de banco de dados com maior flexibilidade, custos mais baixos e menos sobrecarga operacional do que os sistemas de banco de dados tradicionais.