Implementando Chaos Engineering em clusters CNPG com LitmusChaos
Joao Cosme
EnterpriseDB
O CloudNativePG é realmente inquebrável? Vamos testar a lógica do operador sob estresse extremo usando princípios de Chaos Engineering.
A promessa de operadores nativos para Kubernetes é a automação total da resiliência. Mas até onde essa automação aguenta? Nesta palestra, vamos colocar o CloudNativePG (CNPG) sob uma bateria rigorosa de testes usando o LitmusChaos.
O objetivo é realizar uma análise profunda e honesta sobre como o operador se comporta em cenários de falhas compostas e extremas. Não vamos apenas deletar um pod; vamos simular latência de rede intermitente, exaustão de I/O de disco e falhas de comunicação durante o processo de failover.
O que será demonstrado:
A capacidade de autorrecuperação do CNPG em condições de degradação severa.
Como configurar experimentos do LitmusChaos que visam componentes específicos do operador.
Análise de métricas e logs para identificar o exato momento em que a automação atinge seu limite.
Entenda. os bastidores da alta disponibilidade e aprenda como preparar seu banco de dados para sobreviver aos cenários mais improváveis.
Implementando Chaos Engineering em clusters CNPG com LitmusChaos
Joao Cosme
EnterpriseDB
O CloudNativePG é realmente inquebrável? Vamos testar a lógica do operador sob estresse extremo usando princípios de Chaos Engineering.
A promessa de operadores nativos para Kubernetes é a automação total da resiliência. Mas até onde essa automação aguenta? Nesta palestra, vamos colocar o CloudNativePG (CNPG) sob uma bateria rigorosa de testes usando o LitmusChaos.
O objetivo é realizar uma análise profunda e honesta sobre como o operador se comporta em cenários de falhas compostas e extremas. Não vamos apenas deletar um pod; vamos simular latência de rede intermitente, exaustão de I/O de disco e falhas de comunicação durante o processo de failover.
O que será demonstrado:
A capacidade de autorrecuperação do CNPG em condições de degradação severa.
Como configurar experimentos do LitmusChaos que visam componentes específicos do operador.
Análise de métricas e logs para identificar o exato momento em que a automação atinge seu limite.
Entenda. os bastidores da alta disponibilidade e aprenda como preparar seu banco de dados para sobreviver aos cenários mais improváveis.