Pular para o conteúdo principal

Rodando seu primeiro experimento de Chaos Engineering com o Litmus

Como instalar o Litmus no Kubernetes e rodar um experimento de falha controlado, partindo de uma hipótese escrita até chegar a um veredito acionável, sem quebrar a produção por acidente.

14itens
Voltar para todos os checklists
Chaos EngineeringBeginner
chaos-engineeringlitmuskubernetesresilience
Progresso0 / 14 concluídos
0%

Escreva uma hipótese e uma métrica de estado estável antes de mexer em qualquer coisa

Crítico

Rode o primeiro experimento em staging, em uma única carga de trabalho stateless

Crítico

Instale o Litmus em seu próprio namespace com o Helm

Crítico

Confirme que os CRDs de chaos e o operator estão instalados e saudáveis

Crítico

Crie uma ServiceAccount apenas com as permissões que o experimento precisa

Crítico

Instale o ChaosExperiment pod-delete a partir do ChaosHub

Adicione probes para o experimento saber o que significa 'saudável'

Crítico

Escreva o ChaosEngine com seletores de label exatos e uma duração curta

Crítico

Aplique o ChaosEngine e acompanhe o pod runner e o ChaosResult

Mantenha seus dashboards e logs reais abertos enquanto o chaos estiver rodando

Crítico

Leia o ChaosResult e depois delete o ChaosEngine

Aumente o raio de impacto (blast radius) só depois de uma execução limpa

Documente a execução e abra tickets para o que quebrou

Crítico

Agende um gameday recorrente para o sistema continuar sendo testado

Sponsored
Carbon Ads

Mais checklists

Also worth your time on this topic