Rodando seu primeiro experimento de Chaos Engineering com o Litmus
Como instalar o Litmus no Kubernetes e rodar um experimento de falha controlado, partindo de uma hipótese escrita até chegar a um veredito acionável, sem quebrar a produção por acidente.
Escreva uma hipótese e uma métrica de estado estável antes de mexer em qualquer coisa
CríticoRode o primeiro experimento em staging, em uma única carga de trabalho stateless
CríticoInstale o Litmus em seu próprio namespace com o Helm
CríticoConfirme que os CRDs de chaos e o operator estão instalados e saudáveis
CríticoCrie uma ServiceAccount apenas com as permissões que o experimento precisa
CríticoInstale o ChaosExperiment pod-delete a partir do ChaosHub
Adicione probes para o experimento saber o que significa 'saudável'
CríticoEscreva o ChaosEngine com seletores de label exatos e uma duração curta
CríticoAplique o ChaosEngine e acompanhe o pod runner e o ChaosResult
Mantenha seus dashboards e logs reais abertos enquanto o chaos estiver rodando
CríticoLeia o ChaosResult e depois delete o ChaosEngine
Aumente o raio de impacto (blast radius) só depois de uma execução limpa
Documente a execução e abra tickets para o que quebrou
CríticoAgende um gameday recorrente para o sistema continuar sendo testado
Mais checklists
Service Mesh
Checklist de gerenciamento de tráfego no Istio: roteamento, retries e circuit breaking
Como configurar políticas de gerenciamento de tráfego no Istio para que seus serviços possam fazer canary releases, repetir falhas transitórias e descartar carga quando um serviço downstream apresenta problemas. Cobre VirtualService, DestinationRule, retries, timeouts, circuit breakers e outlier detection.
60-90 minutos
GitOps
Checklist de estrutura de repositório multi-ambiente no Argo CD
Como organizar seus repositórios Git ao rodar o Argo CD entre dev, staging e produção. Cobre a estrutura de pastas, app-of-apps, ApplicationSets, secrets, RBAC e o fluxo de promoção.
60-90 minutos
DevOps
Checklist de Implementação de GitOps
Checklist completo para implementar práticas de GitOps, abrangendo estrutura de repositório, políticas de sincronização, gerenciamento de secrets e estratégias de deploy.
60-90 minutos
Also worth your time on this topic
Peças Fundamentais do Litmus: ChaosEngine vs ChaosExperiment
Você instala o Litmus em um cluster e quer matar um pod para ver o que acontece. Me explique as peças que o Litmus oferece, e qual é a diferença real entre um ChaosExperiment e um ChaosEngine?
junior
Checklist de gerenciamento de tráfego no Istio: roteamento, retries e circuit breaking
Como configurar políticas de gerenciamento de tráfego no Istio para que seus serviços possam fazer canary releases, repetir falhas transitórias e descartar carga quando um serviço downstream apresenta problemas. Cobre VirtualService, DestinationRule, retries, timeouts, circuit breakers e outlier detection.
60-90 minutos
GitOps com ArgoCD - Deployments Automatizados no Kubernetes
Implemente workflows de GitOps usando o ArgoCD para deployments de aplicações Kubernetes automatizados, declarativos e auditáveis.
120 minutos