Guias práticos
Guias resolvem um problema específico, do início ao fim. Não explicam teoria — quando o porquê importa, o guia linka para o conceito.
Containers
Seção intitulada “Containers”Tarefas do dia a dia com Docker e imagens.
- Reduzir o tamanho de uma imagem Docker — Da imagem de 1,2 GB para menos de 100 MB, medindo cada passo.
- Debugar um container que não sobe — Roteiro para exit code inesperado, crash imediato e container que sobe e morre.
- Publicar imagem para amd64 e arm64 — Build multiplataforma com buildx e manifest list.
- Acelerar o build de imagem no CI — Cache de camadas que sobrevive entre execuções.
Kubernetes
Seção intitulada “Kubernetes”Operação e diagnóstico no cluster.
- Resolver um Pod em CrashLoopBackOff — O roteiro completo, da causa mais comum à mais rara.
- Service que não responde — Do DNS ao endpoint, checando cada salto.
- Expor um serviço com HTTPS — Ingress mais cert-manager, do zero ao certificado renovando sozinho.
- Definir requests e limits sem chutar — Usar dados de uso real para dimensionar.
- Fazer rollback de um deploy — Voltar rápido e entender o que aconteceu depois.
- Migrar de Ingress para Gateway API — Convivência entre os dois durante a transição.
Pipelines e entrega.
- Montar um pipeline do zero — Build, teste, análise e deploy para um serviço em container.
- Deploy na nuvem sem chave de longa duração — Federação OIDC entre o CI e o provedor de nuvem.
- Acelerar um pipeline lento — Achar onde o tempo vai e cortá-lo.
- Deploy canário automatizado — Progressão por métrica, com abortar automático.
- Promover o mesmo artefato entre ambientes — Build uma vez, promover por digest.
Infraestrutura como código
Seção intitulada “Infraestrutura como código”Terraform, OpenTofu e Ansible na prática.
- Importar infraestrutura existente para o Terraform — Trazer recurso criado na mão para o código, sem recriar nada.
- Recuperar um state quebrado — Lock preso, recurso órfão e state divergente.
- Dividir um state gigante — Reduzir o raio de alcance sem downtime.
- Escrever um módulo que outros times usam — Interface, versionamento e documentação.
- Mostrar o custo da mudança no pull request — Estimativa de custo automática no plan.
Observabilidade
Seção intitulada “Observabilidade”Instrumentar, medir e alertar.
- Instrumentar um serviço com OpenTelemetry — Do zero a traces, métricas e logs correlacionados.
- Montar um dashboard que alguém usa — Método RED aplicado a um serviço real.
- Alertar por consumo de error budget — Trocar alerta por limiar fixo por alerta baseado em SLO.
- Reduzir o custo de logs sem perder diagnóstico — Amostragem, níveis e retenção por classe.
Segurança
Seção intitulada “Segurança”Proteger pipeline, segredo e cluster.
- Um segredo vazou no repositório: o que fazer — Resposta em ordem de prioridade, nos primeiros minutos.
- Assinar imagens e exigir assinatura no cluster — Cosign no pipeline, política de admissão no cluster.
- Tirar segredos do Git em GitOps — External Secrets Operator ligado a um cofre.
- Dar acesso mínimo a um time no cluster — RBAC por namespace sem virar administrador de tudo.
Nuvem e custo
Seção intitulada “Nuvem e custo”Operação e conta no fim do mês.
- Achar de onde veio um gasto inesperado — Da fatura ao recurso, em passos.
- Desligar ambientes fora do horário comercial — Economia direta em desenvolvimento e homologação.
- Migrar cargas para instâncias spot — Reduzir custo aceitando interrupção.
Banco de dados em entrega contínua.
- Rodar migration sem downtime — Expandir, migrar, contrair — com rollback possível.
- Testar a restauração do backup — O ensaio que transforma backup em garantia.