Pular para o conteúdo

Glossário

cultura

Termos organizados por área. Use Ctrl+F ou a busca do portal.

Onde o termo em inglês é o que se usa no dia a dia, ele vem primeiro — traduzir “deployment” para “implantação” numa conversa de time só atrapalha.

Artefato — o resultado empacotado de um build: uma imagem de container, um .jar, um binário. Deve ser construído uma vez e promovido entre ambientes, nunca reconstruído por ambiente.

Blue/green — mantém duas versões completas em paralelo e troca o tráfego de uma para a outra de uma vez. Rollback é trocar de volta. Custa o dobro de infraestrutura durante a transição.

Canário — expõe a versão nova a uma fração pequena do tráfego, mede, e só então aumenta. Precisa de métrica confiável para decidir; sem isso é só um deploy lento.

CI (integração contínua) — integrar o trabalho de todos na linha principal várias vezes ao dia, com build e teste automáticos a cada integração. É sobre frequência de merge, não sobre ter um servidor de CI.

CD — ambíguo de propósito em muita conversa. Entrega contínua significa que todo commit aprovado pode ir a produção com um clique. Deploy contínuo significa que ele vai, sem clique.

Deploy — colocar o código em produção. Não é o mesmo que release.

Release — expor a funcionalidade ao usuário. Feature flags separam release de deploy, e essa separação é o que permite deploy frequente com risco baixo.

Digest — o hash imutável que identifica uma imagem de container. Diferente de tag, que pode ser reapontada. Deploy sério referencia digest.

Drift — divergência entre o estado declarado no código e o estado real da infraestrutura. Normalmente nasce de mudança manual “só dessa vez”.

Feature flag — chave que liga e desliga funcionalidade em tempo de execução, sem deploy. Gera dívida: flag que ninguém remove vira caminho de código não testado.

GitOps — o repositório Git é a fonte da verdade do estado desejado, e um agente no cluster reconcilia a realidade com ele continuamente.

Pipeline — a sequência automatizada de etapas entre o commit e a produção.

Promoção — mover o mesmo artefato de um ambiente para o próximo, mudando só a configuração.

Rollback — voltar à versão anterior. É requisito, não plano B — e precisa ser testado, senão você descobre que não funciona durante o incidente.

Rolling update — substitui as réplicas gradualmente. Padrão do Kubernetes. Exige que as duas versões consigam coexistir por alguns minutos.

Trunk-based development — todo mundo integra na linha principal com frequência alta e branches vivem horas, não semanas. É pré-requisito prático para CI de verdade.

cgroups — mecanismo do kernel Linux que limita e contabiliza recursos (CPU, memória, I/O) de um grupo de processos. É o “limite” do container.

Namespaces — mecanismo do kernel que isola a visão de recursos (processos, rede, montagens) de um grupo de processos. É o “isolamento” do container.

OCI — o conjunto de especificações abertas que padroniza imagem, runtime e distribuição de containers. É por isso que uma imagem construída com Docker roda em containerd.

Distroless — imagem base contendo apenas a aplicação e suas dependências de execução: sem shell, sem gerenciador de pacotes. Reduz drasticamente a superfície de ataque e dificulta a depuração — de propósito.

Pod — a menor unidade agendável do Kubernetes: um ou mais containers que compartilham rede e armazenamento e vivem e morrem juntos.

Sidecar — container auxiliar que roda ao lado do principal no mesmo Pod (proxy, coletor de log, agente de segurança).

Operator — controlador que estende a API do Kubernetes com lógica operacional específica de uma aplicação, expressa em um recurso customizado (CRD).

Reconciliação — o laço que o Kubernetes executa continuamente: comparar estado desejado com estado real e agir para aproximar os dois. É o modelo mental central da ferramenta.

Probe — verificação periódica de um container. Liveness detecta processo travado (e reinicia). Readiness decide se recebe tráfego. Startup protege partida lenta. Confundir liveness com readiness causa reinício em cascata.

Taint e toleration — mecanismo para repelir Pods de um nó, a menos que o Pod declare explicitamente que tolera aquela marca.

QoS (classe de serviço) — como o Kubernetes prioriza o despejo de Pods sob pressão de memória: Guaranteed (request igual a limit), Burstable, BestEffort — nesta ordem de proteção.

SLI — indicador de nível de serviço: a métrica que representa a experiência do usuário. Ex.: proporção de requisições respondidas com sucesso em menos de 300 ms.

SLO — objetivo de nível de serviço: o alvo para o SLI. Ex.: 99,9% em 30 dias. É uma decisão de negócio disfarçada de número técnico.

SLA — acordo de nível de serviço: o contrato com o cliente, com consequência financeira. Sempre mais frouxo que o SLO interno.

Error budget — a quantidade de falha que o SLO permite. Um SLO de 99,9% concede 43,2 minutos de indisponibilidade por mês. Enquanto sobra orçamento, o time entrega; quando acaba, a prioridade vira confiabilidade.

Burn rate (taxa de consumo) — a velocidade com que o error budget está sendo gasto. Alertar por burn rate substitui limiares arbitrários de erro.

Toil — trabalho manual, repetitivo, automatizável e sem valor duradouro, que cresce junto com o serviço. Não é “trabalho chato”: é uma categoria com critérios.

MTTR — tempo médio para restaurar o serviço após uma falha. Uma das quatro métricas DORA. Reduzi-lo costuma valer mais que reduzir a frequência de falhas.

RTO — tempo máximo aceitável para restaurar o serviço após um desastre.

RPO — quantidade máxima aceitável de dados perdidos, medida em tempo. Um RPO de 15 minutos significa aceitar perder até 15 minutos de transações.

Postmortem sem culpado — análise de incidente cujo objetivo é entender o sistema que permitiu a falha, e não identificar responsáveis. Sem isso, as pessoas escondem informação e a organização para de aprender.

Falha cinza — o serviço não está claramente vivo nem claramente morto: responde devagar, falha em parte das requisições, passa nas verificações de saúde. É o modo mais difícil de detectar.

Backpressure — mecanismo pelo qual um sistema sobrecarregado sinaliza para que a origem reduza o envio, em vez de acumular fila até colapsar.

Disjuntor (circuit breaker) — para de chamar uma dependência que está falhando, em vez de acumular timeouts. Dá chance de a dependência se recuperar.

Chaos engineering — injetar falha deliberadamente, com hipótese formulada e raio de alcance controlado, para descobrir fragilidades antes que elas apareçam sozinhas.

Cardinalidade — o número de combinações distintas de labels de uma métrica. Adicionar um label com identificador de usuário multiplica a cardinalidade e é a forma mais rápida de derrubar um Prometheus.

Métrica — valor numérico agregado ao longo do tempo. Barata, responde “o quê”.

Log — registro de evento discreto. Caro em volume, responde “o que aconteceu neste caso específico”.

Trace — o caminho de uma requisição atravessando vários serviços. Responde “onde o tempo foi gasto”.

Span — uma operação individual dentro de um trace, com início, fim e atributos.

Amostragem — decidir quais traces guardar. Head decide no início (barato, pode perder o caso raro). Tail decide no fim, já sabendo se houve erro (mais caro, mais útil).

OpenTelemetry (OTel) — padrão aberto para instrumentar aplicações, que desacopla o código do backend de observabilidade escolhido.

Método RED — para serviços: Rate (taxa), Errors (erros), Duration (duração).

Método USE — para recursos: Utilization (utilização), Saturation (saturação), Errors (erros).

Percentil (p50, p95, p99) — o valor abaixo do qual está aquela porcentagem das observações. Média de latência esconde exatamente a cauda que o usuário sente.

SAST — análise estática do código-fonte em busca de padrões inseguros.

DAST — análise dinâmica, testando a aplicação em execução.

SCA — análise de composição: identifica vulnerabilidades conhecidas nas dependências de terceiros.

SBOM — inventário legível por máquina de tudo que compõe um artefato. Quando sai uma vulnerabilidade crítica, é o que responde “estou afetado?” em minutos, e não em dias.

SLSA — conjunto de níveis que descrevem o quanto o processo de build de um artefato é resistente a adulteração.

Procedência (provenance) — atestado verificável de como, onde e a partir de quê um artefato foi construído.

Sigstore / cosign — infraestrutura para assinar e verificar artefatos usando identidade OIDC, sem que o time precise gerenciar chaves privadas.

Menor privilégio — conceder apenas a permissão necessária, pelo tempo necessário. Quase toda implementação para na primeira metade.

Zero trust — não confiar em nada por estar “dentro da rede”. Toda requisição é autenticada e autorizada com base em identidade, não em origem.

mTLS — TLS mútuo: cliente e servidor apresentam certificado. É como serviços provam identidade entre si dentro de um mesh.

Segredo dinâmico — credencial gerada sob demanda, com prazo curto de validade. Um segredo que expira em uma hora limita muito o dano de um vazamento.

Política como código — regras de conformidade escritas em uma linguagem executável, aplicadas automaticamente no pipeline e na admissão do cluster.

Injeção de prompt — ataque em que instruções maliciosas escondidas em conteúdo processado por um modelo (log, ticket, página) fazem o sistema executar algo não pretendido. Relevante para qualquer automação com LLM.

IaC — infraestrutura como código: provisionar recursos a partir de arquivos versionados, em vez de cliques no console.

Idempotência — aplicar a mesma operação várias vezes produz o mesmo resultado que aplicar uma vez. É a propriedade que torna retry seguro e automação confiável.

Imutabilidade — não modificar servidores em execução: substituí-los por novos, construídos do zero. Elimina a divergência que se acumula ao longo do tempo.

State (Terraform) — o mapa entre o que está declarado no código e o que existe no provedor. Contém segredos em texto claro e é o ponto único de falha mais comum em IaC.

Landing zone — a estrutura base de contas, redes, identidade e guardrails na qual as cargas de trabalho são provisionadas.

Guardrail — restrição preventiva que impede uma classe inteira de erro (por exemplo, impedir a criação de bucket público), em vez de detectá-la depois.

Egress — tráfego que sai da nuvem ou da zona. É o custo que ninguém prevê e que aparece na fatura no fim do mês.

Spot — capacidade computacional com desconto grande que pode ser retomada pelo provedor com aviso de minutos. Excelente para cargas que toleram interrupção.

FinOps — a disciplina de dar visibilidade, responsabilidade e otimização contínua ao custo de nuvem — tratando custo como métrica de engenharia.

Unit economics — custo por unidade de negócio (por transação, por cliente). Muda a conversa de “a conta subiu” para “o custo por pedido caiu 12%”.

DevOps — a prática de derrubar a separação entre quem constrói e quem opera, compartilhando responsabilidade pelo sistema em produção. Não é um cargo, não é uma ferramenta e não é um time separado.

SRE — a disciplina que aplica engenharia de software aos problemas de operação, com SLO e error budget como mecanismo de decisão.

Platform engineering — construir e operar uma plataforma interna como produto, oferecendo caminhos self-service para os times de produto.

Golden path (caminho pavimentado) — a forma recomendada de construir e entregar software na organização, tornada tão conveniente que é mais fácil segui-la do que contorná-la.

IDP — plataforma interna de desenvolvimento: a camada de self-service que expõe os golden paths.

DORA — as quatro métricas de desempenho de entrega: frequência de deploy, lead time para mudança, tempo de restauração e taxa de falha em mudança.

Lead time para mudança — o tempo entre o commit e aquele código rodando em produção.

Lei de Conway — organizações produzem sistemas cujo desenho espelha a estrutura de comunicação delas. A “manobra reversa” é mudar a organização de propósito para obter a arquitetura desejada.

Carga cognitiva — o total que um time precisa manter na cabeça para fazer seu trabalho. Em Team Topologies é tratada como restrição de projeto, e não como uma questão de esforço individual.

Blameless — postura organizacional que assume boa-fé e competência, e busca as condições sistêmicas que tornaram o erro possível.

Shift left — antecipar verificações (teste, segurança, custo) para o início do ciclo, quando corrigir é barato.

Runbook — procedimento passo a passo para lidar com uma situação operacional específica. Bom runbook é executável por alguém que acordou às três da manhã.