← O Que São as Métricas DORA?

GUIA

Change Failure Rate (Taxa de Falha de Mudança): O Que É e Como Calcular

Uma das 4 métricas DORA — a fração de deploys que acabam causando um incidente.

O que mede

Change failure rate é a porcentagem de deploys em produção que resultam num serviço degradado, uma indisponibilidade, ou qualquer outro incidente que exija remediação. É a métrica que mantém as outras três honestas — frequência de deploy e lead time recompensam velocidade, e change failure rate é a checagem de que a velocidade não está custando estabilidade.

Como calcular

Divida o número de deploys que causaram um incidente pelo total de deploys no mesmo período, expresso como porcentagem. A parte que exige uma decisão de verdade é o que conta como "causou" — a abordagem mais limpa é só contar um incidente que começou dentro de uma janela definida depois de um deploy (uma hora, por exemplo), pra problemas sem relação que acontecem por coincidência na mesma hora não inflarem o número.

Performance elite vs. típica

A pesquisa da DORA consistentemente encontra times de elite e alta performance concentrados numa faixa baixa — bem abaixo de um terço dos deploys causando falha, muitas vezes bem menos — enquanto times de performance mais baixa ficam significativamente acima disso. Trate os cortes exatos como uma noção geral de escala, não um placar rígido, já que as faixas precisas mudaram um pouco entre diferentes anos do State of DevOps Report.

Como o moasy.tech calcula isso

O moasy.tech atrela o change failure rate direto a incidentes, não a palpite a partir de label de ticket. Um deploy só conta como falha quando um incidente de verdade — sincronizado somente leitura do Waroom ou incident.io e classificado pelas suas próprias regras configuráveis (sobrescrita por time, com um padrão da empresa como fallback) — acontece dentro de uma janela configurável depois dele. O incident.io ainda não resolve um incidente pra um time específico do jeito que o Waroom resolve, e o change failure rate exige um incidente vinculado a um time, então o dado do incident.io sincroniza mas não entra nesse número até isso ser resolvido.

Veja as outras 3 métricas DORA no guia completo, ou a implementação inteira na página de DORA Metrics.

Perguntas sobre change failure rate

Change failure rate é a mesma coisa que contar ticket de bug?

Não — é atrelado a deploy, não a ticket. Um deploy só conta como falha quando um incidente de verdade acontece dentro de uma janela depois dele. Nem todo ticket de bug é um incidente de produção, e nem todo incidente vem de um deploy.

O que conta como "incidente" pra essa métrica?

Isso é configurável, não fixo — regras de classificação de severidade (quais incidentes contam como falha de verdade versus só informativo) podem ser definidas por time, com um padrão da empresa como fallback, já que o que um time trata como incidente de verdade pode ser diferente do limite de outro.

Veja seu próprio change failure rate

Começar grátis