GUIA
O Custo de IA pra Analisar Incidentes
Quanto custaria em tokens de LLM correlacionar incidentes do Waroom ou incident.io com deploys usando IA em vez de uma janela de tempo configurável.
O que isso cobre
Change failure rate — uma das 4 métricas DORA — depende de correlacionar um incidente
com um deploy recente. O moasy.tech faz isso com uma janela de tempo configurável e
uma query JOIN LATERAL contra dado de deploy sincronizado. Uma
alternativa baseada em LLM leria cada incidente e raciocinaria sobre qual deploy, se
algum, deveria ser responsabilizado — uma decisão genuinamente ambígua que se
beneficia de raciocínio de verdade, não só uma busca.
A conta
Essa é de longe a categoria de menor volume — um time de 5 engenheiros na frequência de deploy elite ainda produz só cerca de 3 incidentes por mês (o próprio ponto do DORA: times elite fazem deploy com frequência e falham raramente). Cada chamada de correlação custa uma estimativa de US$0,0125 (modelo de nível barato) a US$0,125 (modelo de nível topo de linha) — veja o método completo de como esse custo por evento é construído.
| Times | Incidentes/mês | Custo estimado de IA/mês |
|---|---|---|
| 1 | 3 | US$ 0,04 – 0,38 |
| 5 | 15 | US$ 0,19 – 1,88 |
| 7 | 21 | US$ 0,26 – 2,63 |
Como o moasy.tech faz isso em vez disso
Um deploy só conta como falha quando um incidente de verdade, classificado pelas suas próprias regras, acontece dentro de uma janela configurável depois dele — uma query determinística, não uma decisão de julgamento repetida por incidente. Veja a implementação completa na página de DORA Metrics, ou a comparação completa de custo, com calculadora, somando todas as categorias de integração.
Perguntas sobre essa estimativa
Por que essa categoria é tão mais barata que as outras?
Só volume — incidente é raro por natureza num time elite saudável, mesmo um que faz deploy múltiplas vezes ao dia. Contagem de evento baixa significa custo total baixo nesse modelo, mesmo que cada chamada de correlação individual não seja mais barata que nas outras categorias.
Isso inclui o custo de escrever um post-mortem de incidente com IA?
Não — isso conta só a pergunta de correlação (esse incidente mapeia pra um deploy recente) necessária pro change failure rate. Gerar texto de post-mortem é uma tarefa separada com seu próprio custo de token, não incluída aqui.