15 devs, 50 PRs por semana e um agente de IA revisando cada um
Como automatizamos code review com LLMs sem abrir mão de padrão de código — e o que quebrou no caminho.
Com quinze engenheiros abrindo cerca de cinquenta PRs por semana, o gargalo do review humano ficou visível: ou os revisores viravam engarrafamento, ou a qualidade caía. Colocamos um agente de IA para revisar cada PR. Este é o relato honesto do que funcionou e do que quebrou.
O que o agente é bom em pegar
Consistência. O agente nunca está cansado, nunca deixa passar um padrão de nomenclatura por pressa, e reclama do mesmo jeito na sexta-feira à noite e na segunda de manhã. Para regras de estilo, contratos de API internos e anti-padrões conhecidos, ele é um revisor incansável e barato.
Onde ele erra — e por quê importa
O agente não entende intenção de negócio. Ele aprova código correto que resolve o problema errado, e ocasionalmente enterra o revisor humano em ruído: dez comentários irrelevantes escondem o único que importava. A calibragem do que ele comenta — e do que ele cala — foi metade do trabalho.
A regra que não abrimos mão
O agente sugere; o humano decide. Nenhum merge acontece só porque a IA aprovou. O valor não foi substituir o revisor, foi devolver o tempo dele para o que exige julgamento — arquitetura, trade-offs, e as perguntas que um LLM ainda não sabe fazer.