Resultado lógico del boom de la generación de código: los ingenieros empezaron a producir código mucho más rápido (Anthropic afirma un aumento del 200% en volumen por persona al año), y no hay quien revise físicamente toda esa masa.
Anthropic lo vio y lanzó Claude Code Review (por ahora en preview para Team/Enterprise). Es un sistema multiagente completo.
Cómo funciona: por cada PR abierto se despliega un enjambre de agentes. Buscan en paralelo vulnerabilidades y errores lógicos, luego una fase de verificación descarta los falsos positivos (contrastando con el comportamiento real del código), y al final se generan comentarios en línea. En promedio, esta ejecución profunda toma unos 20 minutos.
El costo promedio por revisión: $15–$25 (se descuenta en tokens). 😱
Hay configuración de disparadores. Si por costumbre activas "revisar cada push" para ejecutar agentes en cada commit con errores tipográficos, pronto tendrás que vender todos tus órganos.
Para personalizar las objeciones, puedes colocar en la raíz del repositorio un archivo REVIEW.md. Allí se escriben en lenguaje humano las reglas del equipo.
Además, la red neuronal resalta errores latentes en el código vecino que el PR solo toca tangencialmente.
Según estadísticas internas de Anthropic, en PR grandes (>1000 líneas) los agentes encuentran problemas críticos en el 84% de los casos. Mientras tanto, los propios autores del código rechazan menos del 1% de las observaciones.
¿Podrías haber imaginado hace un par de años cómo funcionaría principalmente el desarrollo empresarial: redes neuronales generando código a toneladas, otras redes neuronales (ya por un costo muy alto) revisando ese código y buscando errores?
Y al saco de piel en este esquema solo le queda pagar las cuentas 🥲
Comentarios
0Aún no hay comentarios.