Kod üretimindeki patlamanın kaçınılmaz sonucu: mühendisler kodu katbekat hızlı yazmaya başladı (Anthropic, kişi başı yıllık hacimde %200 artış olduğunu doğrudan belirtiyor) ve bu kütleyi kontrol edecek fiziksel olarak kimse yok.
Anthropic buna baktı ve Claude Code Review'ı (şimdilik Team/Enterprise için ön izlemede) yayınladı. Bu tam teşekküllü bir çoklu ajan sistemi.
Nasıl çalışıyor: açılan her PR'a bir ajan sürüsü salınıyor. Paralel olarak güvenlik açıkları ve mantıksal hatalar arıyorlar, ardından doğrulama aşaması yanlış pozitifleri ayıklıyor (kodun gerçek davranışıyla karşılaştırarak) ve çıktı olarak satır içi yorumlar oluşturuluyor. Ortalama olarak böyle derin bir tarama yaklaşık 20 dakika sürüyor.
Bir inceleme için ortalama fatura: $15–$25 (token olarak düşülüyor). 😱
Tetikleyici ayarları var. Alışkanlıkla "her push'ta kontrol et" seçeneğini açıp her yazım hatası commit'inde ajanları çalıştırırsanız, yakında tüm böbreklerinizi satmanız gerekebilir.
Özelleştirme için depo köküne REVIEW.md dosyası koyabilirsiniz. Oraya insan dilinde ekip kuralları yazılır.
Ayrıca sinir ağı, PR'ın yalnızca yüzeysel olarak dokunduğu komşu kodda gizli hataları da vurgular.
Anthropic'in iç istatistiklerine göre, büyük PR'larda (>1000 satır) ajanlar vakaların %84'ünde kritik sorunlar buluyor. Kod yazarları ise yorumların %1'inden azını reddediyor.
Birkaç yıl önce kurumsal geliştirmenin temel olarak nasıl çalışacağını hayal edebilir miydiniz: sinir ağları tonlarca kod üretiyor, diğer sinir ağları (çok pahalıya) bu kodu inceliyor ve hataları arıyor.
Bu düzende deri torbaya sadece faturaları ödemek kalıyor 🥲
Yorumlar
0Henüz yorum yok.