Hasil wajar dari ledakan kode-generasi: para insinyur mulai memproduksi kode jauh lebih cepat (Anthropic secara langsung menyatakan peningkatan volume sebesar 200% per orang per tahun), dan secara fisik tidak ada yang bisa memeriksa massa ini.
Anthropic melihat ini dan meluncurkan Claude Code Review (saat ini dalam pratinjau untuk Tim/Perusahaan). Ini adalah sistem multi-agen yang lengkap.
Bagaimana cara kerjanya: pada setiap PR yang dibuka, sekawanan agen dikerahkan. Mereka secara paralel mencari kerentanan dan kesalahan logis, kemudian tahap verifikasi menyaring false positive (dengan memeriksa perilaku kode yang sebenarnya), dan pada akhirnya menghasilkan komentar inline. Rata-rata, pemeriksaan mendalam seperti itu memakan waktu sekitar 20 menit.
Biaya rata-rata untuk satu review: $15–$25 (dibebankan dalam token). 😱
Ada pengaturan pemicu. Jika Anda karena kebiasaan mengaktifkan "periksa setiap push", untuk menjalankan agen pada setiap komitmen yang salah ketik, maka Anda harus segera menjual semua ginjal Anda.
Untuk menyesuaikan pemeriksaan, Anda dapat meletakkan file REVIEW.md di root repositori. Di sana, aturan tim ditulis dalam bahasa manusia.
Jaringan saraf juga menyoroti bug tidur dalam kode tetangga yang disentuh PR secara tidak langsung.
Menurut statistik internal Anthropic, dalam PR besar (>1000 baris), agen menemukan masalah kritis dalam 84% kasus. Sementara itu, penulis kode sendiri menolak kurang dari 1% komentar.
Dapatkah Anda bayangkan beberapa tahun yang lalu bagaimana pengembangan perusahaan akan bekerja: jaringan saraf menghasilkan kode dalam jumlah besar, jaringan saraf lain (dengan harga yang sangat mahal) meninjau kode tersebut dan mencari bug.
Dan yang tersisa bagi kantong kulit dalam skema ini hanyalah membayar tagihan 🥲
Komentar
0Belum ada komentar.
Masuk untuk ikut berdiskusi.