Logische Folge des Code-Generierungsbooms: Ingenieure produzieren Code deutlich schneller (Anthropic gibt einen Anstieg des Volumens um 200% pro Person und Jahr an), und es gibt physisch niemanden, der diese Masse überprüft.
Anthropic hat das erkannt und Claude Code Review veröffentlicht (vorerst in der Vorschau für Team/Enterprise). Es ist ein vollwertiges Multi-Agenten-System.
Wie es funktioniert: Auf jeden offenen PR wird ein Schwarm von Agenten losgelassen. Sie suchen parallel nach Schwachstellen und logischen Fehlern, dann filtert eine Verifikationsphase False Positives heraus (durch Abgleich mit dem tatsächlichen Code-Verhalten), und am Ende werden Inline-Kommentare erstellt. Im Durchschnitt dauert ein solcher tiefergehender Durchlauf etwa 20 Minuten.
Durchschnittliche Kosten pro Review: $15–$25 (wird in Token abgerechnet). 😱
Es gibt eine Einstellung für Trigger. Wenn Sie aus Gewohnheit "bei jedem Push prüfen" aktivieren, um die Agenten bei jedem Tippfehler-Commit loszuschicken, müssen Sie bald alle Ihre Organe verkaufen.
Zur Anpassung der Beanstandungen können Sie eine Datei REVIEW.md im Repository-Stamm ablegen. Dort werden in menschlicher Sprache die Teamregeln festgehalten.
Außerdem hebt die KI schlafende Bugs im benachbarten Code hervor, den der PR nur am Rande berührt.
Laut interner Statistik von Anthropic finden die Agenten bei großen PRs (>1000 Zeilen) in 84% der Fälle kritische Probleme. Dabei lehnen die Code-Autoren selbst weniger als 1% der Anmerkungen ab.
Hätten Sie sich vor ein paar Jahren vorstellen können, wie Enterprise-Entwicklung hauptsächlich funktionieren wird: KIs generieren tonnenweise Code, andere KIs (schon sehr teuer) reviewen diesen Code und suchen nach Bugs.
Und dem menschlichen Sack bleibt in diesem Schema nur noch, die Rechnungen zu bezahlen 🥲
Kommentare
0Noch keine Kommentare.
Melde dich an, um mitzudiskutieren.