Anthropic Lancia Code Review per Claude Code
Code Review di Anthropic manda un team di agenti AI in parallelo su ogni PR. Copertura passata dal 16% al 54% internamente, circa 20 minuti per review.
Alessandro Saiani
Human in the Loop

Il 9 marzo Anthropic ha rilasciato Code Review, un sistema multi-agente che analizza automaticamente le Pull Request. Non un linter glorificato: un team di agenti AI che si divide il lavoro e controlla la PR in parallelo.
E il timing non è casuale. Quattro giorni prima Cursor aveva lanciato Automations con BugBot. La corsa alla code review automatica è ufficialmente aperta.
Come Funziona
Quando apri una PR, Code Review lancia un gruppo di agenti in parallelo. Ogni agente si concentra su una parte diversa del codice, cercando bug, problemi di sicurezza, logica rotta.
Il sistema si adatta alla dimensione e complessità della PR. Una modifica a tre file non riceve lo stesso trattamento di un refactoring che ne tocca trenta. Più la PR è grande e complessa, più agenti vengono assegnati.
Il risultato è una review dettagliata in circa 20 minuti. Non istantanea, ma considerando che un reviewer umano su una PR corposa può metterci ore (o giorni, se è onesto), è un compromesso ragionevole.
I Numeri Interni di Anthropic
Anthropic lo usa internamente su quasi tutte le proprie PR. Ed è qui che i numeri diventano interessanti.
Prima di Code Review, solo il 16% delle PR riceveva una review dettagliata. Dopo l'adozione del tool, la copertura è salita al 54%. Tre volte tanto.
Il 16% iniziale non sorprende chi lavora in team. Le review accurate richiedono tempo, concentrazione e contesto. Quando il ritmo delle PR è alto, le review diventano superficiali — o non avvengono proprio. È il segreto sporco dello sviluppo software: tutti sanno che le review servono, pochi hanno il tempo di farle bene.
Passare al 54% non significa che il restante 46% viene ignorato. Significa che più della metà delle PR ora riceve un'analisi approfondita che prima semplicemente non c'era.
Quanto Costa
Il costo è di $15-$25 per review in token usage. Non è poco, ma va contestualizzato.
Un developer senior costa all'azienda tra i $100 e i $200 all'ora (stipendio + overhead). Se una review manuale richiede 30-60 minuti di attenzione, siamo tra i $50 e i $200 per review. A $15-$25 il rapporto è chiaro.
Il costo reale di un bug che passa in produzione è ovviamente un altro ordine di grandezza. Una review che cattura un problema di sicurezza prima del merge si ripaga da sola.
Detto questo, per team piccoli o progetti open source, $15-$25 a PR non è trascurabile. Se fai 20 PR al giorno, sono $300-$500 al giorno solo di review.
Chi Puo' Usarlo
Code Review è disponibile come research preview per i clienti Claude for Teams e Enterprise. Tra i primi utilizzatori ci sono Uber, Salesforce e Accenture.
Non è ancora disponibile per i singoli sviluppatori o per il tier gratuito. La strategia è chiara: partire dall'enterprise, raccogliere feedback, iterare, poi allargare.
Il Contesto: Una Settimana Molto Densa
Cinque giorni prima del lancio di Code Review, il 5 marzo, Cursor ha lanciato Automations — un sistema che include BugBot, un tool di review automatica delle PR. Approccio diverso (singolo agente vs multi-agente), ma stesso obiettivo.
Il timing racconta una tendenza precisa: la code review automatica è diventata il prossimo campo di battaglia nell'AI coding.
E i numeri di contesto aiutano a capire perché. Claude Code scrive già il 4% dei commit su GitHub. Il 95% degli sviluppatori usa tool AI settimanalmente. Il mercato AI coding vale oltre $5 miliardi.
Più codice viene scritto dall'AI, più serve qualcuno (o qualcosa) che lo controlli. La review automatica non è un nice-to-have: è la conseguenza logica del volume di codice generato.
Primo Multi-Agente da un Big Player
Code Review è il primo tool di code review multi-agente lanciato da un big player AI. La differenza con un approccio singolo-agente non è solo di velocità: agenti diversi possono avere "prospettive" diverse sulla stessa PR.
Uno controlla la logica, un altro la sicurezza, un altro la coerenza con il resto della codebase. Il parallelismo non serve solo a ridurre i tempi — serve a coprire più angoli contemporaneamente.
È lo stesso principio degli Agent Teams lanciati con Opus 4.6 il mese scorso, applicato a un caso d'uso specifico. Anthropic sta costruendo un ecosistema dove il multi-agente non è un concetto teorico ma un pattern di produzione.
Cosa Significa Per Chi Sviluppa
Il segnale pratico è chiaro: la code review sta diventando un processo automatizzabile. Non sostituibile — le decisioni architetturali, il contesto di business, le scelte di design restano umane. Ma la parte meccanica (bug ovvi, pattern problematici, vulnerabilità note) può essere delegata.
Se lavori in un team enterprise con Claude for Teams, vale la pena testare Code Review sulle prossime PR. Il costo è contenuto rispetto al tempo risparmiato, e il feedback arriva in 20 minuti.
Se sei uno sviluppatore indipendente, per ora ti tocca aspettare — o guardare a BugBot di Cursor come alternativa. Ma la direzione è tracciata: entro fine anno, la review automatica sarà una feature standard in quasi tutti i tool di AI coding.