Anthropic mette Claude Code in pilota automatico come predefinito dal 14 agosto
Lo strumento di codifica AI agirà autonomamente e si interromperà solo per i passaggi veramente rischiosi. Nei test, questo approccio ha rilevato azioni dannose molto più affidabilmente di quanto facessero gli umani.

Punti chiave
- Anthropic renderà la modalità automatica l'impostazione predefinita per gli account Claude Code Pro, Max e Team a partire dal 14 agosto 2026.
- In uno studio su 1.053 tester pagati, la modalità automatica ha rilevato l'89% delle azioni dannose; i revisori umani ne hanno rilevate solo il 13,6%.
- Gli umani hanno approvato il 97% dei prompt di autorizzazione durante la revisione manuale, suggerendo che il click routinario aveva reso la supervisione praticamente inutile.
- Anthropic sta anche aggiungendo lo screening dell'iniezione di prompt e regole di diniego personalizzabili a Claude Code.
Gli antropici hanno a lungo presumo che mantenere un umano nel processo renda gli strumenti AI più sicuri. Un nuovo studio di Anthropic suggerisce che il contrario potrebbe a volte essere vero, almeno quando l'umano in questione ha visto la stessa finestra di approvazione cento volte oggi.
A partire dal 14 agosto, Claude Code, l'assistente di codifica basato su AI di Anthropic che scrive, modifica ed esegue codice per tuo conto, attiverà la modalità automatica per impostazione predefinita per gli utenti con piani Pro, Max e Team. La modalità automatica significa che lo strumento completa i compiti autonomamente e si interrompe solo per chiedere il permesso quando un'azione è classificata come irreversibile, distruttiva o diretta al di fuori dei tuoi file e sistemi.
Anthropic ha testato per la prima volta la modalità automatica a marzo 2026, proponendola come un modo per mantenere il lavoro in movimento senza sacrificare il controllo.
Perché rimuovere l'approvazione umana rende effettivamente le cose più sicure?
Perché gli umani smettono di prestare attenzione. Nello studio di Anthropic, gli utenti hanno approvato il 97% di tutti i prompt di autorizzazione mostrati loro durante la revisione manuale. Cliccare "sì" era diventato un'abitudine, non un vero controllo.
La modalità automatica, al contrario, applica regole coerenti ogni singola volta. Tra 1.053 tester pagati, ha correttamente identificato l'89% delle azioni dannose. I revisori umani ne hanno rilevate solo il 13,6%.
Boris Cherny, responsabile di Claude Code, l'ha affermato chiaramente in un post su X: "Il team e io usiamo la modalità Auto esclusivamente da molti mesi. Non riuscirei ad immaginare di tornare ai prompt di autorizzazione".
A cosa dovrebbero effettivamente prestare attenzione gli utenti?
La modalità automatica non è un'autorizzazione per allontanarti dal computer mentre Claude Code riscritto la tua base di codice.
Lo strumento si interrompe prima di azioni che giudica irreversibili o distruttive, ma quel giudizio è fatto dall'AI, non da te. Familiarizzarsi con le nuove regole di "diniego assoluto", che ti consentono di bloccare specifiche categorie di azione completamente, vale i dieci minuti che occorrono.
Anthropic sta anche implementando lo screening dell'iniezione di prompt. L'iniezione di prompt è un attacco in cui istruzioni dannose sono nascoste all'interno di contenuti che l'AI legge, come una pagina web o un documento, ingannandola nel fare qualcosa che il suo utente non ha mai chiesto. Il nuovo screening è progettato per catturare quei comandi nascosti prima che influenzino ciò che fa lo strumento.
Se il tuo lavoro coinvolge dati sensibili, file di clienti o sistemi di produzione che non possono essere facilmente ripristinati, imposta le tue regole di diniego assoluto prima del 14 agosto. Considera la modalità automatica come un assistente capace che lavora velocemente e ha bisogno di confini chiari, non uno che ha bisogno di una supervisione costante, ma nemmeno uno che puoi ignorare completamente.



