Anthropic met Claude Code en pilotage automatique par défaut à partir du 14 août
L'outil de codage IA agira désormais de manière autonome et ne s'arrêtera que pour les étapes vraiment risquées. Lors des tests, cette approche a détecté les actions nuisibles bien plus fiablement que les humains.

Points clés
- Anthropic rendra le mode automatique par défaut pour les comptes Pro, Max et Team de Claude Code à partir du 14 août 2026.
- Dans une étude portant sur 1 053 testeurs payants, le mode automatique a détecté 89 % des actions nuisibles ; les examinateurs humains n'en ont détecté que 13,6 %.
- Les humains ont approuvé 97 % des invites de permission lors de l'examen manuel, ce qui suggère que le clic systématique avait rendu la surveillance pratiquement inefficace.
- Anthropic ajoute également un dépistage des injections d'invite et des règles de refus catégorique personnalisables à Claude Code.
Les anthropologues ont longtemps supposé que maintenir un humain dans la boucle rendait les outils IA plus sûrs. Une nouvelle étude d'Anthropic suggère que le contraire pourrait parfois être vrai, du moins quand cet humain a vu la même boîte d'approbation une centaine de fois aujourd'hui.
À partir du 14 août, Claude Code, l'assistant de codage alimenté par l'IA d'Anthropic qui écrit, modifie et exécute du code en votre nom, activera le mode automatique par défaut pour les utilisateurs des plans Pro, Max et Team. Le mode automatique signifie que l'outil complète les tâches de manière autonome et s'arrête uniquement pour demander une permission lorsqu'une action est classée comme irréversible, destructrice ou dirigée en dehors de vos propres fichiers et systèmes.
Anthropic a d'abord testé le mode automatique en mars 2026, le présentant comme un moyen de maintenir la productivité sans sacrifier le contrôle.
Pourquoi supprimer l'approbation humaine rend-elle les choses plus sûres ?
Parce que les humains cessent de prêter attention. Dans l'étude d'Anthropic, les utilisateurs ont approuvé 97 % de toutes les invites de permission qui leur ont été présentées lors de l'examen manuel. Cliquer sur « oui » était devenu un geste machinal, pas une véritable vérification.
Le mode automatique, en revanche, applique des règles cohérentes à chaque fois. Sur les 1 053 testeurs payants, il a correctement signalé 89 % des actions nuisibles. Les examinateurs humains n'en ont détecté que 13,6 %.
Boris Cherny, responsable de Claude Code, l'a clairement énoncé dans un post sur X : « L'équipe et moi utilisons le mode automatique exclusivement, et ce depuis plusieurs mois. Je ne pourrais pas imaginer revenir aux invites de permission. »
Que devraient réellement surveiller les utilisateurs ?
Le mode automatique n'est pas une carte blanche pour vous éloigner de votre ordinateur tandis que Claude Code réécrit votre base de code.
L'outil s'arrête avant les actions qu'il juge irréversibles ou destructrices, mais ce jugement est porté par l'IA, pas par vous. Se familiariser avec les nouvelles règles de « refus catégorique », qui vous permettent de bloquer des catégories d'actions spécifiques, vaut bien les dix minutes que cela prendra.
Anthropic déploie également un dépistage des injections d'invite. L'injection d'invite est une attaque où des instructions malveillantes sont cachées dans le contenu que l'IA lit, comme une page Web ou un document, la trompant pour faire quelque chose que son utilisateur n'a jamais demandé. Le nouveau dépistage est conçu pour détecter ces commandes cachées avant qu'elles n'influencent ce que l'outil fait.
Si votre travail implique des données sensibles, des fichiers clients ou des systèmes de production qui ne peuvent pas être facilement annulés, définissez vos règles de refus catégorique avant le 14 août. Traitez le mode automatique comme un assistant capable qui travaille vite et a besoin de limites claires, pas un qui a besoin d'être constamment guidé, mais pas un que vous pouvez ignorer entièrement non plus.



