Anthropic запускає Claude Code в автоматичному режимі за замовчуванням з 14 серпня
Інструмент штучного інтелекту для кодування тепер діятиме самостійно й робитиме паузу лише для справді ризикованих кроків. При тестуванні такий підхід виявив шкідливі дії набагато надійніше, ніж люди.

Ключові моменти
- Anthropic зробить автоматичний режим стандартним для Claude Code для акаунтів Pro, Max і Team з 14 серпня 2026 року.
- У дослідженні 1053 платних тестувальників автоматичний режим виявив 89% шкідливих дій; людські рецензенти виявили лише 13,6%.
- Люди схвалили 97% запитів дозволу під час ручної перевірки, що свідчить про те, що рутинне натискання зробило нагляд майже марним.
- Anthropic також додає фільтрацію prompt injection та настроювані правила жорсткого відхилення до Claude Code.
Фахівці Anthropic довгий час припускали, що збереження людини в контурі управління робить інструменти штучного інтелекту безпечнішими. Нове дослідження Anthropic припускає, що іноді може бути навпаки — принаймні, коли людина, про яку йдеться, бачила те саме вікно схвалення сотні разів на день.
Починаючи з 14 серпня, Claude Code — помічник Anthropic для програмування на основі штучного інтелекту, який пише, редагує та запускає код від вашого імені — увімкне автоматичний режим за замовчуванням для користувачів планів Pro, Max і Team. Автоматичний режим означає, що інструмент виконує завдання самостійно й зупиняється, щоб попросити дозвіл лише тоді, коли дія класифікується як незворотна, деструктивна або спрямована за межі ваших файлів і систем.
Anthropic вперше протестував автоматичний режим у березні 2026 року, представивши його як спосіб розпочати роботу без шкоди контролю.
Чому видалення людського схвалення насправді робить речі безпечнішими?
Тому що люди перестають звертати увагу. У дослідженні Anthropic користувачі схвалили 97% всіх запитів дозволу, яких їм були показані під час ручної перевірки. Натискання «так» стало м'язовою пам'яттю, а не справжною перевіркою.
Автоматичний режим, у свою чергу, застосовує послідовні правила щоразу. На 1053 платних тестувальниках він правильно позначив 89% шкідливих дій. Людські рецензенти виявили лише 13,6% тих самих дій.
Борис Черні, керівник Claude Code, прямо сказав у дописі на X: «Я та моя команда користуємося виключно автоматичним режимом протягом багатьох місяців. Я не можу уявити, як повернутися до запитів дозволу».
На що насправді повинні звертати увагу користувачі?
Автоматичний режим — це не дозвіл залишати комп'ютер без нагляду, поки Claude Code переписує вашу кодову базу.
Інструмент зупиняється перед діями, які він судить незворотними або деструктивними, але це судження робиться штучним інтелектом, а не вами. Познайомитися з новими правилами «жорсткого відхилення», які дозволяють вам повністю блокувати певні категорії дій, варто десять хвилин, які це займе.
Anthropic також розгортає фільтрацію prompt injection. Prompt injection — це атака, під час якої шкідливі інструкції приховуються всередину вмісту, який читає штучний інтелект, наприклад веб-сторінки або документи, змушуючи його виконувати щось, про що його користувач ніколи не просив. Нова фільтрація розроблена так, щоб виявити ці приховані команди, перш ніж вони вплинуть на роботу інструменту.
Якщо ваша робота пов'язана з конфіденційними даними, файлами клієнтів або виробничими системами, які не можуть бути легко повернені, встановіть правила жорсткого відхилення до 14 серпня. Ставтеся до автоматичного режиму як до спроможного помічника, який працює швидко й потребує чітких меж, а не того, який потребує постійного опікування, але також не того, якого можна повністю ігнорувати.



