Anthropic ने 14 अगस्त से Claude Code को डिफ़ॉल्ट रूप से ऑटोपायलट पर रखा

यह AI कोडिंग टूल अब स्वतंत्र रूप से काम करेगा और केवल वास्तव में जोखिम भरे कदमों के लिए रुकेगा। परीक्षण में, यह दृष्टिकोण मनुष्यों की तुलना में बहुत अधिक विश्वसनीय रूप से हानिकारक कार्यों को पकड़ा।

AI2Day Newsdesk3 min read
Close-up, edge-to-edge 16:9 photograph of a glowing circuit board with streams of faintly visible text and code cascading across its surface in soft blue and wh
Share

मुख्य बातें

  • Anthropic 14 अगस्त, 2026 से Claude Code के Pro, Max, और Team खातों के लिए ऑटो मोड को डिफ़ॉल्ट बनाएगा।
  • 1,053 भुगतान किए गए परीक्षकों के एक अध्ययन में, ऑटो मोड ने 89% हानिकारक कार्यों को पकड़ा; मानव समीक्षकों ने केवल 13.6% को पकड़ा।
  • मानव उपयोगकर्ताओं ने मैनुअल समीक्षा के दौरान 97% अनुमति प्रॉम्प्ट को मंजूरी दी, जिससे पता चलता है कि नियमित क्लिक-थ्रू करना निरीक्षण को लगभग निरर्थक बना गया था।
  • Anthropic Claude Code में प्रॉम्प्ट इंजेक्शन स्क्रीनिंग और अनुकूलन योग्य कठोर अस्वीकार नियम भी जोड़ रहा है।

Anthropic लंबे समय से मान रहा है कि AI टूल्स को सुरक्षित रखने के लिए मनुष्य को लूप में रखना आवश्यक है। Anthropic के एक नए अध्ययन से पता चलता है कि कम से कम कुछ मामलों में विपरीत सत्य हो सकता है, खासकर जब प्रश्न में मनुष्य ने आज सौ बार समान अनुमोदन बॉक्स देखा हो।

14 अगस्त से, Claude Code, Anthropic का AI-संचालित कोडिंग सहायक जो आपकी ओर से कोड लिखता है, संपादित करता है, और चलाता है, Pro, Max, और Team योजनाओं पर उपयोगकर्ताओं के लिए डिफ़ॉल्ट रूप से ऑटो मोड चालू करेगा। ऑटो मोड का मतलब है कि टूल स्वतंत्र रूप से कार्य पूरा करता है और केवल तब रुकता है जब कोई कार्य अपरिवर्तनीय, विनाशकारी, या आपकी अपनी फाइलों और सिस्टम के बाहर लक्षित के रूप में वर्गीकृत हो।

Anthropic ने पहली बार मार्च 2026 में ऑटो मोड का परीक्षण किया था, इसे नियंत्रण का बलिदान किए बिना काम को आगे बढ़ाने के तरीके के रूप में प्रस्तुत किया था।

मानव अनुमोदन को हटाना वास्तव में चीजों को सुरक्षित कैसे बनाता है?

क्योंकि मनुष्य ध्यान देना बंद कर देते हैं। Anthropic के अध्ययन में, उपयोगकर्ताओं ने मैनुअल समीक्षा के दौरान उन्हें दिखाए गए 97% अनुमति प्रॉम्प्ट को मंजूरी दी। "हाँ" पर क्लिक करना असली जांच नहीं, बल्कि मांसपेशियों की स्मृति बन गई था।

इसके विपरीत, ऑटो मोड हर एक बार सुसंगत नियमों को लागू करता है। 1,053 भुगतान किए गए परीक्षकों के पार, इसने 89% हानिकारक कार्यों को सही तरीके से चिह्नित किया। मानव समीक्षकों ने समान कार्यों का केवल 13.6% पकड़ा।

Claude Code के प्रमुख Boris Cherny ने X पर एक पोस्ट में स्पष्ट रूप से कहा: "टीम और मैं विशेष रूप से ऑटो मोड का उपयोग करते हैं, और कई महीनों से कर रहे हैं। मैं अनुमति प्रॉम्प्ट पर वापस जाने की कल्पना नहीं कर सकता।"

उपयोगकर्ताओं को वास्तव में क्या देखना चाहिए?

ऑटो मोड आपके कंप्यूटर से दूर चलने का मुफ्त पास नहीं है जबकि Claude Code आपके कोडबेस को फिर से लिखता है।

टूल उन कार्यों से पहले रुकता है जिन्हें यह अपरिवर्तनीय या विनाशकारी मानता है, लेकिन वह निर्णय AI द्वारा किया जाता है, आपके द्वारा नहीं। नए "कठोर अस्वीकार" नियमों से परिचित होना, जो आपको कार्रवाई की विशिष्ट श्रेणियों को पूरी तरह से अवरुद्ध करने देते हैं, दस मिनट लगाने के लायक है।

Anthropic प्रॉम्प्ट इंजेक्शन स्क्रीनिंग भी चला रहा है। प्रॉम्प्ट इंजेक्शन एक हमला है जहां दुर्भावनापूर्ण निर्देश उस सामग्री के अंदर छिपे होते हैं जो AI पढ़ता है, जैसे वेबपेज या दस्तावेज़, इसे कुछ ऐसा करने के लिए धोखा देता है जो इसके उपयोगकर्ता ने कभी नहीं मांगा था। नई स्क्रीनिंग उन छिपे हुए आदेशों को पकड़ने के लिए डिज़ाइन की गई है इससे पहले कि वे यह प्रभावित करें कि टूल क्या करता है।

यदि आपका काम संवेदनशील डेटा, ग्राहक फाइलें, या उत्पादन सिस्टम से जुड़ा है जिन्हें आसानी से वापस नहीं किया जा सकता है, तो 14 अगस्त से पहले अपने कठोर अस्वीकार नियमों को सेट करें। ऑटो मोड को एक सक्षम सहायक के रूप में मानें जो तेजी से काम करता है और स्पष्ट सीमाओं की आवश्यकता है, न कि एक जो निरंतर हाथ पकड़ने की आवश्यकता है, लेकिन एक जिसे आप पूरी तरह से अनदेखा भी नहीं कर सकते।

© 2026 AI2Day