कोर्ट दस्तावेज़ों में Anthropic की 'दुनिया की सभी किताबों को विनाशकारी रूप से स्कैन करने' की गुप्त योजना का खुलासा

एक कॉपीराइट मुकदमे में सामने आए आंतरिक ज्ञापन से पता चलता है कि Claude निर्माता ने एक गुप्त किताब-स्कैनिंग परियोजना चलाई जिसे उसने जानबूझकर एक कोडनेम के तहत छुपाया था।

AI2Day Newsdesk3 min read
Full-frame edge-to-edge photoreal news-editorial image of a darkened server room with rows of humming rack-mounted servers, one rack cordoned off with yellow po
Share

मुख्य बिंदु

  • उत्तरी कैलिफोर्निया में एक संघीय कोर्ट केस, Bartz v Anthropic PBC, ने जुलाई 2025 के अंत में Anthropic की "Project Panama" नामक एक आंतरिक परियोजना को उजागर किया।
  • एक आंतरिक ज्ञापन में परियोजना के लक्ष्य को "दुनिया की सभी किताबों को विनाशकारी रूप से स्कैन करना" बताया गया ताकि Claude, Anthropic के AI असिस्टेंट के लिए प्रशिक्षण डेटा एकत्र किया जा सके।
  • उसी ज्ञापन में कर्मचारियों को कोडनेम का उपयोग करने की चेतावनी दी गई क्योंकि Anthropic नहीं "चाहता था कि यह ज्ञात हो" कि यह काम चल रहा था।
  • यह परियोजना तब सामने आई जब AI कंपनियों को इस बारे में बढ़ते कानूनी दबाव का सामना करना पड़ रहा है कि क्या AI सिस्टम को प्रशिक्षित करने के लिए कॉपीराइट की गई किताबों का उपयोग करने के लिए लेखकों की अनुमति की आवश्यकता है।

Anthropic Claude बनाता है, जो एक बड़ा भाषा मॉडल है, यानी ऐसा सॉफ़्टवेयर जो विशाल मात्रा में पाठ पर प्रशिक्षित होता है और फिर बातचीत कर सकता है, सवालों के जवाब दे सकता है और लिख सकता है। सभी ऐसी प्रणालियों की तरह, Claude को सीखने के लिए विशाल मात्रा में लिखित सामग्री की आवश्यकता है। वह सामग्री कहाँ से आती है यह अब संयुक्त राज्य भर में मुकदमों का विषय है।

उत्तरी कैलिफोर्निया जिले में Bartz v Anthropic में कोर्ट प्रदर्शन 21 में एक आंतरिक ज्ञापन है जो स्पष्टता से पूछता है: "Project Panama क्या है?" इसके अंदर लिखा उत्तर: "Project Panama दुनिया की सभी किताबों को विनाशकारी रूप से स्कैन करने का हमारा प्रयास है।"

"विनाशकारी" यहाँ किताब-स्कैनिंग दुनिया से एक तकनीकी शब्द है। इसका मतलब है कि भौतिक किताब की रीढ़ को काट दिया जाए ताकि पृष्ठों को स्कैनर के माध्यम से तेजी से खिलाया जा सके। इस प्रक्रिया में किताब बर्बाद हो जाती है। यह फ्लैटबेड स्कैनिंग की तुलना में तेजी से और सस्ता है, लेकिन फिर भी यह लेखक की सहमति के बिना एक कॉपीराइट वस्तु को स्कैन कर रहा है।

ज्ञापन परियोजना का वर्णन करने पर रुकता नहीं है। यह यह भी समझाता है कि कोडनेम का उपयोग क्यों किया गया। "[क्योंकि] हम नहीं चाहते कि यह ज्ञात हो कि हम इस पर काम कर रहे हैं," यह कहता है। वह पंक्ति अब एक सार्वजनिक कोर्ट फाइलिंग में बैठी है।

यह लेखकों और पाठकों के लिए क्यों महत्वपूर्ण है?

जिन लेखकों की किताबें स्कैन की गईं उन्हें कोई कहना नहीं है और कोई भुगतान नहीं मिलता। संयुक्त राज्य में कॉपीराइट कानून निर्माताओं को अपने काम को पुनः प्रस्तुत करने का एक्सक्लूसिव अधिकार देता है। क्या एक स्कैन की गई किताब को AI प्रशिक्षण पाइपलाइन में डालना उस तरह का पुनः प्रस्तुतिकरण गिना जाता है यह ठीक वही है जो कोर्ट अभी काम कर रहे हैं।

Bartz मामला, जिसे पहले The Guardian ने रिपोर्ट किया था, इस प्रश्न का परीक्षण करने वाले कई सक्रिय मामलों में से एक है। Anthropic के विरुद्ध एक निर्णय इसे उन किताबों को लाइसेंस देने के लिए मजबूर कर सकता है जिन्हें यह पहले ही उपयोग कर चुका है, नुकसान का भुगतान कर सकता है, या भविष्य में प्रशिक्षण डेटा कैसे एकत्र करता है यह बदल सकता है।

पाठकों और Claude उपयोगकर्ताओं के लिए, तत्काल व्यावहारिक प्रभाव छोटा है: मुकदमेबाजी के दौरान सेवा चलती रहती है। लेकिन अगर कोर्ट लगातार लेखकों के पक्ष में फैसला करते हैं, तो AI सिस्टम को प्रशिक्षित करने की लागत में तेजी से वृद्धि हो सकती है, जो यह प्रभावित करेगी कि कौन सी कंपनियां उन्हें बनाने का खर्च कर सकती हैं।

आगे क्या होता है?

मामला अभी भी सक्रिय है। दायित्व पर कोई अंतिम निर्णय नहीं दिया गया है। Anthropic ने Project Panama ज्ञापन पर सार्वजनिक रूप से कोई टिप्पणी नहीं की है।

जिन लेखकों को लगता है कि उनके काम का उपयोग सहमति के बिना किया गया था, वे यह देख सकते हैं कि क्या उनके शीर्षक उन डेटासेट में दिखाई देते हैं जो शोधकर्ता सार्वजनिक कर चुके हैं, हालांकि अभी तक Anthropic के प्रशिक्षण स्रोतों की कोई संपूर्ण सूची मौजूद नहीं है।

AI प्रशिक्षण डेटा के बारे में व्यापक कानूनी लड़ाई तेजी से आगे बढ़ रही है। कांग्रेस ने सुनवाई की है, और कई विधेयक प्रस्तावित हैं, हालांकि कोई भी पारित नहीं हुए हैं, जो AI कंपनियों को यह प्रकट करने की आवश्यकता देंगे कि उन्होंने किस कॉपीराइट सामग्री पर प्रशिक्षण दिया।

सामान्य प्रश्न

क्या Anthropic यह स्वीकार करना मतलब है कि इसने कानून तोड़ा?

अनिवार्य नहीं। AI प्रशिक्षण के लिए कॉपीराइट सामग्री का उपयोग "उचित उपयोग" के रूप में योग्य हो सकता है, एक कानूनी अपवाद जो बिना अनुमति के सीमित पुनः प्रस्तुतिकरण की अनुमति देता है। कोर्ट अभी भी तय कर रहे हैं कि क्या वह बचाव यहाँ लागू होता है।

क्या यह अन्य AI कंपनियों को प्रभावित कर सकता है?

हाँ। समान मुकदमे प्रशिक्षण डेटा के बारे में OpenAI, Meta और अन्य को निशाना बनाते हैं। Bartz में एक फैसला एक पूर्वदृष्टांत तय करेगा जिसे वे सभी बारीकी से देख रहे हैं।

© 2026 AI2Day