कोर्ट दस्तावेज़ों में Anthropic की 'दुनिया की सभी किताबों को विनाशकारी रूप से स्कैन करने' की गुप्त योजना का खुलासा
एक कॉपीराइट मुकदमे में सामने आए आंतरिक ज्ञापन से पता चलता है कि Claude निर्माता ने एक गुप्त किताब-स्कैनिंग परियोजना चलाई जिसे उसने जानबूझकर एक कोडनेम के तहत छुपाया था।

मुख्य बिंदु
- उत्तरी कैलिफोर्निया में एक संघीय कोर्ट केस, Bartz v Anthropic PBC, ने जुलाई 2025 के अंत में Anthropic की "Project Panama" नामक एक आंतरिक परियोजना को उजागर किया।
- एक आंतरिक ज्ञापन में परियोजना के लक्ष्य को "दुनिया की सभी किताबों को विनाशकारी रूप से स्कैन करना" बताया गया ताकि Claude, Anthropic के AI असिस्टेंट के लिए प्रशिक्षण डेटा एकत्र किया जा सके।
- उसी ज्ञापन में कर्मचारियों को कोडनेम का उपयोग करने की चेतावनी दी गई क्योंकि Anthropic नहीं "चाहता था कि यह ज्ञात हो" कि यह काम चल रहा था।
- यह परियोजना तब सामने आई जब AI कंपनियों को इस बारे में बढ़ते कानूनी दबाव का सामना करना पड़ रहा है कि क्या AI सिस्टम को प्रशिक्षित करने के लिए कॉपीराइट की गई किताबों का उपयोग करने के लिए लेखकों की अनुमति की आवश्यकता है।
Anthropic Claude बनाता है, जो एक बड़ा भाषा मॉडल है, यानी ऐसा सॉफ़्टवेयर जो विशाल मात्रा में पाठ पर प्रशिक्षित होता है और फिर बातचीत कर सकता है, सवालों के जवाब दे सकता है और लिख सकता है। सभी ऐसी प्रणालियों की तरह, Claude को सीखने के लिए विशाल मात्रा में लिखित सामग्री की आवश्यकता है। वह सामग्री कहाँ से आती है यह अब संयुक्त राज्य भर में मुकदमों का विषय है।
उत्तरी कैलिफोर्निया जिले में Bartz v Anthropic में कोर्ट प्रदर्शन 21 में एक आंतरिक ज्ञापन है जो स्पष्टता से पूछता है: "Project Panama क्या है?" इसके अंदर लिखा उत्तर: "Project Panama दुनिया की सभी किताबों को विनाशकारी रूप से स्कैन करने का हमारा प्रयास है।"
"विनाशकारी" यहाँ किताब-स्कैनिंग दुनिया से एक तकनीकी शब्द है। इसका मतलब है कि भौतिक किताब की रीढ़ को काट दिया जाए ताकि पृष्ठों को स्कैनर के माध्यम से तेजी से खिलाया जा सके। इस प्रक्रिया में किताब बर्बाद हो जाती है। यह फ्लैटबेड स्कैनिंग की तुलना में तेजी से और सस्ता है, लेकिन फिर भी यह लेखक की सहमति के बिना एक कॉपीराइट वस्तु को स्कैन कर रहा है।
ज्ञापन परियोजना का वर्णन करने पर रुकता नहीं है। यह यह भी समझाता है कि कोडनेम का उपयोग क्यों किया गया। "[क्योंकि] हम नहीं चाहते कि यह ज्ञात हो कि हम इस पर काम कर रहे हैं," यह कहता है। वह पंक्ति अब एक सार्वजनिक कोर्ट फाइलिंग में बैठी है।
यह लेखकों और पाठकों के लिए क्यों महत्वपूर्ण है?
जिन लेखकों की किताबें स्कैन की गईं उन्हें कोई कहना नहीं है और कोई भुगतान नहीं मिलता। संयुक्त राज्य में कॉपीराइट कानून निर्माताओं को अपने काम को पुनः प्रस्तुत करने का एक्सक्लूसिव अधिकार देता है। क्या एक स्कैन की गई किताब को AI प्रशिक्षण पाइपलाइन में डालना उस तरह का पुनः प्रस्तुतिकरण गिना जाता है यह ठीक वही है जो कोर्ट अभी काम कर रहे हैं।
Bartz मामला, जिसे पहले The Guardian ने रिपोर्ट किया था, इस प्रश्न का परीक्षण करने वाले कई सक्रिय मामलों में से एक है। Anthropic के विरुद्ध एक निर्णय इसे उन किताबों को लाइसेंस देने के लिए मजबूर कर सकता है जिन्हें यह पहले ही उपयोग कर चुका है, नुकसान का भुगतान कर सकता है, या भविष्य में प्रशिक्षण डेटा कैसे एकत्र करता है यह बदल सकता है।
पाठकों और Claude उपयोगकर्ताओं के लिए, तत्काल व्यावहारिक प्रभाव छोटा है: मुकदमेबाजी के दौरान सेवा चलती रहती है। लेकिन अगर कोर्ट लगातार लेखकों के पक्ष में फैसला करते हैं, तो AI सिस्टम को प्रशिक्षित करने की लागत में तेजी से वृद्धि हो सकती है, जो यह प्रभावित करेगी कि कौन सी कंपनियां उन्हें बनाने का खर्च कर सकती हैं।
आगे क्या होता है?
मामला अभी भी सक्रिय है। दायित्व पर कोई अंतिम निर्णय नहीं दिया गया है। Anthropic ने Project Panama ज्ञापन पर सार्वजनिक रूप से कोई टिप्पणी नहीं की है।
जिन लेखकों को लगता है कि उनके काम का उपयोग सहमति के बिना किया गया था, वे यह देख सकते हैं कि क्या उनके शीर्षक उन डेटासेट में दिखाई देते हैं जो शोधकर्ता सार्वजनिक कर चुके हैं, हालांकि अभी तक Anthropic के प्रशिक्षण स्रोतों की कोई संपूर्ण सूची मौजूद नहीं है।
AI प्रशिक्षण डेटा के बारे में व्यापक कानूनी लड़ाई तेजी से आगे बढ़ रही है। कांग्रेस ने सुनवाई की है, और कई विधेयक प्रस्तावित हैं, हालांकि कोई भी पारित नहीं हुए हैं, जो AI कंपनियों को यह प्रकट करने की आवश्यकता देंगे कि उन्होंने किस कॉपीराइट सामग्री पर प्रशिक्षण दिया।
सामान्य प्रश्न
क्या Anthropic यह स्वीकार करना मतलब है कि इसने कानून तोड़ा?
अनिवार्य नहीं। AI प्रशिक्षण के लिए कॉपीराइट सामग्री का उपयोग "उचित उपयोग" के रूप में योग्य हो सकता है, एक कानूनी अपवाद जो बिना अनुमति के सीमित पुनः प्रस्तुतिकरण की अनुमति देता है। कोर्ट अभी भी तय कर रहे हैं कि क्या वह बचाव यहाँ लागू होता है।
क्या यह अन्य AI कंपनियों को प्रभावित कर सकता है?
हाँ। समान मुकदमे प्रशिक्षण डेटा के बारे में OpenAI, Meta और अन्य को निशाना बनाते हैं। Bartz में एक फैसला एक पूर्वदृष्टांत तय करेगा जिसे वे सभी बारीकी से देख रहे हैं।



