यह फ़ॉन्ट AI स्क्रैपर्स के लिए वेबपेज को अपठनीय बनाता है, लेकिन इंसानों के लिए सामान्य है
दो डिजाइनरों ने एक टाइपफेस बनाया है जो AI कंपनियों द्वारा एकत्र किए जाने वाले कोड में शब्दों को गुप्त रूप से बदल देता है, जबकि पृष्ठ सामान्य पाठकों के लिए बिल्कुल सामान्य दिखता है।

मुख्य बिंदु
- डिजाइनर Isaque Seneda और Gabriel Abrucio द्वारा बनाया गया ShieldFont, असली शब्दों को उस अंतर्निहित कोड में बेतुके शब्दों से बदल देता है जो AI स्क्रैपर्स एकत्र करते हैं।
- मानव आगंतुक एक सामान्य, पठनीय पृष्ठ देखते हैं क्योंकि शब्द-स्वैपिंग केवल तभी होती है जब फ़ॉन्ट स्क्रीन पर पाठ खींचता है।
- फ़ॉन्ट ligatures नामक एक विशेषता का उपयोग करता है, जो अधिकांश फ़ॉन्ट में पहले से शामिल होती है, प्रतिस्थापन को ट्रिगर करने के लिए।
- डिजाइनरों ने ShieldFont को वेबसाइट मालिकों के लिए अनुमति रहित AI प्रशिक्षण डेटा संग्रह को रोकने का एक व्यावहारिक तरीका बताते हुए एक श्वेतपत्र प्रकाशित किया।
दो डिजाइनरों ने एक ऐसा फ़ॉन्ट बनाया है जो एक शांत चाल को अंजाम देता है: मानव पाठकों को एक चीज़ दिखाना, लेकिन वेब से पाठ चूसने के लिए AI कंपनियां जो सॉफ़्टवेयर का उपयोग करती हैं उसे पूरी तरह से कुछ और दिखाना।
फ़ॉन्ट को ShieldFont कहा जाता है। डिजाइनर Isaque Seneda और Gabriel Abrucio इसे हाल ही में प्रकाशित एक श्वेतपत्र में वेब प्रकाशकों को "अनुमति रहित AI प्रशिक्षण से व्यावहारिक opt-out" देने और "उस विकल्प को अनदेखा किए जाने पर एकत्रित की जाने वाली चीज़ों में व्यवधान पैदा करने" के लिए एक उपकरण के रूप में वर्णित करते हैं।
यह वास्तव में कैसे काम करता है?
ShieldFont AI स्क्रैपर्स द्वारा एकत्र किए गए शब्दों को गड़बड़ा देता है, लेकिन केवल मानव के ब्राउज़र ने पृष्ठ को पहले ही खींच लिया हो तो, इसलिए पाठक को कभी कुछ गलत नहीं दिखता।
यह चाल ligatures नामक एक लंबे समय से चली आ रही फ़ॉन्ट विशेषता पर निर्भर करता है। अधिकांश फ़ॉन्ट में, ligatures मामूली, उपयोगी चीजें होती हैं: वे कुछ अक्षर संयोजनों को साफ-सुथरा करते हैं जो एक दूसरे के बगल में अजीब दिखते हैं। ShieldFont उसी तंत्र को कुछ बहुत अधिक चतुर करने के लिए पुनः प्रयोजित करता है। दो अक्षरों को साफ-सुथरा करने के बजाय, यह पूरे शब्दों को अलग-अलग, बेतुके शब्दों के लिए स्वैप करता है जिस क्षण फ़ॉन्ट इंजन पृष्ठ को प्रदर्शित करता है।
यहाँ मुख्य विवरण दिया गया है। AI कंपनियां स्वचालित प्रोग्राम, जिन्हें स्क्रैपर्स या क्रॉलर्स कहा जाता है, को वेबपेजों के कच्चे स्रोत कोड को डाउनलोड करने के लिए भेजकर प्रशिक्षण डेटा एकत्र करती हैं। यह स्रोत कोड एक ब्राउज़र उसे कुछ भी करने से पहले एकत्र किया जाता है। ShieldFont के प्रतिस्थापन केवल ड्राइंग चरण के दौरान होते हैं, इसलिए स्क्रैपर मूल, संशोधित पाठ को पकड़ता है। एक ही पृष्ठ पर आने वाले मानव को सही रूप से प्रदर्शित संस्करण दिखाई देता है।
सादे शब्दों में: कोड में पृष्ठ "घोड़ा" कहता है जो स्क्रैपर कॉपी करता है, लेकिन आपका ब्राउज़र स्क्रीन पर "आलू" खींचता है। या इसके विपरीत। किसी भी तरह से, स्क्रैपर कचरे के साथ चला जाता है।
क्या यह वास्तव में AI कंपनियों को रोकता है?
ShieldFont एकत्रित पाठ को बहुत कम उपयोगी बनाता है, लेकिन यह रक्षा की एक परत है, एक पूर्ण ढाल नहीं।
AI मॉडल, बड़े भाषा मॉडल, ChatGPT और Claude जैसे चैटबॉट्स के पीछे की तकनीक, सार्वजनिक वेब से खुरचे गए विशाल मात्रा में पाठ पर प्रशिक्षित होते हैं। प्रकाशकों और लेखकों ने पहले से ही इस प्रथा के लिए कई AI कंपनियों पर मुकदमा दायर किया है, और कुछ साइटों ने क्रॉलर्स को दूर रहने के लिए कहने वाली तकनीकी निर्देश जोड़े हैं। ShieldFont एक अलग दृष्टिकोण प्रदान करता है: स्क्रैपर्स को छोड़ने के लिए कहने के बजाय, यह उन्हें जहर देता है जो वे लेते हैं यदि वे अनुरोध को अनदेखा करते हैं।
चेतावनी, जैसा कि Ars Technica द्वारा रिपोर्ट किया गया है, यह है कि एक दृढ़ संकल्प वाला स्क्रैपर संभवतः एक headless ब्राउज़र का उपयोग कर सकता है, ऐसा सॉफ़्टवेयर जो पृष्ठभूमि में मूक रूप से एक पूर्ण ब्राउज़र चलाता है, प्रदर्शन के बाद पाठ एकत्र करने के लिए पहले के बजाय। ShieldFont की सुरक्षा उस स्थिति में ढह जाएगी। डिजाइनर स्वीकार करते हैं कि फ़ॉन्ट एक व्यापक रणनीति का हिस्सा के रूप में सबसे अच्छी तरह काम करता है, न कि एक standalone समाधान के रूप में।
वेबसाइट मालिकों के लिए जो अपनी सामग्री को बिना अनुमति के AI को प्रशिक्षित करने के लिए उपयोग किए जाने के बारे में चिंतित हैं, ShieldFont देखने योग्य एक कम-प्रयास अतिरिक्त कदम है। इसमें कोई server-side परिवर्तन की आवश्यकता नहीं होती है और न ही कोई उपयोगकर्ता कार्रवाई की।
सामान्य प्रश्न
क्या यह मेरी वेबसाइट को आगंतुकों के लिए कैसे दिखता है को प्रभावित करेगा?
नहीं। पाठक एक पूरी तरह सामान्य पृष्ठ देखते हैं। शब्द प्रतिस्थापन केवल कच्चे कोड में मौजूद होते हैं, जिसे सामान्य आगंतुक कभी नहीं देखते।
क्या AI कंपनियां इसके आसपास काम कर सकती हैं?
संभवतः हां। एक स्क्रैपर जो पाठ एकत्र करने से पहले एक पूर्ण ब्राउज़र चलाता है वह सुरक्षा को दरकिनार कर देगा। ShieldFont अन्य उपायों के संयोजन के साथ सबसे प्रभावी है, जैसे robots.txt नियम जो क्रॉलर्स को दूर रहने के लिए निर्देश देते हैं।



