कॉपीराइट विवाद: AI कंपनियां क्यों खरीद रहीं पुरानी किताबें, पूरा मामला समझें
समझें क्या है पूरा मामला...
- AI कंपनियां किताबें खरीदकर स्कैन के बाद क्यों कर रहीं नष्ट।
- दुर्लभ किताबों की बाइंडिंग काटकर हो रही विनाशकारी स्कैनिंग।
- 2022 से पहले छपी किताबें बनीं AI कंपनियों की पहली पसंद।
- गूगल बुक्स से कितना अलग है आज का यह नया विवाद।
- भारत में AI किताब स्कैनिंग पर कॉपीराइट कानून अब भी अस्पष्ट।
ऑस्ट्रेलिया और यूरोप में कई बुकसेलर्स को किताबों की असामान्य मांग मिली है। इनमें दुर्लभ, पुरानी और सस्ती पेपरबैक किताबें भी शामिल हैं। बाद में पता चला कि ये किताबें AI मॉडल की ट्रेनिंग के लिए खरीदी जा रही हैं।
स्कैनिंग के दौरान कई किताबों की बाइंडिंग काटकर उन्हें नष्ट किया जा रहा है। इससे कॉपीराइट और सांस्कृतिक धरोहर को लेकर नया विवाद खड़ा हुआ है।
किताबों की तरफ क्यों बढ़ा AI कंपनियों का रुख
बीते कुछ वर्षों में चैटजीपीटी, जेमिनी और क्लॉड जैसी बड़ी AI कंपनियों ने इंटरनेट पर मौजूद अरबों शब्दों से अपने मॉडल ट्रेन किए हैं। लेकिन अब हालात बदल रहे हैं। कॉपीराइट को लेकर मुकदमे लगातार बढ़ रहे हैं। इसी वजह से कंपनियां अब भरोसेमंद और इंसानों की लिखी हाई क्वालिटी कंटेंट की तलाश में हैं।
गार्डियन की रिपोर्ट के अनुसार ऑस्ट्रेलिया के बुकसेलर्स को बिचौलियों के जरिए दुर्लभ और सस्ती किताबों की मांग मिली थी। फॉर्च्यून ने भी एक डच बुकसेलर से जुड़ी ऐसी ही घटना की जानकारी दी थी। इनमें से कई किताबों की दूसरी कॉपी तक उपलब्ध नहीं है।
एक्सपर्ट्स के मुताबिक साल 2022 से पहले छपी किताबें AI कंपनियों के लिए सबसे उपयोगी मानी जा रही हैं। वजह यह है कि इनमें लिखी सामग्री पूरी तरह मौलिक है, जबकि इंटरनेट पर अब AI जनरेटेड कंटेंट की भरमार हो चुकी है।
विनाशकारी स्कैनिंग क्या है
इस पूरे विवाद की असली वजह किताबें खरीदना नहीं, बल्कि उन्हें स्कैन करने का तरीका है। एक कॉपीराइट मुकदमे में सामने आए दस्तावेजों से इस प्रक्रिया का खुलासा हुआ, जिसे विनाशकारी स्कैनिंग कहा जाता है।
इस प्रक्रिया में पहले किताब की बाइंडिंग हटाकर हर पन्ना अलग किया जाता है। फिर पन्नों को हाई स्पीड स्कैनर से गुजारा जाता है। इसके बाद ऑप्टिकल कैरेक्टर रिकॉग्निशन तकनीक की मदद से इन्हें डिजिटल टेक्स्ट में बदला जाता है। यही टेक्स्ट बाद में AI मॉडल की ट्रेनिंग में इस्तेमाल होता है। कई मामलों में इसके बाद किताबों को रीसाइकिल या नष्ट कर दिया जाता है।
कंपनियां यह तरीका क्यों अपना रही हैं
कई किताबें डिजिटल प्लेटफॉर्म पर उपलब्ध ही नहीं हैं। जो उपलब्ध भी हैं, उन तक पहुंचना प्रकाशकों के अधिकारों के चलते मुश्किल होता है। हाथ से स्कैन करना धीमा और महंगा तरीका है।
बाइंडिंग काटने से पन्नों से टेक्स्ट निकालना ज्यादा आसान और सटीक हो जाता है। इससे कम समय और कम खर्च में बड़ी संख्या में किताबें डिजिटल बनाई जा सकती हैं। यही वजह है कि कंपनियां इस तरीके को तकनीकी और आर्थिक रूप से फायदेमंद मानती हैं।
हर संस्था यह तरीका नहीं अपनाती। इंटरनेट आर्काइव जैसी संस्था सालों से किताबों को डिजिटल कर रही है, लेकिन उसका दावा है कि वह ऐसे स्कैनर इस्तेमाल करती है जिनसे बाइंडिंग खोले बगैर स्कैनिंग हो जाती है। हालांकि यह तरीका महंगा माना जाता है।
किताब विक्रेताओं की चिंता
ऑस्ट्रेलिया, यूरोप और अन्य देशों के कई बुकसेलर्स ने बड़ी मात्रा में किताबों की खरीद देखी है। इसमें सीधे AI कंपनियां नहीं, बल्कि एजेंट और बिचौलिए शामिल रहे हैं। इनमें कई किताबें इतनी दुर्लभ थीं कि उनकी दूसरी कॉपी तक मौजूद नहीं थी। इससे यह आशंका भी जताई जा रही है कि सांस्कृतिक और साहित्यिक धरोहर को भी इस प्रक्रिया में नष्ट किया जा सकता है।
गूगल बुक्स से कितना अलग है यह विवाद
करीब दो दशक पहले गूगल ने गूगल बुक्स प्रोजेक्ट शुरू किया था। इसका मकसद दुनिया भर की किताबों को खोजने योग्य बनाना था। उस समय भी कॉपीराइट को लेकर लंबी कानूनी लड़ाई चली थी।
जानकारों का कहना है कि आज का मामला अलग है। गूगल बुक्स का लक्ष्य लोगों को किताबें खोजने और पढ़ने में मदद करना था। वहीं आज AI कंपनियों का मकसद किताबों को मशीन से पढ़े जाने वाले डेटा में बदलकर मॉडल ट्रेन करना है।
भारत में कानूनी स्थिति क्या है
दुनिया भर में यह बहस चल रही है कि किताबें खरीदकर उन्हें स्कैन कर AI ट्रेन करना कॉपीराइट कानून का उल्लंघन है या नहीं। भारत में अभी इस पर स्पष्ट स्थिति नहीं है।
भारत के कॉपीराइट एक्ट 1957 की धारा 52 में फेयर डीलिंग का प्रावधान है। इसके तहत रिसर्च, सेल्फ स्टडी, रिव्यू और न्यूज रिपोर्टिंग जैसे कामों के लिए कॉपीराइट कंटेंट का सीमित इस्तेमाल बिना अनुमति किया जा सकता है।
कुछ कानूनी जानकारों का मानना है कि अगर डिजिटाइजेशन सिर्फ AI ट्रेनिंग तक सीमित रहे और उसका कोई व्यावसायिक इस्तेमाल न हो, तो इसे उचित माना जा सकता है। हालांकि अंतिम फैसला अदालतों को ही करना होगा।
लेखकों और प्रकाशकों की आपत्ति
लेखकों और प्रकाशकों का कहना है कि उनकी किताबों का इस्तेमाल बिना सहमति के हो रहा है। उन्हें इसकी कोई रॉयल्टी भी नहीं मिलती। वहीं उन्हीं की सामग्री सीखकर AI आगे चलकर प्रतिस्पर्धी कंटेंट बना सकता है, जिससे क्रिएटिव इंडस्ट्री पर आर्थिक असर पड़ने की आशंका है।
इसी वजह से एक्सपर्ट्स AI से बने कंटेंट की स्पष्ट लेबलिंग की मांग कर रहे हैं। साथ ही लेखकों के लिए मुआवजा फंड बनाने और बिना लाइसेंस किताबों के इस्तेमाल पर रोक लगाने की भी बात कही जा रही है।
FAQ
- विनाशकारी स्कैनिंग क्या है?
विनाशकारी स्कैनिंग वह प्रक्रिया है जिसमें किताब की बाइंडिंग काटकर पन्ने अलग किए जाते हैं। फिर हाई स्पीड स्कैनर से उन्हें डिजिटल टेक्स्ट में बदला जाता है। इसके बाद कई बार किताब को रीसाइकिल या नष्ट कर दिया जाता है। - AI कंपनियां 2022 से पहले की किताबों को क्यों तरजीह दे रही हैं?
इन किताबों में लिखी सामग्री पूरी तरह मौलिक और इंसानों की लिखी होती है। इंटरनेट पर अब AI जनरेटेड कंटेंट की भरमार हो चुकी है। इसलिए पुरानी किताबें बेहतर ट्रेनिंग डेटा मानी जा रही हैं। - भारत में इस तरह की स्कैनिंग कानूनी है या नहीं?
भारत में अभी इस पर स्पष्ट कानून नहीं है। कॉपीराइट एक्ट 1957 की धारा 52 के तहत सीमित इस्तेमाल को फेयर डीलिंग माना जा सकता है। हालांकि अंतिम फैसला अदालतों पर निर्भर करेगा।
ये खबरें भी पढ़ें...
बारिश पर मजाक पड़ा महंगा, गुरुगाम में CARS24 को देना पड़ा 50 हजार चालान
लोन रिकवरी: एक जनवरी 2027 से आएंगे EMI वसूली के नए नियम, जानें बदलाव
तत्काल बुकिंग सिस्टम अब और आसान, एक मिनट में बुक होंगे एक लाख से ज्यादा टिकट
पर्सनैलिटी कल्ट: नेहरू और अंबेडकर की चेतावनी आज भी क्यों जरूरी है