कॉपीराइट विवाद: AI कंपनियां क्यों खरीद रहीं पुरानी किताबें, पूरा मामला समझें

Jitendra Shrivastava | Aug 11, 2026, 23:56 IST
Photograph: (THESOOTR)
INTERNATIONAL DESK. AI कंपनियां मॉडल ट्रेनिंग के लिए दुर्लभ और पुरानी किताबें बड़ी संख्या में खरीद रही हैं। स्कैनिंग के बाद कई किताबों की बाइंडिंग काटकर उन्हें नष्ट किया जा रहा है।

समझें क्या है पूरा मामला...

  • AI कंपनियां किताबें खरीदकर स्कैन के बाद क्यों कर रहीं नष्ट।
  • दुर्लभ किताबों की बाइंडिंग काटकर हो रही विनाशकारी स्कैनिंग।
  • 2022 से पहले छपी किताबें बनीं AI कंपनियों की पहली पसंद।
  • गूगल बुक्स से कितना अलग है आज का यह नया विवाद।
  • भारत में AI किताब स्कैनिंग पर कॉपीराइट कानून अब भी अस्पष्ट।

ऑस्ट्रेलिया और यूरोप में कई बुकसेलर्स को किताबों की असामान्य मांग मिली है। इनमें दुर्लभ, पुरानी और सस्ती पेपरबैक किताबें भी शामिल हैं। बाद में पता चला कि ये किताबें AI मॉडल की ट्रेनिंग के लिए खरीदी जा रही हैं।



स्कैनिंग के दौरान कई किताबों की बाइंडिंग काटकर उन्हें नष्ट किया जा रहा है। इससे कॉपीराइट और सांस्कृतिक धरोहर को लेकर नया विवाद खड़ा हुआ है।



किताबों की तरफ क्यों बढ़ा AI कंपनियों का रुख

बीते कुछ वर्षों में चैटजीपीटी, जेमिनी और क्लॉड जैसी बड़ी AI कंपनियों ने इंटरनेट पर मौजूद अरबों शब्दों से अपने मॉडल ट्रेन किए हैं। लेकिन अब हालात बदल रहे हैं। कॉपीराइट को लेकर मुकदमे लगातार बढ़ रहे हैं। इसी वजह से कंपनियां अब भरोसेमंद और इंसानों की लिखी हाई क्वालिटी कंटेंट की तलाश में हैं।



गार्डियन की रिपोर्ट के अनुसार ऑस्ट्रेलिया के बुकसेलर्स को बिचौलियों के जरिए दुर्लभ और सस्ती किताबों की मांग मिली थी। फॉर्च्यून ने भी एक डच बुकसेलर से जुड़ी ऐसी ही घटना की जानकारी दी थी। इनमें से कई किताबों की दूसरी कॉपी तक उपलब्ध नहीं है।



एक्सपर्ट्स के मुताबिक साल 2022 से पहले छपी किताबें AI कंपनियों के लिए सबसे उपयोगी मानी जा रही हैं। वजह यह है कि इनमें लिखी सामग्री पूरी तरह मौलिक है, जबकि इंटरनेट पर अब AI जनरेटेड कंटेंट की भरमार हो चुकी है।



विनाशकारी स्कैनिंग क्या है

इस पूरे विवाद की असली वजह किताबें खरीदना नहीं, बल्कि उन्हें स्कैन करने का तरीका है। एक कॉपीराइट मुकदमे में सामने आए दस्तावेजों से इस प्रक्रिया का खुलासा हुआ, जिसे विनाशकारी स्कैनिंग कहा जाता है।



इस प्रक्रिया में पहले किताब की बाइंडिंग हटाकर हर पन्ना अलग किया जाता है। फिर पन्नों को हाई स्पीड स्कैनर से गुजारा जाता है। इसके बाद ऑप्टिकल कैरेक्टर रिकॉग्निशन तकनीक की मदद से इन्हें डिजिटल टेक्स्ट में बदला जाता है। यही टेक्स्ट बाद में AI मॉडल की ट्रेनिंग में इस्तेमाल होता है। कई मामलों में इसके बाद किताबों को रीसाइकिल या नष्ट कर दिया जाता है।



कंपनियां यह तरीका क्यों अपना रही हैं

कई किताबें डिजिटल प्लेटफॉर्म पर उपलब्ध ही नहीं हैं। जो उपलब्ध भी हैं, उन तक पहुंचना प्रकाशकों के अधिकारों के चलते मुश्किल होता है। हाथ से स्कैन करना धीमा और महंगा तरीका है।



बाइंडिंग काटने से पन्नों से टेक्स्ट निकालना ज्यादा आसान और सटीक हो जाता है। इससे कम समय और कम खर्च में बड़ी संख्या में किताबें डिजिटल बनाई जा सकती हैं। यही वजह है कि कंपनियां इस तरीके को तकनीकी और आर्थिक रूप से फायदेमंद मानती हैं।



हर संस्था यह तरीका नहीं अपनाती। इंटरनेट आर्काइव जैसी संस्था सालों से किताबों को डिजिटल कर रही है, लेकिन उसका दावा है कि वह ऐसे स्कैनर इस्तेमाल करती है जिनसे बाइंडिंग खोले बगैर स्कैनिंग हो जाती है। हालांकि यह तरीका महंगा माना जाता है।



किताब विक्रेताओं की चिंता

ऑस्ट्रेलिया, यूरोप और अन्य देशों के कई बुकसेलर्स ने बड़ी मात्रा में किताबों की खरीद देखी है। इसमें सीधे AI कंपनियां नहीं, बल्कि एजेंट और बिचौलिए शामिल रहे हैं। इनमें कई किताबें इतनी दुर्लभ थीं कि उनकी दूसरी कॉपी तक मौजूद नहीं थी। इससे यह आशंका भी जताई जा रही है कि सांस्कृतिक और साहित्यिक धरोहर को भी इस प्रक्रिया में नष्ट किया जा सकता है।



गूगल बुक्स से कितना अलग है यह विवाद

करीब दो दशक पहले गूगल ने गूगल बुक्स प्रोजेक्ट शुरू किया था। इसका मकसद दुनिया भर की किताबों को खोजने योग्य बनाना था। उस समय भी कॉपीराइट को लेकर लंबी कानूनी लड़ाई चली थी।



जानकारों का कहना है कि आज का मामला अलग है। गूगल बुक्स का लक्ष्य लोगों को किताबें खोजने और पढ़ने में मदद करना था। वहीं आज AI कंपनियों का मकसद किताबों को मशीन से पढ़े जाने वाले डेटा में बदलकर मॉडल ट्रेन करना है।



भारत में कानूनी स्थिति क्या है

दुनिया भर में यह बहस चल रही है कि किताबें खरीदकर उन्हें स्कैन कर AI ट्रेन करना कॉपीराइट कानून का उल्लंघन है या नहीं। भारत में अभी इस पर स्पष्ट स्थिति नहीं है।



भारत के कॉपीराइट एक्ट 1957 की धारा 52 में फेयर डीलिंग का प्रावधान है। इसके तहत रिसर्च, सेल्फ स्टडी, रिव्यू और न्यूज रिपोर्टिंग जैसे कामों के लिए कॉपीराइट कंटेंट का सीमित इस्तेमाल बिना अनुमति किया जा सकता है।



कुछ कानूनी जानकारों का मानना है कि अगर डिजिटाइजेशन सिर्फ AI ट्रेनिंग तक सीमित रहे और उसका कोई व्यावसायिक इस्तेमाल न हो, तो इसे उचित माना जा सकता है। हालांकि अंतिम फैसला अदालतों को ही करना होगा।



लेखकों और प्रकाशकों की आपत्ति

लेखकों और प्रकाशकों का कहना है कि उनकी किताबों का इस्तेमाल बिना सहमति के हो रहा है। उन्हें इसकी कोई रॉयल्टी भी नहीं मिलती। वहीं उन्हीं की सामग्री सीखकर AI आगे चलकर प्रतिस्पर्धी कंटेंट बना सकता है, जिससे क्रिएटिव इंडस्ट्री पर आर्थिक असर पड़ने की आशंका है।



इसी वजह से एक्सपर्ट्स AI से बने कंटेंट की स्पष्ट लेबलिंग की मांग कर रहे हैं। साथ ही लेखकों के लिए मुआवजा फंड बनाने और बिना लाइसेंस किताबों के इस्तेमाल पर रोक लगाने की भी बात कही जा रही है।



FAQ

  1. विनाशकारी स्कैनिंग क्या है?
    विनाशकारी स्कैनिंग वह प्रक्रिया है जिसमें किताब की बाइंडिंग काटकर पन्ने अलग किए जाते हैं। फिर हाई स्पीड स्कैनर से उन्हें डिजिटल टेक्स्ट में बदला जाता है। इसके बाद कई बार किताब को रीसाइकिल या नष्ट कर दिया जाता है।
  2. AI कंपनियां 2022 से पहले की किताबों को क्यों तरजीह दे रही हैं?
    इन किताबों में लिखी सामग्री पूरी तरह मौलिक और इंसानों की लिखी होती है। इंटरनेट पर अब AI जनरेटेड कंटेंट की भरमार हो चुकी है। इसलिए पुरानी किताबें बेहतर ट्रेनिंग डेटा मानी जा रही हैं।
  3. भारत में इस तरह की स्कैनिंग कानूनी है या नहीं?
    भारत में अभी इस पर स्पष्ट कानून नहीं है। कॉपीराइट एक्ट 1957 की धारा 52 के तहत सीमित इस्तेमाल को फेयर डीलिंग माना जा सकता है। हालांकि अंतिम फैसला अदालतों पर निर्भर करेगा।

ये खबरें भी पढ़ें...



बारिश पर मजाक पड़ा महंगा, गुरुगाम में CARS24 को देना पड़ा 50 हजार चालान



लोन रिकवरी: एक जनवरी 2027 से आएंगे EMI वसूली के नए नियम, जानें बदलाव



तत्काल बुकिंग सिस्टम अब और आसान, एक मिनट में बुक होंगे एक लाख से ज्यादा टिकट



पर्सनैलिटी कल्ट: नेहरू और अंबेडकर की चेतावनी आज भी क्यों जरूरी है



Tags:
  • AI
  • गूगल
  • डिजिटाइजेशन
  • स्कैनिंग
  • कॉपीराइट एक्ट