न्यायाधीश ने Google की यह कोशिश खारिज की कि DMCA के सहारे उसे स्क्रैप होने से बचाया जाए
हालिया U.S. अदालत का निर्णय, जिसमें SerpApi—एक सेवा जो Google search results को स्क्रैप करती है—के खिलाफ Google के DMCA दावे को खारिज किया गया, इस बात की एक महत्वपूर्ण पुष्टि के रूप में देखा जा रहा है कि सार्वजनिक search result pages को कानूनी रूप से स्क्रैप किया जा सकता है। टिप्पणीकार विडंबना को रेखांकित करते हैं कि Google, जिसकी प्रभुत्वशाली स्थिति खुले web को crawling करके बनी, अब दूसरों को अपनी ही pages को index करने से रोकना चाहता है, जबकि कोई मजबूत public search API भी नहीं देता। इस ruling को AI training, search में competition, scam ads के लिए platform liability, और indexes तथा model outputs की copyright स्थिति पर व्यापक प्रभाव वाला माना जा रहा है.
समझी गई पाखंडपूर्ण स्थिति और स्क्रैपिंग की प्रकृति
- बहुतों को इसमें विडंबना दिखती है कि Google, जो बड़े पैमाने पर वेब स्क्रैपिंग पर बना है, अब अपनी SERPs की स्क्रैपिंग को रोकने की कोशिश कर रहा है।
- कुछ का तर्क है कि Google की क्रॉलिंग “ज़्यादा नरम” है (robots.txt, CAPTCHA तोड़ना नहीं) बनिस्बत SerpAPI के कथित रूप से वितरित प्रॉक्सी के उपयोग और bot-blocked साइटों की स्क्रैपिंग के।
- अन्य लोग नोट करते हैं कि Google की बाज़ार-शक्ति का मतलब है कि साइटें व्यवहारतः उसके bots को अनुमति देने के लिए मजबूर हैं, इसलिए “robots.txt का सम्मान” कहानी का केवल एक हिस्सा है।
सर्च परिणामों की स्क्रैपिंग की कानूनी स्थिति
- कई टिप्पणीकार कहते हैं कि Google SERPs की स्क्रैपिंग संभवतः हमेशा से कानूनी रही है, हालांकि Google इसे तकनीकी और संविदात्मक रूप से रोकने की लड़ाई जारी रखेगा।
- एक मुख्य निष्कर्ष: DMCA कॉपीराइटेड सामग्री के बारे में है; केवल सर्च indexes/URLs शायद इसके दायरे में न आएँ, इसलिए यहाँ DMCA एक कमजोर उपकरण है।
- कुछ लोग बताते हैं कि U.S. और EU के antitrust कदम पहले से ही Google को “qualified competitors” के साथ सर्च डेटा साझा करने के लिए धकेल रहे हैं।
सर्च APIs, पहुँच, और प्रतिस्पर्धा
- इस बात पर निराशा कि Google ने अपने सार्वजनिक search APIs बंद कर दिए, जिससे डेवलपर्स SerpAPI जैसे scrapers की ओर गए।
- कुछ लोग चाहते हैं कि सरकारें सार्वजनिक search indexes अनिवार्य करें।
- Gemini “search grounding” को बहुत प्रतिबंधित और कड़े नियंत्रण वाला माना जा रहा है।
AI प्रशिक्षण और मॉडलों पर प्रभाव
- चर्चा है कि यह precedent यह संकेत दे सकता है कि AI model weights और distilled outputs पर भी कॉपीराइट पाना कठिन है, लेकिन इसे अटकल/अस्पष्ट बताया गया है।
- यह सवाल भी उठा कि “frontier labs” ने ऐतिहासिक रूप से प्रशिक्षण के लिए डेटा कैसे क्रॉल किया है और वे इस बारे में कितने पारदर्शी हैं।
विज्ञापन, धोखाधड़ी, और प्लेटफ़ॉर्म ज़िम्मेदारी
- SERPs में scam वाले ads को लेकर गहरी चिंता है (जैसे visa/registry scams)।
- इस पर बहस कि क्या प्लेटफ़ॉर्म्स को अपने ad networks में fraud के लिए ज़िम्मेदार ठहराया जाना चाहिए:
- एक पक्ष DMCA-शैली के safe harbors जैसी मजबूत ज़िम्मेदारी और वास्तविक प्रवर्तन चाहता है।
- दूसरे कहते हैं कि मुख्य दोष scammers पर ही रहना चाहिए, प्लेटफ़ॉर्म्स को “private police” नहीं बनाना चाहिए।
- Section 230 पर विवाद है: कुछ कहते हैं इसका गलत उपयोग हो रहा है, अन्य कहते हैं कि ad-driven platforms के लिए यह संरचनात्मक रूप से टूटा हुआ है।
कॉपीराइट, DMCA, और database rights
- DMCA की व्यापक रूप से आलोचना की गई; कुछ लोग तो copyright को ही समाप्त करने की बात करते हैं, जबकि अन्य आर्थिक झटके की चेतावनी देते हैं।
- EU database rights और U.S. originality standard की तुलना की गई; ranked search results “सिर्फ facts” हैं या रचनात्मक चयन, इस पर धुंधलापन है।
- Maps और PageRank को इस बात के edge cases के रूप में चर्चा में लाया गया कि क्या कॉपीराइट योग्य है।
Google का moat और search का भविष्य
- राय बंटी हुई है:
- कुछ का कहना है कि Google का moat (default status, non-blocked crawler, YouTube, cloud) अब भी बहुत मज़बूत है।
- अन्य मानते हैं कि LLM-based assistants कई queries के लिए classic search को तेज़ी से बदल रहे हैं।
- एक समूह का दावा है कि उनके जानने वाले लगभग सभी लोग Google से हट चुके हैं; दूसरे बताते हैं कि उनके जानने वाले लगभग सभी लोग अब भी इसे इस्तेमाल करते हैं।
- अटकल है कि यह ruling आंशिक रूप से OpenAI/Anthropic द्वारा intermediaries जैसे SerpAPI के माध्यम से live Google results तक पहुँच को सीमित करने के बारे में है, हालांकि विवरण अभी भी स्पष्ट नहीं हैं।