1 पॉइंट द्वारा GN⁺ 3 시간 전 | 1 टिप्पणियां | WhatsApp पर शेयर करें
  • अदालत ने SerpAPI द्वारा Google खोज परिणामों के संग्रह को DMCA धारा 1201 के circumvention-ban उल्लंघन के रूप में देखने वाले दावे को खारिज कर दिया, लेकिन दायरा सीमित करके दोबारा दायर करने की संभावना खुली छोड़ी
  • ऑटोमेटेड requests को रोकने वाला SearchGuard कॉपीराइट-सुरक्षित सामग्री हो या न हो, पूरे search results पर लागू होता है, इसलिए इसे किसी कृति तक पहुंच नियंत्रित करने वाला तकनीकी सुरक्षा उपाय नहीं माना गया
  • search results में तीसरे पक्ष से लाइसेंस की गई images वाला Knowledge Panel दिख सकता है, लेकिन हर result या panel में कॉपीराइट-सुरक्षित सामग्री हो, ऐसा नहीं है
  • DMCA के तहत तकनीकी उपाय को कॉपीराइट धारक के अधिकार के आधार पर कृति तक पहुंच नियंत्रित करनी चाहिए, लेकिन Google यह भी पर्याप्त रूप से नहीं दिखा सका कि SearchGuard उसी कॉपीराइट धारक के अधिकार से लागू और संचालित हुआ
  • Google अपने अधिकार वाली सामग्री तक दावे का दायरा सीमित कर सकता है और SerpAPI भी उसे संग्रह के दायरे से बाहर कर सकता है, इसलिए सार्वजनिक खोज जानकारी को पूरे तौर पर DMCA से नियंत्रित करने की रणनीति पर रोक लगी है

Google और SerpAPI का विवाद

  • Google ने दिसंबर 2025 में SerpAPI द्वारा Google search results एकत्र करने के खिलाफ DMCA धारा 1201 का मुकदमा दायर किया
  • अदालत ने शिकायत खारिज कर दी, लेकिन Google के लिए संशोधित दावा फिर से दाखिल करने की गुंजाइश छोड़ी
  • SerpAPI search engine results pages को scrape करके एक अनौपचारिक search results API उपलब्ध कराता है, जो developers, AI कंपनियों, researchers और enterprises को सार्वजनिक search information तक पहुंच में मदद देता है
  • AI युग में data का मूल्य बढ़ने के साथ public web के कुछ हिस्सों तक पहुंच पर बाधाएं लगाने की कोशिशें बढ़ रही हैं, और इस प्रक्रिया में आम users भी साथ में blocked हो सकते हैं

Reddit मुकदमे से संबंध

  • Reddit ने 2025 की शरद ऋतु में SerpAPI और Perplexity आदि के खिलाफ अलग मुकदमा दायर किया
    • उसका आरोप था कि SerpAPI ने Google search results के जरिए Reddit सामग्री अन्य व्यवसायों को देकर DMCA के anti-circumvention प्रावधान का उल्लंघन किया
    • Reddit posts का कॉपीराइट users के पास है, और SerpAPI ने सीधे Reddit नहीं बल्कि Google को scrape किया था
    • Reddit और Google के बीच API contract है, लेकिन प्रतिवादी उस contract के पक्षकार नहीं हैं
  • Reddit मामले में प्रतिवादियों की dismissal motion लंबित है, जबकि Google मामले में अदालत ने पहले ही शिकायत खारिज कर दी

DMCA धारा 1201 का लागू दायरा

  • DMCA धारा 1201 मूल रूप से DRM जैसे तकनीकी सुरक्षा उपायों को bypass करने की कार्रवाई पर ही जिम्मेदारी तय करने के लिए बनाई गई थी
    • DRM तोड़ना या bypass के तरीके बताना भी कॉपीराइट उल्लंघन की जिम्मेदारी तक ले जा सकता है, इसलिए इसे व्यापक रूप से लिखा गया था
    • थर्ड-पार्टी printer ink या garage door opener के इस्तेमाल को सीमित करने जैसे, कॉपीराइट से सीधे असंबंधित मामलों में भी तकनीकी सुरक्षा उपायों का इस्तेमाल होता रहा है
  • अदालत ने Lexmark printer से जुड़े precedent की भी समीक्षा की, लेकिन माना कि वह इस मामले पर लागू नहीं होता
    • Lexmark के खिलाफ गया संबंधित precedent DMCA नहीं बल्कि ट्रेडमार्क कानून से आया था, और Lexmark का धारा 1201 वाला दावा भी सफल नहीं हुआ था

SearchGuard कैसे काम करता है

  • SearchGuard तब JavaScript challenge भेजता है जब Google को किसी अपरिचित source से search request मिलती है, ताकि यह जांचा जा सके कि सामने वास्तविक user है या automation software
    • browser user और environment से जुड़ी कुछ जानकारी वाला response Google को भेजता है
    • इंसानी user के browser में JavaScript अपने-आप चल जाती है, इसलिए user experience में लगभग कोई बाधा नहीं आती
    • बड़े पैमाने के automated query systems आम तौर पर इस challenge को हल नहीं कर पाते, इसलिए Google search results तक उनकी पहुंच अस्वीकार कर दी जाती है
  • Google का कहना था कि automated scraping उसके लिए सिर्फ लागत पैदा करने वाला deadweight loss है, और SearchGuard अनधिकृत automated access को रोकता है
  • लेकिन SearchGuard केवल कॉपीराइट सामग्री को अलग करके नहीं रोकता, बल्कि सुरक्षा की स्थिति चाहे जो हो, पूरे search results पर automated access नियंत्रित करता है

पूरे search results को कृति क्यों नहीं माना जा सकता

  • Google search results इंटरनेट से मिली सार्वजनिक जानकारी को relevance के आधार पर व्यवस्थित करके दिखाते हैं
  • Google ने यह दावा नहीं किया कि google.com या वहां दिखने वाले search results स्वयं कॉपीराइट कानून से संरक्षित हैं
  • search results में कभी-कभी Knowledge Panel दिखता है, जिसमें तीसरे पक्ष से लाइसेंस की गई कॉपीराइट images हो सकती हैं
    • Knowledge Panel हर search result में नहीं दिखता
    • panel दिखने पर भी उसमें हमेशा कॉपीराइट सामग्री हो, यह जरूरी नहीं है
  • इसलिए SearchGuard जिन चीजों को नियंत्रित करता है, उनमें कॉपीराइट सामग्री वाले और बिना कॉपीराइट सामग्री वाले दोनों तरह के results शामिल हैं
  • DMCA तब लागू नहीं होता जब तकनीकी उपाय जिस चीज को नियंत्रित कर रहा है वह कॉपीराइट कानून के तहत संरक्षित न हो, इसलिए कॉपीराइट सामग्री के बिना search results पर आधारित §1201(a)(1)(A) और §1201(a)(2) दावे कानूनी रूप से टिकते नहीं हैं

कॉपीराइट धारक के अधिकार की शर्त

  • §1201(a)(3)(B) के अनुसार किसी तकनीकी उपाय को कृति तक पहुंच को प्रभावी रूप से नियंत्रित करने वाला मानने के लिए, पहुंच के लिए जरूरी जानकारी, प्रक्रिया या treatment कॉपीराइट धारक के अधिकार के तहत लागू होना चाहिए
  • Ninth Circuit के precedent ने भी इसकी व्याख्या इस तरह की है कि plaintiff को यह दावा और प्रमाण देना होगा कि संबंधित उपाय कॉपीराइट धारक के अधिकार से लागू और संचालित हुआ
  • Google ने जवाब दिया कि SearchGuard किसने deploy किया, इससे ज्यादा यह देखना चाहिए कि उसे bypass कौन कर सकता है, लेकिन अदालत ने यह तर्क स्वीकार नहीं किया
    • Google ने जिन Disney Enterprises v. VidAngel और Universal City Studios v. Corley मामलों का हवाला दिया, वे §1201(a)(3)(A) की व्याख्या करते हैं, जो ‘तकनीकी उपाय के circumvention’ को परिभाषित करता है
    • यहां विवाद §1201(a)(3)(B) से जुड़ा था, जो यह तय करता है कि कोई तकनीकी उपाय कृति तक पहुंच को प्रभावी रूप से नियंत्रित करने के लिए किन शर्तों को पूरा करे
  • Google ने कहा कि कॉपीराइट धारक SearchGuard के जरिए सुरक्षा का समर्थन करते हैं, लेकिन वह यह शर्त पूरी नहीं कर सका कि यह वास्तव में कॉपीराइट धारक के अधिकार के आधार पर लागू और संचालित था

खारिजी के बाद दावे की संभावित सीमा

  • SerpAPI की सभी दलीलें स्वीकार नहीं की गईं, लेकिन फिलहाल Google का पूरा DMCA दावा खारिज हो गया है
  • Google उन search results पर वही दावा दोबारा नहीं ला सकता जिन पर उसका कॉपीराइट अधिकार नहीं है
  • हालांकि Knowledge Panel जैसी, Google के अधिकार वाली सामग्री तक सीमित एक संकीर्ण दावा दायर किया जा सकता है
  • SerpAPI अपने scraping तरीके को Google-निर्मित सामग्री से बचाने के लिए बदल सकता है, जिससे संकीर्ण दावे से भी बचने की संभावना है
  • SerpAPI ने खारिजी पर अपनी प्रतिक्रिया में कहा कि सार्वजनिक pages तक पहुंच को भी DMCA से नियंत्रित करने की कोशिश अस्वीकार कर दी गई, और वह सार्वजनिक search information पर निर्भर developers, AI कंपनियों, researchers और enterprises का समर्थन जारी रखेगा
  • वेब scraping के जरिए अपना कारोबार खड़ा करने वाली Google का अब अपने search results की scraping रोकने के लिए DMCA का इस्तेमाल करना खुले इंटरनेट की access ladder को पीछे से लात मारने जैसा है

1 टिप्पणियां

 
GN⁺ 3 시간 전
Hacker News की राय
  • अगर Google ने search results के लिए एक ढंग का API दिया होता, तो इस तरीके से मुझे ज़्यादा सहमति होती। लेकिन पुराना API बंद कर दिया गया है और कोई विकल्प भी नहीं है, इसलिए policy बदलने तक मैं Google results को scrape करने वाली third-party services का इस्तेमाल करता रहूँगा

    • EU द्वारा Google को search data share करने के लिए मजबूर करने के बाद हालात कैसे बदलेंगे, यह जानने की उत्सुकता है
      https://abcnews.com/Technology/wireStory/eu-forces-google-sh...
    • Nelson Minar के पुराने search API या ऐसी ही किसी service को फिर से ज़िंदा करना चाहिए। Gemini API के search-based responses सुविधाजनक हैं, लेकिन उनमें versatility कम है
    • जब Google ने search के लिए JavaScript ज़रूरी करना शुरू किया, तभी मैंने Google का इस्तेमाल बंद कर दिया, और वही दिन लगा जब open web सच में मर गया
  • यह बहुत सारे resources वाली बड़ी कंपनियों का एक क्लासिक व्यवहार है। संभव है Google समझौता करवाना चाहता था, या उसे लगा कि उससे बहुत छोटी दिखने वाली SerpAPI मुकदमे का खर्च नहीं उठा पाएगी
    Google के पास इतना पैसा है कि loser pays principle लागू होने पर भी शायद वह मुकदमा छोड़ने वाला नहीं है

  • EU, content को इकट्ठा करने, verify करने और पेश करने में गुणात्मक या मात्रात्मक रूप से काफ़ी निवेश किया गया हो, तो creative expression से अलग database producer की सुरक्षा करता है। अमेरिकी copyright law में data के selection, coordination और arrangement में कम-से-कम थोड़ी originality होनी चाहिए, तभी सुरक्षा मिलती है
    Google search results सिर्फ़ तथ्य हैं, लेकिन maps copyright protected हैं — ऐसा साफ़-साफ़ अलग करना मुश्किल है। वेब को crawl करने और rank करने में बहुत बड़ा प्रयास लगता है, और मेरे हिसाब से PageRank खुद भी copyright protection के दायरे में आना चाहिए

    • maps सही comparison नहीं हैं; photos बेहतर example हैं। maps में मूल चीज़ को ज्यों का त्यों कॉपी करके या बिना बदलाव सीधे दिखाकर काम नहीं चलता, बल्कि क्या शामिल करना है, क्या हटाना है, कहाँ बढ़ा-चढ़ाकर दिखाना है और कहाँ distortion करना है — इन सब पर फ़ैसला करना पड़ता है, इसलिए उनमें साफ़ creativity चाहिए। यही वजह है कि एक ही इलाके के maps भी काफ़ी अलग हो सकते हैं
      वहीं search results कई pages के text snippets को मूल रूप में जोड़कर रख देते हैं, इसलिए उनमें मौजूद creativity शायद photos के समान स्तर की हो
    • जब Google ने search results में content का जवाब ही देना शुरू किया, तभी उसने उस सीमा को साफ़ तौर पर पार करना शुरू कर दिया
    • PageRank paper आए 20 साल से ज़्यादा हो चुके हैं, और Google ने भी करीब 15 साल पहले PageRank का इस्तेमाल बंद कर दिया था, इसलिए मुझे लगता है कि वह तर्क अब पुराना हो चुका है
  • search results pages को scrape किया जा सकना चाहिए — इसका एक अहम कारण यह है कि Google लगातार ETA·ESTA एजेंसी sites जैसी धोखाधड़ी वाली ads दिखाता है: https://www.bbc.co.uk/news/technology-56886957

    • ज़रा सोचिए, अगर internet ad giants अपने फैलाए हुए fraud और malware के लिए कुछ हद तक ज़िम्मेदार ठहराए जाएँ, तो दुनिया कितनी अलग हो सकती है
    • UK land registry service में भी यही हाल है। यह जानते हुए भी कि .gov site ढूँढनी है, कई बार कोशिश करनी पड़ती है, और पिछली बार तभी समझ आया कि मैं ad site पर हूँ जब उसने उस service के लिए payment माँगी जो government site पर मुफ़्त है
  • यह विडंबना है कि Google की सफलता open web को crawl और index करके बनी। अपने product की रक्षा करने की उसकी इच्छा समझ में आती है, लेकिन सस्ता API हटाकर और उस खाली जगह को भरने वाली third-party तक को रोकने की कोशिश करके, वह उसी scraping demand को खुद पैदा करता है जिसे वह दबाना चाहता था

  • अब यह समझना मुश्किल हो रहा है कि क्या इसका मतलब है कि कोई भी Google search results को कानूनी तौर पर scrape कर सकता है

    • किसी चीज़ का कानूनी होना और Google का उसे रोकने के लिए हर संभव तरीका न अपनाना — ये दोनों बिल्कुल अलग बातें हैं
  • blog post में यह बात गायब थी कि यह मुकदमा इसलिए दायर किया गया क्योंकि OpenAI ने SerpApi के ज़रिए Google search results इकट्ठा किए थे। Alphabet, Anthropic का investor भी है, और 10 अगस्त तक दाख़िल होने वाली amended complaint का इंतज़ार है
    https://searchengineland.com/inside-google-searchguard-46767...

  • किसी न किसी दिन DMCA reform ज़रूरी होगी

    • यह कोई नई बात नहीं है, लेकिन यह लेख फिर से अच्छी तरह दिखाता है कि DMCA कितना भयानक क़ानून है। अब तक इसे सुधारा नहीं गया, यह समझ से बाहर है
    • copyright system ही ख़त्म कर देनी चाहिए
  • यह फ़ैसला संतोषजनक लग सकता है, लेकिन यह Google की अपनी scraping को भी पूरी तरह वैध होने का बल देता है। संभव है Google ने यह मुकदमा इस तरह देखा हो कि या तो competitor को गिराया जा सके, या हारने पर भी भविष्य के अपने लिए सुरक्षा देने वाला precedent मिल जाए — यानी दोनों तरफ़ से जीतने वाली स्थिति

    • मुझे Google पसंद नहीं है, लेकिन public data की scraping को गैरकानूनी बना देने पर दुरुपयोग की संभावना बहुत ज़्यादा बढ़ जाएगी, इसलिए यह नतीजा सबसे बेहतर है
    • मेरे हिसाब से Google के पास अब कोई moat नहीं बचा। मेरे आसपास शायद ही कोई Google search इस्तेमाल करता है, coding models कहीं ज़्यादा गहरे स्तर का development संभव बना रहे हैं, और नौकरी से निकाले गए ढेरों engineers 10x productivity देने वाले coding tools के साथ Google products के क्षेत्र में घुस सकते हैं
      हाल में किसी ने Google G Suite की नकल करके शानदार नतीजा निकाला, और Drive व Search भी replace होने वाले commodities बन सकते हैं। सीधे phone operating system बनाना चाहने वाले लोग भी हज़ारों में होंगे, और Chrome भी replaceable लगता है। Firefox की share पिछले महीने 1 percentage point बढ़ी
      लेकिन YouTube का network effect तोड़ना मुश्किल है, और Google Cloud भी शायद गायब नहीं होगा