Back to Blog

गूगल ने स्क्रैपिंग मामले में मुकदमा हार दिया: SerpApi का मामला और इसका प्रभाव

20 जुलाई 2026 को कैलिफोर्निया के संघीय न्यायालय ने Google के खिलाफ SerpApi की याचिका को खारिज कर दिया: एंटीबॉट सिस्टम SearchGuard कॉपीराइट की रक्षा नहीं करता है, जब इसके पीछे सामान्य खोज परिणाम होते हैं - URL, स्निप्पेट और इंडेक्स के तथ्य। हम निर्णय के विवरण, जो इसके दायरे से बाहर रह गए हैं, और यह SERP डेटा संग्रह के अभ्यास पर कैसे प्रभाव डालता है, पर चर्चा करते हैं।

📅July 24, 2026
गूगल ने स्क्रैपिंग मामले में मुकदमा हार दिया: SerpApi का मामला और इसका प्रभाव
```html

20 जुलाई 2026 को कैलिफोर्निया के उत्तरी जिले की संघीय अदालत ने SerpApi के खिलाफ Google की शिकायत को खारिज कर दिया - एक कंपनी जो API के माध्यम से खोज परिणामों तक पहुंच बेचती है। Google ने SERP के स्क्रैपिंग पर DMCA के एंटी-सर्कमवेंट नियमों को लागू करने की कोशिश की - वही, जो DVD सुरक्षा को हैक करने के खिलाफ लिखे गए थे। अदालत ने उत्तर दिया: उन डेटा के चारों ओर तकनीकी बाधाएं, जो कॉपीराइट द्वारा सुरक्षित नहीं हैं, कॉपीराइट कानून द्वारा सुरक्षित नहीं हैं। हम समझते हैं कि अदालत ने वास्तव में क्या तय किया, क्या नहीं तय किया, और इससे उन सभी के लिए क्या निष्कर्ष निकलता है जो परिणामों से डेटा एकत्र करते हैं।

क्या हुआ: मामले का समयरेखा

Google ने 19 दिसंबर 2025 को एक शिकायत दर्ज की (मामला 25-cv-10826-YGR, कैलिफोर्निया का उत्तरी जिला)। प्रतिवादी - SerpApi, एक सेवा जो API के माध्यम से Google खोज के परिणामों को संरचित रूप में प्रदान करती है। इसके डेटा पर SEO उद्योग का एक महत्वपूर्ण हिस्सा निर्भर करता है: स्थिति ट्रैकर्स, कीवर्ड चयन उपकरण, प्रतिस्पर्धी खुफिया डैशबोर्ड।

मामले की सामग्री के प्रमुख तथ्य:

  • SearchGuard - एंटी-स्क्रैपिंग प्रणाली, जिसे Google ने जनवरी 2025 में लॉन्च किया। यह अनजान स्रोतों से आने वाले अनुरोधों के लिए JavaScript चुनौतियाँ भेजती है और पुष्टि करने की मांग करती है कि ब्राउज़र के पीछे एक व्यक्ति है। स्वचालित प्रणाली ऐसी जांचों को आमतौर पर पास नहीं करती और अस्वीकृति प्राप्त करती है।
  • Google के अनुसार, SerpApi ने “प्रतिदिन सैकड़ों मिलियन कृत्रिम खोज अनुरोध उत्पन्न किए”, और अनुरोधों की मात्रा लगभग 25,000% दो वर्षों में बढ़ गई
  • Google ने सांविधिक क्षति की मांग की - प्रत्येक सर्कमवेंट कार्य के लिए $200 से $2500। लाखों अनुरोधों के साथ, यह राशि SerpApi की वार्षिक आय से कई गुना अधिक हो गई, जो लाखों डॉलर में मापी जाती है। दूसरे शब्दों में, यदि शिकायत सफल होती, तो यह कंपनी को बंद कर देती।
  • SerpApi ने फरवरी 2026 में खारिज करने के लिए एक याचिका दायर की। निर्णय 20 जुलाई 2026 को जिला न्यायाधीश इवोन गोंजालेज रोजर्स द्वारा सुनाया गया।

क्यों DMCA काम नहीं किया

DMCA का अनुभाग 1201 तकनीकी साधनों को बायपास करने पर रोक लगाता है, जो “कॉपीराइट द्वारा संरक्षित काम तक पहुंच को प्रभावी ढंग से नियंत्रित करते हैं।” Google की तर्कशक्ति: SearchGuard एक सुरक्षा तकनीक है, SerpApi इसे बायपास करता है, इसलिए उल्लंघन स्पष्ट है।

अदालत ने संरचना को भागों में विभाजित किया। सामान्य परिणाम - URL, स्निप्पेट्स, वास्तविक डेटा इंडेक्स, स्थिति - ये सार्वजनिक तथ्य हैं, न कि “कॉपीराइट द्वारा संरक्षित काम।” इसलिए, इस हिस्से में SearchGuard को “संरक्षित काम तक प्रभावी पहुंच नियंत्रित करने वाला नहीं माना जा सकता।” गैर-कॉपीराइट परिणामों पर आधारित दावे स prejudice के साथ खारिज कर दिए गए - पुनः प्रस्तुत करने का अधिकार नहीं।

Google ने कहा कि परिणाम पृष्ठ “संरक्षित और असुरक्षित सामग्री का एक मिश्रण” है, और लाइसेंस प्राप्त छवियों का उदाहरण दिया। यहाँ अदालत ने अधिक नरम स्थिति अपनाई: इन दावों को संशोधन के अधिकार के साथ खारिज कर दिया। लेकिन एक शर्त के साथ - Google को यह दिखाना होगा कि SearchGuard कॉपीराइट तत्वों की सुरक्षा स्वयं अधिकार धारकों की अनुमति से करती है। किसी अन्य की लाइसेंस प्राप्त छवि को अपनी पृष्ठ पर रखना और अपनी एंटी-बॉट को उसकी सुरक्षा घोषित करना संभव नहीं होगा। Google को संशोधित शिकायत दायर करने के लिए 21 दिन दिए गए।

SerpApi के ब्लॉग का निष्कर्ष: अदालत ने “Google के DMCA को सार्वजनिक पृष्ठों तक पहुंच पर नियंत्रण बढ़ाने के प्रयासों को खारिज कर दिया।” कंपनी के CEO जूलियन हलेगी ने निर्णय को “सार्वजनिक डेटा तक खुली पहुंच की सुरक्षा” कहा।

यह मामला दो कंपनियों के विवाद से बड़ा क्यों है

पिछले डेढ़ वर्षों का संदर्भ बताता है कि Google ने अदालत में जाने का निर्णय क्यों लिया। तकनीकी रूप से, उसने SERP डेटा बाजार पर पहले भी दबाव डाला था:

  • सितंबर 2025 में Google ने num=100 पैरामीटर हटा दिया, जो एक ही अनुरोध में सौ परिणाम प्राप्त करने की अनुमति देता था। उपकरणों के लिए पूरी स्क्रैपिंग की लागत लगभग दस गुना बढ़ गई
  • जब DataForSEO ने एक बायपास समाधान पेश किया, जिससे लागत लगभग 80% कम हो गई, Google ने इसे पाँच दिनों में ब्लॉक कर दिया

इसलिए तकनीकी स्तर पर Google पहले से ही जीत रही थी। शिकायत एक कानूनी लीवर जोड़ने का प्रयास थी: एंटी-बॉट को एक अपराध में बदलना, प्रत्येक अनुरोध के लिए निश्चित दंड के साथ। यही अदालत ने नहीं होने दिया। यदि यह पारित होता, तो कोई भी CAPTCHA या JS चुनौती सार्वजनिक पृष्ठ पर स्वचालित रूप से “काम की तकनीकी सुरक्षा” बन जाती - और सार्वजनिक डेटा के किसी भी पार्सर को स्वचालित रूप से DMCA का उल्लंघन करने वाला बना देती।

प्रश्न की अर्थव्यवस्था: क्यों SERP डेटा के लिए युद्ध चल रहा है

खोज परिणाम केवल “एक और डेटा स्रोत” नहीं हैं। इसके चारों ओर एक पूरी उद्योग बनी हुई है: स्थिति ट्रैकिंग, प्रतिस्पर्धी विश्लेषण, मूल्य निगरानी, AI मॉडल के लिए शिक्षण सेट। इस बीच, Google एक द्वंद्वात्मक स्थिति में है: कंपनी ने स्वयं खोज को अन्य के सामग्री के बड़े पैमाने पर संग्रह पर बनाया है, लेकिन संकलित परिणामों तक पहुंच को पूरी तरह से नियंत्रित करना चाहती है।

एक अलग परत - कृत्रिम बुद्धिमत्ता। खोज परिणाम भाषा मॉडल के लिए ताजा इंटरनेट चित्र प्राप्त करने का एक तेज़ तरीका बन गए हैं बिना अपने क्रॉलर के। यही कारण है कि पिछले वर्ष की शिकायतों में पारंपरिक स्क्रैपिंग सेवाओं के साथ AI कंपनियाँ भी बढ़ती जा रही हैं। “हम केवल सार्वजनिक पृष्ठ पढ़ रहे हैं” का तर्क SEO उपकरण और AI सहायक दोनों में समान रूप से सुनाई देता है, और अदालतें केवल यह समझने लगी हैं कि उनके बीच सीमा कहाँ गुजरती है। SerpApi का मामला कम से कम एक प्रश्न का स्पष्ट उत्तर देता है: कॉपीराइट केवल इसलिए फैला नहीं है क्योंकि तथ्य CAPTCHA के पीछे हैं।

निर्णय उस रेखा को जारी रखता है, जो hiQ Labs बनाम LinkedIn के मामले में जानी जाती है: सार्वजनिक डेटा का संग्रह अपने आप में अपराध नहीं बनता है केवल इसलिए कि प्लेटफॉर्म के मालिक को यह पसंद नहीं है। अंतर यह है कि hiQ का मामला CFAA (अनधिकृत पहुंच) से संबंधित था, जबकि यहाँ एक अन्य बायपास मार्ग - कॉपीराइट से संबंधित - बंद किया गया है।

इस निर्णय को क्या नहीं रद्द करता है

यहाँ एक एपिसोड में जीत को छूट के साथ भ्रमित नहीं करना महत्वपूर्ण है। जो चीजें स्थान पर रहीं:

  1. तकनीकी ब्लॉक कहीं नहीं गए हैं। SearchGuard 19 जुलाई को जिस तरह से काम कर रहा था, उसी तरह काम कर रहा है। अदालत का निर्णय पहुंच नहीं खोलता - यह केवल एक विशिष्ट प्रकार की कानूनी जिम्मेदारी को हटा देता है। परिणामों को पार्स करना अभी भी तकनीकी रूप से कठिन और महंगा है।
  2. अनुबंधीय दावे और ToS। उपयोगकर्ता समझौते का उल्लंघन एक अलग कानूनी क्षेत्र है, DMCA का निर्णय इसे प्रभावित नहीं करता।
  3. विशिष्ट तत्वों पर कॉपीराइट। वास्तव में, अदालत ने उस दरवाजे को खुला छोड़ दिया। वास्तविक परिणाम - तथ्य; Knowledge Panel में छवियाँ, लाइसेंस प्राप्त सामग्री, तस्वीरें, उपयोगकर्ता समीक्षाएँ - पहले से ही नहीं। “पृष्ठ से सब कुछ इकट्ठा करना” और स्थिति और स्निप्पेट्स इकट्ठा करना - कानूनी रूप से अलग क्रियाएँ हैं।
  4. समानांतर प्रक्रियाएँ। अक्टूबर 2025 में Reddit ने न्यूयॉर्क के दक्षिणी जिले में Perplexity AI, SerpApi, Oxylabs और AWMProxy के खिलाफ एक शिकायत दायर की, उन पर सुरक्षा को बायपास करने और AI के लिए डेटा एकत्र करने का आरोप लगाया; संशोधित शिकायत 6 फरवरी 2026 को दायर की गई, मामला खारिज करने की याचिकाओं पर विचार के चरण में है। इसके अलावा, SerpApi टेक्सास में SearchApi के खिलाफ शिकायत का सामना कर रहा है। कानूनी परिदृश्य विवादित बना हुआ है।

और सबसे महत्वपूर्ण: यह एक जिला अदालत का निर्णय है, न कि अपील का प्रेसीडेंट। Google लाइसेंस प्राप्त सामग्री के हिस्से में शिकायत को संशोधित कर सकता है, और फिर अपील कर सकता है। यह मान लेना कि यह प्रश्न हमेशा के लिए बंद हो गया है, जल्दबाजी होगी।

इससे व्यावहारिक रूप से क्या निकलता है

यदि आप खोज परिणामों से डेटा एकत्र करते हैं या ऐसा करने की योजना बना रहे हैं, तो निर्णय पर उचित प्रतिक्रिया “अब सब कुछ संभव है” नहीं, बल्कि कार्य नियमों को स्पष्ट करना है।

  1. पार्सर स्तर पर तथ्य और संरक्षित सामग्री को अलग करें। URL, शीर्षक, स्निप्पेट्स, स्थिति, ब्लॉकों की उपस्थिति - ये तथ्यात्मक स्तर हैं, इसके चारों ओर अदालत की स्थिति सबसे मजबूत है। छवियाँ, अंतर्निहित लाइसेंस प्राप्त सामग्री, पूर्ण समीक्षाओं के पाठ - जोखिम क्षेत्र हैं। तकनीकी रूप से, इसका मतलब है कि एक्सट्रैक्टर में फ़ील्ड का एक श्वेतसूची, न कि “सुरक्षा के लिए पूरा HTML सहेजना।”
  2. कानूनी जोखिम को संचालन से भ्रमित न करें। SERP को स्क्रैप करते समय आपकी मुख्य समस्या अदालत नहीं है, बल्कि ब्लॉक, CAPTCHA और IP की गुणवत्ता है। बाजार कड़ा हो गया है: num=100 को हटाने के बाद, समान मात्रा के डेटा की लागत अनुरोधों में कई गुना अधिक हो गई है। व्यावहारिक पक्ष - कौन से ब्लॉक कैसे हटाए जाएँ और क्यों सत्र टूटते हैं - हमने Google SERP और AI ओवरव्यूज़ के स्क्रैपिंग पर गाइड में चर्चा की है।
  3. उचित लोड बनाए रखें। “अनुरोधों में 25,000% वृद्धि” का आंकड़ा शिकायत में संयोग से नहीं था: आक्रामक मात्रा अपने आप में आपके खिलाफ एक तर्क बन जाती है - और अदालत में, और एंटी-बॉट के सामने। उचित अंतराल, प्राथमिकता वाले अनुरोधों के बजाय कुल स्क्रैपिंग और परिणामों को कैश करना दोनों प्रकार के जोखिम को तुरंत कम करता है।
  4. कार्य के लिए भूगोल और IP के प्रकार को बनाए रखें। परिणाम क्षेत्र के अनुसार व्यक्तिगत होते हैं, और “कहीं से भी” एकत्र किए गए डेटा बस गलत होते हैं। भूगोल-सटीक और स्थिर सत्रों के लिए अक्सर रेसिडेंशियल प्रॉक्सी का उपयोग किया जाता है; समान तकनीकी अनुरोधों की बड़ी मात्रा के लिए, जहाँ डिटेक्ट के प्रति संवेदनशीलता कम होती है, डेटा सेंटर प्रॉक्सी सस्ती होती हैं।
  5. आप क्या और क्यों एकत्र कर रहे हैं, इसे रिकॉर्ड करें। आधे पृष्ठ का आंतरिक दस्तावेज़ - स्रोत, फ़ील्ड, आवृत्ति, भंडारण की अवधि - महंगा नहीं है, और किसी भी विवाद में शोध संग्रह को अनियंत्रित खींचने से अलग करता है। संबंधित कानूनी बारीकियों पर प्रॉक्सी के कानूनी उपयोग पर सामग्री में चर्चा की गई है।

निष्कर्ष

20 जुलाई 2026 का निर्णय सार्वजनिक परिणामों के स्क्रैपिंग के बारे में विवाद में एक महत्वपूर्ण बिंदु है। अदालत ने तथ्यात्मक सामग्री के पीछे होने पर एंटी-बॉट प्रणाली को “काम की सुरक्षा” मानने से इनकार कर दिया, और इस दावे को अंतिम रूप से बंद कर दिया। साथ ही, उसने Google को पृष्ठ के लाइसेंस प्राप्त तत्वों की ओर से प्रयास करने के लिए 21 दिन दिए।

डेटा बाजार के लिए व्यावहारिक अर्थ सरल है: परिणामों से तथ्यों के संग्रह पर कानूनी दबाव कम हो गया है, लेकिन तकनीकी दबाव नहीं है और न ही होगा। SEO विश्लेषण, प्रतिस्पर्धी खुफिया और मूल्य निगरानी के उपकरण पहले की तरह ही काम करते रहते हैं: गुणवत्ता की पहुंच की अवसंरचना, सावधानीपूर्वक लोड और यह स्पष्ट समझ कि आप पृष्ठ से कौन से फ़ील्ड ले रहे हैं।

```