Back to Blog

गूगल ने परिणामों से URL छिपा दिए: goto-रीडायरेक्ट्स और अब SERP पार्सिंग के साथ क्या करें

26 अगस्त 2026 को Google ने google.com/goto के रोलआउट की पुष्टि की: परिणामों में लिंक एन्क्रिप्टेड रीडायरेक्ट पर जाते हैं, न कि वेबसाइट पर। और केवल वे लोग जो खोज द्वारा बॉट समझे गए हैं, वे बदलाव देख सकते हैं। हम टोकनों की मैकेनिक्स, 500-1000 अनुरोधों की कीमत और डेटा संग्रह को दो परतों में पुनर्संरचना करने के बारे में चर्चा कर रहे हैं।

📅August 31, 2026
गूगल ने परिणामों से URL छिपा दिए: goto-रीडायरेक्ट्स और अब SERP पार्सिंग के साथ क्या करें
```html

26 अगस्त 2026 को Google ने आधिकारिक तौर पर पुष्टि की: खोज परिणामों में लिंक अब सीधे वेबसाइट पर नहीं जाते हैं। HTML में पृष्ठ के पते के बजाय एक रीडायरेक्ट है जैसे google.com/goto?url=... जिसमें एक एन्क्रिप्टेड टोकन है। इस कहानी में सबसे अप्रिय बात यह है कि बदलें हुए लिंक सभी को नहीं मिलते। सामान्य व्यक्ति अपने ब्राउज़र में सीधे URL देखता है। इन्हें विशेष रूप से उन लोगों से छिपाया जाता है, जिन्हें Google ने पहले ही स्वचालन के रूप में माना है।

क्या हुआ

पहले कुछ संकेत 23 जून 2026 को आए — इस पर एलेक्स ग्रीनलैंड ने ध्यान दिया। 2 जुलाई को ब्रॉडी क्लार्क ने इसे बड़े पैमाने पर दर्ज किया। और 26 अगस्त को डेरिक पर्किन्स, Nozzle ट्रैकिंग प्लेटफॉर्म के CEO, ने लगभग पूर्ण रोलआउट की रिपोर्ट दी, और Google ने आधिकारिक तौर पर परिवर्तन की पुष्टि की।

कंपनी के प्रतिनिधि का Search Engine Roundtable के लिए बयान स्पष्ट रूप से सामान्य था: Google के पास "विकसित रूपों के खिलाफ तकनीकी उपायों का एक लंबा इतिहास है," और कंपनी "अपने सेवाओं और उपयोगकर्ताओं की सुरक्षा के लिए नियमित रूप से कदम उठाती है।" किसे विशेष रूप से दुरुपयोग माना जाए — इस पर कोई स्पष्टता नहीं दी गई।

मैकेनिक्स सरल और इसलिए दर्दनाक है। पहले परिणाम के मार्कअप में एक तैयार पता होता था — पार्सर इसे शीर्षक और स्निपेट के साथ एक ही अनुरोध में लेता था। अब वहां Google के मध्यवर्ती रीडायरेक्ट का लिंक है, और अंदर — protobuf-टोकन: base64-स्ट्रिंग जिसमें CAES प्रीफिक्स है, जिसके बाद एन्क्रिप्टेड payload आता है। इसे अपनी तरफ से डिक्रिप्ट करना असंभव है — आपके पास कुंजी नहीं है। लिंक के गंतव्य को जानने का एकमात्र तरीका उस पर जाना है।

तीन विवरण जो प्रश्न की कीमत को निर्धारित करते हैं

  • टोकन एक बार का है। एक ही लिंक एक ही पृष्ठ के लिए एक ही अनुरोध पर हर बार एक नया टोकन प्राप्त करता है। "टोकन → URL" का एक निर्देशिका बनाना और इसका पुन: उपयोग करना संभव नहीं है।
  • HEAD मदद नहीं करता। HEAD अनुरोध 200 लौटाता है बिना Location हेडर के — यानी बिना गंतव्य पते के। एक पूर्ण GET की आवश्यकता है, जो 302 के साथ लगभग 59 मि.सेक. की मध्यवर्ती देरी देता है।
  • केवल ऑर्गेनिक कोर को ही नहीं छुआ गया। छिपे हुए पते सामान्य परिणामों, वीडियो, AI ओवरव्यू स्रोतों, "संबंधित प्रश्नों" ब्लॉक और विज्ञापनों (पते aclk) में मिलते हैं। Growtika ने आठ अनुरोधों पर 493 लिंक का विश्लेषण किया — प्रत्येक ने गंतव्य पता छिपाया।

गणित अप्रिय है। पर्किन्स के अनुसार, एक अनुरोध के लिए पांच परिणाम पृष्ठों के सभी लिंक को हल करने के लिए 500 से 1000 अनुरोधों की आवश्यकता होती है। स्वतंत्र माप scraping.club के अनुसार, डिडुप्लिकेशन के बाद 295–565 अधिक विनम्र हैं — लेकिन यह फिर भी एक अनुरोध से दो आदेश अधिक है, जिसका उपयोग पहले किया जाता था।

पर्किन्स का मुख्य उद्धरण इस बदलाव की वास्तविकता को किसी भी संख्या से बेहतर बताता है: बाधा अब बैंडविड्थ या स्टोरेज नहीं है, बल्कि रेट-लिमिट हैं।

यह स्वचालन पर क्यों प्रहार है

यहां सबसे दिलचस्प बात है। scraping.club के अवलोकनों के अनुसार, लिंक का परिवर्तन सार्वभौमिक नहीं है: सामान्य उपयोगकर्ता — लॉगिन किया हुआ या इनकोग्निटो मोड में — अभी भी सीधे URL प्राप्त करता है। रीडायरेक्ट स्वचालित ग्राहकों को स्थिर रूप से मिलते हैं: स्क्रिप्ट जो ब्राउज़र को --remote-debugging-port जैसे फ्लैग के साथ उठाती हैं, और पूरी स्वचालन के साथ हेडलेस स्टैक्स।

व्यावहारिक निष्कर्ष, जिसे आपको अपने पार्सर को फिर से लिखने से पहले समझना चाहिए: आपकी प्रतिक्रिया में goto लिंक का प्रकट होना एक निदान संकेत है. इसका मतलब है कि Google ने पहले ही आपके ग्राहक को बॉट्स में वर्गीकृत कर दिया है। आप एक नए परिणाम प्रारूप का सामना नहीं कर रहे हैं — आप देख रहे हैं कि उन लोगों के लिए परिणाम कैसे दिखता है जिन्हें पहचान लिया गया है। और पहले ठीक करने की आवश्यकता केवल लिंक पार्सर नहीं है, बल्कि यह है कि आप मनुष्य से कैसे भिन्न हैं: लॉन्च फ्लैग, हेडर का क्रम, TLS फिंगरप्रिंट, पृष्ठ का व्यवहार। हमने इस प्रकार की आत्म-परीक्षा की विधि पर चर्चा की है कैसे साइट के स्क्रिप्ट के माध्यम से पहचान मानचित्र को हटाने के लिए.

एक मजेदार बात, जो इस संस्करण की पुष्टि करती है: Google का रीडायरेक्ट का रिज़ॉल्व लगभग कोई सुरक्षा नहीं देता है। scraping.club के माप के अनुसार, लिंक पर जाने के लिए न तो प्रॉक्सी, न ही विशेष हेडर, न ही TLS का अनुकरण आवश्यक है — सामान्य requests लाइब्रेरी नकली Chrome से कम नहीं है, और छोटे वॉल्यूम में 110+ अनुरोध प्रति सेकंड बिना स्पष्ट सीमाओं के संभव है। यानी बाधा न तो क्रिप्टोग्राफिक है और न ही नेटवर्क। यह मात्रा पर एक कर है: आपको ब्लॉक नहीं किया जाता है, आपको बस अनुरोधों में बिल दिया जाता है।

दूसरा लगातार प्रहार

परिवर्तन को पिछले से अलग करके नहीं पढ़ा जाना चाहिए। 12–14 सितंबर 2025 को Google ने &num=100 पैरामीटर को बंद कर दिया, जो एक पृष्ठ पर सौ परिणाम देता था। इसके बाद उसी गहराई के लिए लगभग दस गुना अधिक अनुरोधों की आवश्यकता थी।

परिणाम पार्सिंग से बहुत दूर दिखाई दिए। Search Engine Land द्वारा विश्लेषण किए गए 319 प्रॉपर्टीज के अनुसार, 87.7% साइटों ने Search Console में दिखने में कमी की, और 77.6% ने कुछ अद्वितीय रैंकिंग वाले अनुरोधों को खो दिया। इस बीच वास्तविक ट्रैफ़िक में कोई बदलाव नहीं आया — माप टूट गया: दूर की स्थितियों पर "दिखावों" का अधिकांश हिस्सा लोगों द्वारा नहीं, बल्कि ट्रैकर्स द्वारा उत्पन्न किया गया, जो सौ परिणाम खींच रहे थे।

हम दो कदम जोड़ते हैं: पहले परिणाम की कीमत अनुरोधों की संख्या में दस गुना बढ़ गई, अब प्रत्येक परिणाम के लिए उसके पते के लिए एक अलग अनुरोध जोड़ा गया है। रणनीति स्पष्ट है — Google व्यवस्थित रूप से अपने परिणामों के औद्योगिक संग्रह की लागत बढ़ा रहा है।

कानूनी पृष्ठभूमि भी उल्लेखनीय है। तकनीकी उपाय ठीक उसी समय लागू किए गए जब न्यायिक मार्ग विफल हो गया: Google का SerpApi के खिलाफ DMCA के तहत मुकदमा खारिज कर दिया गया — अदालत ने कॉपीराइटेड कार्यों की सुरक्षा और सार्वजनिक तथ्यों तक पहुंच के बीच की सीमा को स्पष्ट किया, यह बताते हुए कि तथ्य और URL कार्य नहीं हैं। इस निर्णय के विवरण और इसके परिणामों पर हमने एक अलग सामग्री में चर्चा की है Google बनाम SerpApi मामले. प्रतिबंधित करने में असफल रहे — महंगा बनाने में सफल रहे।

क्या रिपोर्टों में अभी टूट रहा है

DemandSphere प्लेटफॉर्म ने विशिष्ट टूटने की सूची दी है, जो यदि कुछ नहीं किया गया तो उत्पन्न होती हैं:

  1. गंतव्य डोमेन google.com में समाहित हो जाता है। पार्सर ईमानदारी से वही लिखता है जो वह मार्कअप में देखता है — और सभी परिणाम "Google के स्वामित्व" में बदल जाते हैं।
  2. अपने पृष्ठों का मिलान टूट जाता है। सिस्टम आपके URL को पहचानना बंद कर देता है और मानता है कि आप परिणामों से बाहर हो गए हैं।
  3. वोट का हिस्सा और प्रतिस्पर्धियों की एट्रिब्यूशन बह जाती है — और गिनने के लिए कुछ नहीं बचता, सभी लिंक एक ही डोमेन पर हैं।
  4. ऐतिहासिक श्रृंखला ठीक उसी दिन टूट जाती है। यह सबसे कपटी है: ग्राफ़ एक गिरावट दिखाएगा, जो वास्तव में नहीं हुई।

अच्छी खबर: शुद्ध स्थिति डेटा कम प्रभावित होते हैं। DataForSEO ने 5 जुलाई 2026 को बताया कि 99.99% ऑर्गेनिक परिणाम पहले से ही सीधे पते के साथ उनके API के माध्यम से लौटाए जा रहे हैं। समस्या परिणाम ब्लॉकों में केंद्रित है — Growtika के अनुसार, goto लिंक लगभग आधे AI ओवरव्यू में और एक चौथाई स्थानीय ब्लॉकों में बने रहते हैं। यानी वही प्रभावित हो रहा है जो आज सबसे महत्वपूर्ण है: AI उत्तरों के स्रोत और स्थानीय परिणाम।

कैसे संग्रह को पुनर्गठित करें

सभी उपरोक्त से इंजीनियरिंग निष्कर्ष है — संग्रह को दो स्तरों में विभाजित करें जिनकी अनुरोध की कीमत अलग है.

  1. पहले जांचें कि क्या आपको पहचाना गया है। अपने पार्सर से एक ही परिणाम को अपने ब्राउज़र से मैन्युअल रूप से निकालें। मैन्युअल रन में सीधे लिंक और स्वचालित में goto — यह आपकी छिपाने की कोशिश का एक दोष है, न कि Google की विशेषता।
  2. परिणाम संग्रह और लिंक का रिज़ॉल्व अलग करें। पहला स्तर भारी है: रेंडर, व्यवहारिक विश्वसनीयता, गुणवत्ता वाले IP। दूसरा — 302 के लिए साधारण GET, बिना ब्राउज़र और बिना अनुकरण के। उसी महंगे स्टैक के माध्यम से रिज़ॉल्व चलाना — बजट को व्यर्थ जलाना है।
  3. गिगाबाइट्स नहीं, सीमाओं की गणना करें। संकीर्ण स्थान अनुरोधों की संख्या में स्थानांतरित हो गया है। आवश्यक RPS के आधार पर पते के पूल की योजना बनाएं, न कि ट्रैफ़िक के वॉल्यूम के आधार पर।
  4. टोकन को कैश करने की कोशिश न करें। वे एक बार के होते हैं। रिज़ॉल्व के परिणाम को कैश करना — "अनुरोध + स्थिति + डोमेन" का संयोजन, न कि स्वयं टोकन।
  5. ऐतिहासिक डेटा में टूटने की तारीख को चिह्नित करें। 26 अगस्त 2026 को रिपोर्टों में एक स्पष्ट मील का पत्थर होना चाहिए, अन्यथा विधिक विफलता को दृश्यता में गिरावट के रूप में पढ़ा जाएगा।
  6. ब्लॉकों की अलग-अलग जांच करें। ऑर्गेनिक पहले से ठीक हो सकता है, जबकि AI ओवरव्यू और स्थानीय ब्लॉक नहीं हो सकते। उन्हें स्वतंत्र संस्थाओं के रूप में परीक्षण करें।

कौन से प्रॉक्सी और कहाँ

दो स्तरों में विभाजन के साथ बुनियादी ढांचे का विभाजन भी आता है — और यह एक ही पूल के माध्यम से सब कुछ चलाने की तुलना में काफी सस्ता है।

परिणाम के संग्रह का हिस्सा सबसे संवेदनशील है। यहां महत्वपूर्ण है कि सामान्य उपयोगकर्ताओं के बीच में न दिखें, और यही स्तर निर्धारित करता है कि क्या आप सीधे लिंक या goto देखेंगे। इसके लिए रिज़िडेंट प्रॉक्सी का उपयोग किया जाता है, और स्थानीय परिणाम जैसे भू-निर्भर कार्यों के लिए — मोबाइल, जहां IP किसी विशेष क्षेत्र के लिए पूरी तरह से स्वाभाविक लगता है।

लेकिन रीडायरेक्ट का रिज़ॉल्व, जैसा कि माप ने दिखाया, कोई विशेष आवश्यकताएं नहीं रखता: सामान्य GET, कोई अनुकरण नहीं, उच्च गति। यह डेटा सेंटर प्रॉक्सी के लिए एक क्लासिक कार्य है — सस्ता, तेज, कई समानांतर धाराएं। 500–1000 अतिरिक्त अनुरोधों के साथ दो दृष्टिकोणों के बीच लागत में अंतर बजट का निर्णायक लेख बन जाता है।

निष्कर्ष

Google ने परिणामों तक पहुंच बंद नहीं की — उसने इसे महंगा बना दिया और साथ ही प्रतिक्रिया प्रारूप को पहचान संकेत में बदल दिया। बाजार के लिए इसका मतलब है कि &num=100 को बंद करने के बाद शुरू किए गए पाठ्यक्रम को जारी रखना: खोज डेटा का सामूहिक संग्रह डिफ़ॉल्ट रूप से सस्ता नहीं रहता और स्पष्ट अर्थव्यवस्था के साथ एक इंजीनियरिंग कार्य बन जाता है।

व्यावहारिक रूप से, निष्कर्ष दो बिंदुओं में संकुचित होता है। यदि आप goto लिंक देखते हैं — पार्सर से शुरू करें, न कि छिपाने से: संभवतः आपको वही ठीक करना पड़ेगा जो लगता है। यदि छिपाना ठीक है, लेकिन रीडायरेक्ट अभी भी हैं — संग्रह स्तरों को अलग करें और उन अनुरोधों के लिए प्रीमियम मूल्य न चुकाएं जिनकी आवश्यकता नहीं है।

```