Quay lại blog

Google ẩn URL khỏi kết quả tìm kiếm: goto-redirects và điều gì sẽ xảy ra với việc phân tích SERP

Vào ngày 26 tháng 8 năm 2026, Google đã xác nhận việc triển khai google.com/goto: các liên kết trong kết quả tìm kiếm dẫn đến một chuyển hướng mã hóa, chứ không phải trang web. Hơn nữa, chỉ những người mà tìm kiếm coi là bot mới thấy sự thay đổi này. Chúng ta sẽ phân tích cơ chế của các token, giá của vấn đề trong khoảng 500–1000 yêu cầu và cách tái cấu trúc việc thu thập dữ liệu thành hai lớp.

📅31 tháng 8, 2026
Google ẩn URL khỏi kết quả tìm kiếm: goto-redirects và điều gì sẽ xảy ra với việc phân tích SERP
```html

Ngày 26 tháng 8 năm 2026, Google đã chính thức xác nhận: các liên kết trong kết quả tìm kiếm không còn dẫn trực tiếp đến trang web nữa. Thay vì địa chỉ trang trong HTML, có một chuyển hướng dạng google.com/goto?url=... với mã thông báo được mã hóa. Điều khó chịu nhất trong câu chuyện này là các liên kết bị thay thế không đến với tất cả mọi người. Người bình thường trong trình duyệt thấy các URL trực tiếp. Chúng được giấu đi chính từ những người mà Google đã coi là tự động hóa.

Chuyện gì đã xảy ra

Các tín hiệu đơn lẻ đầu tiên đã xuất hiện vào ngày 23 tháng 6 năm 2026 — điều này đã được Alex Greenland chú ý. Vào ngày 2 tháng 7, hiện tượng này đã được Brody Clark ghi nhận một cách đại trà. Và vào ngày 26 tháng 8, Derek Perkins, CEO của nền tảng theo dõi vị trí Nozzle, đã báo cáo về việc triển khai gần như hoàn toàn, và Google đã xác nhận sự thay đổi một cách chính thức.

Cách diễn đạt của đại diện công ty cho Search Engine Roundtable đã được nhấn mạnh là chung chung: Google có “lịch sử dài trong việc áp dụng các biện pháp kỹ thuật chống lại các hình thức lạm dụng đang tiến hóa”, và công ty “thường xuyên thực hiện các bước để bảo vệ dịch vụ và người dùng của mình”. Ai cụ thể được coi là lạm dụng — không được làm rõ bằng một từ nào.

Cơ chế rất đơn giản và vì thế đau đớn. Trước đây, trong cấu trúc kết quả có địa chỉ sẵn có — trình phân tích lấy nó cùng với tiêu đề và đoạn trích trong một yêu cầu. Bây giờ có liên kết đến chuyển hướng trung gian của Google, và bên trong là mã thông báo protobuf: chuỗi base64 với tiền tố CAES, sau đó là payload được mã hóa. Không thể giải mã nó ở phía bạn — bạn không có chìa khóa. Cách duy nhất để biết liên kết dẫn đến đâu là đi theo nó.

Ba chi tiết xác định giá trị của vấn đề

  • Mã thông báo là một lần sử dụng. Cùng một liên kết đến cùng một trang theo cùng một yêu cầu nhận được mã thông báo mới mỗi khi hiển thị. Không thể xây dựng một danh bạ “mã thông báo → URL” và tái sử dụng nó.
  • HEAD không giúp ích gì. Yêu cầu HEAD trả về 200 mà không có tiêu đề Location — tức là không có địa chỉ đích. Cần một GET đầy đủ, trả về 302 với độ trễ trung bình khoảng 59 ms.
  • Không chỉ có lõi tự nhiên bị ảnh hưởng. Các địa chỉ ẩn xuất hiện trong kết quả thông thường, video, nguồn AI Overviews, khối “Câu hỏi tương tự” và trong quảng cáo (các địa chỉ aclk). Trong nghiên cứu của Growtika, họ đã phân tích 493 liên kết theo tám yêu cầu — địa chỉ đích đã bị ẩn đi trong mỗi trường hợp.

Phép toán trở nên khó chịu. Theo ước tính của Perkins, để giải quyết tất cả các liên kết cho năm trang kết quả theo một yêu cầu, cần từ 500 đến 1000 yêu cầu. Một phép đo độc lập từ scraping.club sau khi loại bỏ trùng lặp đưa ra con số khiêm tốn hơn là 295–565 — nhưng vẫn nhiều hơn hai bậc so với một yêu cầu mà trước đây đã được sử dụng.

Câu trích dẫn quan trọng của Perkins mô tả bản chất của sự thay đổi tốt hơn bất kỳ con số nào: giới hạn ràng buộc không phải là băng thông hay lưu trữ, mà là giới hạn tỷ lệ.

Tại sao đây là cú đánh vào tự động hóa

Điều thú vị nằm ở đây. Theo quan sát của scraping.club, việc thay thế liên kết không phải là phổ quát: người dùng thông thường — đã đăng nhập hoặc ở chế độ ẩn danh — vẫn nhận được các URL trực tiếp. Các chuyển hướng ổn định đến tay các khách hàng tự động hóa: các kịch bản khởi động trình duyệt với các cờ như --remote-debugging-port, và các ngăn xếp headless với sự tự động hóa hoàn toàn.

Kết luận thực tiễn mà bạn nên nhận thức trước khi bắt đầu viết lại trình phân tích: sự xuất hiện của các liên kết goto trong phản hồi của bạn là một tín hiệu chẩn đoán. Nó có nghĩa là Google đã phân loại khách hàng của bạn là bot. Bạn không gặp phải định dạng kết quả mới — bạn đã thấy cách mà kết quả trông như thế nào đối với những người đã bị phát hiện. Và cần sửa chữa không phải là trình phân tích liên kết, mà là những đặc điểm nào khiến bạn khác biệt với con người: cờ khởi động, thứ tự tiêu đề, dấu vân tay TLS, hành vi của trang. Chúng tôi đã phân tích phương pháp tự kiểm tra như vậy trong tài liệu về cách lấy bản đồ phát hiện của trang web qua các kịch bản của chính nó.

Chi tiết thú vị, xác nhận giả thuyết: chính việc giải quyết chuyển hướng của Google gần như không được bảo vệ. Theo các phép đo của scraping.club, để đi theo liên kết không cần proxy, không cần tiêu đề đặc biệt, không cần giả mạo TLS — thư viện thông thường requests hoạt động không kém gì Chrome giả mạo, và với khối lượng nhỏ có thể đạt được 110+ yêu cầu mỗi giây mà không có giới hạn rõ ràng. Điều đó có nghĩa là rào cản không phải là mã hóa hay mạng. Đây là thuế trên khối lượng: bạn không bị chặn, bạn chỉ đơn giản là bị tính phí theo yêu cầu.

Cú đánh thứ hai liên tiếp

Sự thay đổi này không nên được đọc tách biệt khỏi cái trước đó. Từ ngày 12 đến 14 tháng 9 năm 2025, Google đã tắt tham số &num=100, cái mà trả về một trăm kết quả trên một trang. Sau đó, để đạt được độ sâu kết quả tương tự, cần khoảng mười lần nhiều yêu cầu hơn.

Hậu quả đã trở nên rõ ràng xa hơn cả việc phân tích. Theo phân tích 319 tài sản, được nghiên cứu bởi Search Engine Land, 87,7% trang web đã mất hiển thị trong Search Console, trong khi 77,6% mất một phần các yêu cầu xếp hạng độc đáo. Lưu lượng thực tế không thay đổi — việc đo lường đã bị hỏng: phần lớn “hiển thị” ở các vị trí xa được tạo ra không phải bởi con người, mà bởi các trình theo dõi, kéo hàng trăm kết quả.

Chúng ta cộng hai bước: trước tiên, kết quả đã tăng giá gấp mười lần về số lượng yêu cầu, giờ đây mỗi kết quả lại thêm một yêu cầu riêng cho địa chỉ của nó. Chiến lược trở nên rõ ràng — Google một cách có hệ thống tăng giá thành của việc thu thập dữ liệu từ chính kết quả của mình.

Bối cảnh pháp lý cũng đáng chú ý. Các biện pháp kỹ thuật đã được áp dụng đúng vào thời điểm mà con đường pháp lý gặp trục trặc: vụ kiện của Google đối với SerpApi theo DMCA đã bị bác bỏ — tòa án đã phân định ranh giới giữa việc bảo vệ tác phẩm bản quyền và quy định về quyền truy cập vào các sự kiện công khai, chỉ ra rằng các sự kiện và URL không phải là tác phẩm. Chi tiết về quyết định này và hậu quả của nó đã được chúng tôi phân tích trong tài liệu riêng về vụ kiện Google chống lại SerpApi. Không thể cấm — nhưng có thể làm cho nó trở nên đắt đỏ.

Cái gì đang bị hỏng trong báo cáo ngay bây giờ

Nền tảng DemandSphere đã liệt kê các sự cố cụ thể xảy ra nếu không có hành động nào được thực hiện:

  1. Miền đích bị thu hẹp thành google.com. Trình phân tích trung thực ghi lại những gì nó thấy trong cấu trúc — và toàn bộ kết quả trở thành “thuộc về Google”.
  2. Sự đối chiếu các trang của bạn bị hỏng. Hệ thống không còn nhận ra các URL của bạn và cho rằng bạn đã rơi ra khỏi kết quả.
  3. Phần trăm phiếu bầu và phân bổ của đối thủ bị ảnh hưởng — không còn gì để tính, tất cả các liên kết đều trên một miền.
  4. Dòng lịch sử bị đứt ngay tại ngày triển khai. Đây là điều xảo quyệt nhất: biểu đồ sẽ cho thấy sự sụt giảm mà thực tế không xảy ra.

Tin tốt là: dữ liệu vị trí thuần túy ít bị ảnh hưởng hơn. DataForSEO đã thông báo vào ngày 5 tháng 7 năm 2026 rằng 99,99% kết quả tự nhiên qua API của họ đã được trả về với các địa chỉ trực tiếp. Vấn đề tập trung vào các khối kết quả — theo ước tính của Growtika, các liên kết goto vẫn xuất hiện trong khoảng một nửa AI Overviews và một phần tư các khối địa phương. Điều đó có nghĩa là những gì quan trọng nhất hiện nay đang bị ảnh hưởng: các nguồn AI-đáp và kết quả địa phương.

Cách tái cấu trúc việc thu thập

Kết luận kỹ thuật từ tất cả những điều đã nêu là chia việc thu thập thành hai lớp với giá yêu cầu khác nhau.

  1. Trước tiên, hãy kiểm tra xem bạn có bị phát hiện không. Lấy cùng một kết quả bằng trình phân tích của bạn và thủ công từ trình duyệt sạch. Các liên kết trực tiếp trong lần chạy thủ công và goto trong tự động — đó là bản án cho việc ngụy trang của bạn, không phải là thuộc tính của Google.
  2. Chia tách việc thu thập kết quả và giải quyết liên kết. Lớp đầu tiên nặng nề: render, độ tin cậy hành vi, IP chất lượng. Lớp thứ hai — GET đơn giản cho 302, không cần trình duyệt và không cần giả mạo. Chạy giải quyết qua cùng một ngăn xếp đắt đỏ — sẽ đốt cháy ngân sách một cách vô ích.
  3. Tính toán giới hạn, không phải gigabyte. Điểm nghẽn đã chuyển sang số lượng yêu cầu. Lập kế hoạch cho nhóm địa chỉ dựa trên RPS yêu cầu, không phải trên khối lượng lưu lượng.
  4. Đừng cố gắng lưu trữ mã thông báo. Chúng là một lần sử dụng. Việc lưu trữ có ý nghĩa cho kết quả giải quyết — cặp “yêu cầu + vị trí + miền”, không phải mã thông báo tự nó.
  5. Đánh dấu ngày đứt gãy trong dữ liệu lịch sử. Ngày 26 tháng 8 năm 2026 phải được ghi rõ trong báo cáo, nếu không, sự sai lệch phương pháp sẽ được đọc như sự sụt giảm khả năng hiển thị.
  6. Kiểm tra các khối riêng biệt. Tự nhiên có thể đã ổn, nhưng AI Overviews và khối địa phương thì không. Kiểm tra chúng như những thực thể độc lập.

Các proxy nào và ở đâu

Từ việc chia thành hai lớp cũng dẫn đến việc chia tách cơ sở hạ tầng — và điều này rẻ hơn nhiều so với việc chạy tất cả qua một nhóm.

Việc thu thập chính kết quả — phần nhạy cảm nhất. Ở đây quan trọng là không nổi bật so với người dùng thông thường, và chính lớp này xác định liệu bạn có thấy các liên kết trực tiếp hay goto. Đối với nó, người ta sử dụng proxy cư trú, và cho các nhiệm vụ phụ thuộc vào địa lý như kết quả địa phương — proxy di động, nơi IP trông hoàn toàn tự nhiên cho khu vực cụ thể.

Trong khi đó, việc giải quyết chuyển hướng, như các phép đo đã chỉ ra, không yêu cầu gì đặc biệt: GET thông thường, không cần giả mạo, tốc độ cao. Đây là nhiệm vụ cổ điển cho proxy trung tâm dữ liệu — rẻ, nhanh, nhiều luồng song song. Sự khác biệt về chi phí giữa hai phương pháp khi có 500–1000 yêu cầu bổ sung cho mỗi yêu cầu kết quả trở thành một mục chi tiêu quyết định.

Kết luận

Google không đóng cửa truy cập vào kết quả — họ làm cho nó đắt hơn và đồng thời biến định dạng phản hồi thành chỉ báo phát hiện. Đối với thị trường, điều này có nghĩa là tiếp tục con đường đã bắt đầu bằng việc tắt &num=100: việc thu thập dữ liệu tìm kiếm hàng loạt không còn rẻ mặc định và trở thành một nhiệm vụ kỹ thuật với kinh tế rõ ràng.

Trên thực tế, kết luận được rút ra từ hai điểm. Nếu bạn thấy các liên kết goto — hãy bắt đầu với việc ngụy trang, không phải với trình phân tích: có thể bạn sẽ phải sửa chữa không phải điều mà bạn nghĩ. Nếu việc ngụy trang ổn, nhưng vẫn có các chuyển hướng — hãy chia tách các lớp thu thập và đừng trả giá cao cho các yêu cầu mà nó không cần thiết.

```