Vào ngày 20 tháng 7 năm 2026, tòa án liên bang khu vực Bắc California đã bác bỏ đơn kiện của Google chống lại SerpApi — công ty cung cấp quyền truy cập vào kết quả tìm kiếm thông qua API. Google đã cố gắng áp dụng các quy định chống lại việc thu thập dữ liệu SERP theo DMCA — những quy định được viết ra để chống lại việc bẻ khóa bảo vệ DVD. Tòa án đã trả lời: các rào cản kỹ thuật xung quanh dữ liệu không được bảo vệ bản quyền không được bảo vệ bởi luật bản quyền. Chúng ta sẽ phân tích những gì tòa án thực sự đã quyết định, những gì không quyết định và điều gì sẽ xảy ra với tất cả những ai thu thập dữ liệu từ kết quả tìm kiếm.
Điều gì đã xảy ra: thời gian của vụ án
Google đã đệ đơn kiện vào ngày 19 tháng 12 năm 2025 (vụ án 25-cv-10826-YGR, khu vực Bắc California). Bị đơn là SerpApi, dịch vụ cung cấp kết quả tìm kiếm của Google dưới dạng có cấu trúc thông qua API. Dữ liệu của nó phục vụ cho một phần đáng kể của ngành SEO: các công cụ theo dõi vị trí, công cụ tìm kiếm từ khóa, bảng điều khiển tình báo cạnh tranh.
Các sự kiện chính trong tài liệu vụ án:
- SearchGuard — hệ thống chống thu thập dữ liệu được Google ra mắt vào tháng 1 năm 2025. Nó gửi các thử thách JavaScript cho các yêu cầu từ các nguồn không xác định và yêu cầu xác nhận rằng có người đứng sau trình duyệt. Các kiểm tra tự động thường không vượt qua và bị từ chối.
- Theo Google, SerpApi đã tạo ra “hàng trăm triệu yêu cầu tìm kiếm giả mỗi ngày”, và khối lượng yêu cầu đã tăng khoảng 25.000% trong hai năm.
- Google yêu cầu bồi thường thiệt hại theo quy định — từ 200 đến 2500 đô la cho mỗi hành vi vi phạm. Với hàng triệu yêu cầu, số tiền này vượt quá doanh thu hàng năm của SerpApi, được đo bằng hàng triệu đô la. Nói cách khác, nếu đơn kiện thành công, nó sẽ đóng cửa công ty.
- SerpApi đã đệ đơn xin bác bỏ vào tháng 2 năm 2026. Quyết định được đưa ra bởi thẩm phán chính của khu vực Yvonnne Gonzalez Rogers vào ngày 20 tháng 7 năm 2026.
Tại sao DMCA không hiệu quả
Điều 1201 DMCA cấm việc vượt qua các phương tiện kỹ thuật “kiểm soát hiệu quả quyền truy cập vào tác phẩm được bảo vệ bởi luật bản quyền”. Lý do của Google: SearchGuard là một phương tiện bảo vệ kỹ thuật, SerpApi đã vượt qua nó, do đó có sự vi phạm.
Tòa án đã phân tích cấu trúc theo từng phần. Kết quả tìm kiếm thông thường — URL, đoạn trích, dữ liệu thực tế của chỉ mục, vị trí — là các sự kiện công khai, không phải là “tác phẩm được bảo vệ bởi luật bản quyền”. Do đó, SearchGuard trong phần này “không thể được coi là kiểm soát hiệu quả quyền truy cập vào tác phẩm được bảo vệ”. Các khiếu nại dựa trên kết quả không có bản quyền đã bị bác bỏ với prejudice — không có quyền kháng cáo.
Google đã chỉ ra rằng trang kết quả là “một sự pha trộn” giữa nội dung được bảo vệ và không được bảo vệ, và đã đưa ra ví dụ về hình ảnh có giấy phép trong Knowledge Panel. Tại đây, tòa án đã có một lập trường nhẹ nhàng hơn: các khiếu nại này đã bị bác bỏ với quyền sửa đổi đơn kiện. Nhưng với điều kiện — Google phải chứng minh các sự kiện cho thấy SearchGuard bảo vệ các yếu tố bản quyền với sự đồng ý của chính các chủ sở hữu bản quyền. Chỉ đơn giản là đặt một hình ảnh có giấy phép của người khác trên trang của mình và tuyên bố rằng hệ thống chống bot của mình là sự bảo vệ sẽ không thành công. Google có 21 ngày để nộp đơn kiện sửa đổi.
Cách diễn đạt của blog SerpApi về kết quả: tòa án “đã bác bỏ nỗ lực của Google mở rộng DMCA để kiểm soát quyền truy cập vào các trang công khai”. Giám đốc điều hành của công ty, Julien Halégu, gọi quyết định này là sự bảo vệ “quyền truy cập công khai vào dữ liệu công khai”.
Tại sao vụ án này lớn hơn một cuộc tranh chấp giữa hai công ty
Ngữ cảnh của một năm rưỡi qua giải thích lý do tại sao Google lại đưa vụ kiện ra tòa. Về mặt kỹ thuật, họ đã gây áp lực lên thị trường dữ liệu SERP trước đó:
- Vào tháng 9 năm 2025, Google đã loại bỏ tham số
num=100, cho phép nhận được một trăm kết quả trong một yêu cầu. Chi phí để thu thập toàn bộ kết quả đã tăng khoảng gấp mười lần. - Khi DataForSEO phát hành một giải pháp vượt qua, giảm chi phí khoảng 80%, Google đã chặn nó sau năm ngày.
Tức là về mặt kỹ thuật, Google đã thắng. Đơn kiện là một nỗ lực để thêm một công cụ pháp lý vào điều này: biến việc vượt qua hệ thống chống bot thành một hành vi vi phạm với các khoản phạt cố định cho mỗi yêu cầu. Điều này đã không được tòa án chấp nhận. Nếu điều đó xảy ra, bất kỳ CAPTCHA hoặc thử thách JS nào trên trang công khai sẽ tự động trở thành “phương tiện bảo vệ kỹ thuật của tác phẩm” — và bất kỳ trình phân tích dữ liệu công khai nào cũng sẽ trở thành vi phạm DMCA theo mặc định.
Kinh tế của vấn đề: tại sao có cuộc chiến về dữ liệu SERP
Kết quả tìm kiếm không chỉ là “một nguồn dữ liệu khác”. Nó đã xây dựng một ngành công nghiệp: theo dõi vị trí, phân tích đối thủ, giám sát giá cả, tập huấn cho các mô hình AI. Google trong khi đó lại ở trong một vị trí mâu thuẫn: chính công ty đã xây dựng tìm kiếm dựa trên việc thu thập hàng loạt nội dung của người khác, nhưng lại muốn kiểm soát hoàn toàn quyền truy cập vào kết quả tổng hợp.
Một lớp riêng biệt — trí tuệ nhân tạo. Kết quả tìm kiếm đã trở thành một cách nhanh chóng cho các mô hình ngôn ngữ để có được bức tranh mới nhất của internet mà không cần có trình thu thập riêng. Đó là lý do tại sao trong các vụ kiện của năm ngoái, bên cạnh các dịch vụ thu thập dữ liệu truyền thống, ngày càng nhiều công ty AI xuất hiện. Lập luận “chúng tôi chỉ đọc các trang công khai” nghe giống nhau ở cả công cụ SEO và trợ lý AI, và các tòa án chỉ mới bắt đầu tìm hiểu ranh giới giữa chúng. Vụ án SerpApi đưa ra câu trả lời rõ ràng ít nhất cho một câu hỏi: bản quyền không mở rộng đến các sự kiện chỉ vì chúng nằm sau CAPTCHA.
Quyết định tiếp tục đường lối đã được biết đến từ vụ hiQ Labs chống lại LinkedIn: việc thu thập dữ liệu công khai không tự nó trở thành tội phạm chỉ vì chủ sở hữu nền tảng không thích điều đó. Sự khác biệt là hiQ liên quan đến CFAA (truy cập không được phép), trong khi ở đây một con đường vượt qua khác đã bị đóng lại — bản quyền.
Điều gì mà quyết định này KHÔNG hủy bỏ
Ở đây quan trọng là không nhầm lẫn chiến thắng trong một tập hợp với sự miễn trừ. Những gì còn lại:
- Các khối kỹ thuật không biến mất. SearchGuard hoạt động chính xác như đã hoạt động vào ngày 19 tháng 7. Quyết định của tòa án không mở quyền truy cập — nó chỉ loại bỏ một loại trách nhiệm pháp lý cụ thể. Việc thu thập dữ liệu vẫn khó khăn và tốn kém về mặt kỹ thuật.
- Các khiếu nại hợp đồng và ToS. Vi phạm thỏa thuận người dùng là một lĩnh vực pháp lý riêng biệt, quyết định DMCA không ảnh hưởng đến nó.
- Bản quyền đối với các yếu tố cụ thể. Chính cánh cửa đó mà tòa án để mở. Kết quả thực tế — các sự kiện; hình ảnh trong Knowledge Panel, nội dung có giấy phép, hình ảnh, đánh giá của người dùng — thì không. Việc thu thập “mọi thứ từ trang” và thu thập vị trí và đoạn trích là những hành động pháp lý khác nhau.
- Các quy trình song song. Vào tháng 10 năm 2025, Reddit đã đệ đơn kiện tại khu vực phía Nam New York chống lại Perplexity AI, SerpApi, Oxylabs và AWMProxy, cáo buộc họ vượt qua bảo vệ và thu thập dữ liệu cho AI; đơn khiếu nại đã được sửa đổi được nộp vào ngày 6 tháng 2 năm 2026, vụ án đang trong giai đoạn xem xét các đơn xin bác bỏ. Thêm vào đó, SerpApi đang chống lại đơn kiện SearchApi tại Texas. Cảnh quan pháp lý vẫn còn tranh cãi.
Và điều quan trọng: đây là quyết định của tòa án cấp quận sơ cấp, không phải là tiền lệ kháng cáo. Google có thể sửa đổi đơn kiện về nội dung có giấy phép, và sau đó kháng cáo. Việc cho rằng vấn đề đã được đóng lại vĩnh viễn là quá sớm.
Điều gì có thể rút ra từ điều này trong thực tế
Nếu bạn thu thập dữ liệu từ kết quả tìm kiếm hoặc có kế hoạch làm như vậy, phản ứng hợp lý đối với quyết định là không phải “bây giờ có thể làm mọi thứ”, mà là làm rõ các quy tắc làm việc.
- Phân tách sự kiện và nội dung được bảo vệ ở cấp độ trình phân tích. URL, tiêu đề, đoạn trích, vị trí, sự hiện diện của các khối — đó là lớp thực tế, xung quanh đó lập trường của tòa án mạnh mẽ nhất. Hình ảnh, tài liệu có giấy phép nhúng, văn bản đầy đủ của đánh giá — là khu vực rủi ro. Về mặt kỹ thuật, điều này có nghĩa là danh sách trắng các trường trong bộ trích xuất, không phải là “lưu toàn bộ HTML để phòng trường hợp”.
- Đừng nhầm lẫn rủi ro pháp lý với rủi ro vận hành. Vấn đề chính của bạn khi thu thập SERP không phải là tòa án, mà là các khối, CAPTCHA và chất lượng IP. Thị trường đã trở nên khắt khe hơn: sau khi hủy
num=100, cùng một khối lượng dữ liệu có giá trị cao hơn nhiều về yêu cầu. Phần thực tiễn — các khối nào nên thu thập và tại sao các phiên lại bị ngắt — chúng tôi đã phân tích trong hướng dẫn về thu thập dữ liệu Google SERP và AI Overviews. - Giữ tải hợp lý. Con số “25.000% tăng trưởng yêu cầu” không phải là ngẫu nhiên trong đơn kiện: khối lượng yêu cầu quá mức tự nó trở thành một lập luận chống lại bạn — cả trong tòa án và trong mắt hệ thống chống bot. Các khoảng thời gian hợp lý, các yêu cầu ưu tiên thay vì thu thập toàn bộ và lưu trữ kết quả giảm cả hai loại rủi ro ngay lập tức.
- Giữ geo và loại IP phù hợp với nhiệm vụ. Kết quả được cá nhân hóa theo khu vực, và dữ liệu thu thập “từ bất cứ đâu” chỉ đơn giản là không chính xác. Đối với các phiên chính xác về địa lý và ổn định, thường sử dụng proxy dân cư; đối với các khối lượng lớn các yêu cầu kỹ thuật đồng nhất, nơi độ nhạy với việc phát hiện thấp hơn, proxy trung tâm dữ liệu thường rẻ hơn.
- Ghi lại những gì và tại sao bạn thu thập. Một tài liệu nội bộ dài nửa trang — nguồn gốc, trường, tần suất, thời gian lưu trữ — không tốn nhiều, nhưng trong bất kỳ cuộc điều tra nào nó phân biệt việc thu thập nghiên cứu với việc thu thập không kiểm soát. Các khía cạnh pháp lý liên quan đã được phân tích trong tài liệu về sử dụng hợp pháp proxy.
Kết luận
Quyết định vào ngày 20 tháng 7 năm 2026 là một điểm đáng chú ý trong cuộc tranh cãi về việc thu thập dữ liệu công khai. Tòa án đã từ chối coi hệ thống chống bot là “bảo vệ tác phẩm”, khi mà nó chỉ chứa các sự kiện, không phải nội dung sáng tạo, và đã đóng cửa khiếu nại này một cách dứt khoát. Đồng thời, tòa án đã để Google 21 ngày để thử nghiệm với các yếu tố có giấy phép trên trang.
Ý nghĩa thực tiễn cho thị trường dữ liệu rất đơn giản: áp lực pháp lý đối với việc thu thập các sự kiện từ kết quả đã giảm bớt, nhưng áp lực kỹ thuật thì không và sẽ không. Các công cụ phân tích SEO, tình báo cạnh tranh và giám sát giá cả tiếp tục hoạt động như trước đây: cơ sở hạ tầng truy cập chất lượng, tải trọng cẩn thận và hiểu biết rõ ràng về các trường cụ thể mà bạn đang thu thập từ trang.
