Pada 31 Juli 2026, hakim federal Paul Engelmayer (Distrik Selatan New York) menolak untuk menutup gugatan Reddit terhadap Perplexity AI dan agregator hasil pencarian SerpApi. Klaim utama berdasarkan pasal DMCA ยง 1201(a) tetap bertahan โ kasus ini akan berlanjut. Sebelas hari sebelumnya, hakim federal lain di California Utara membuang gugatan hampir identik dari Google terhadap SerpApi. Penghalang teknis yang sama, tergugat yang sama โ dan dua hasil yang berlawanan.
Ini bukan kontradiksi antara pengadilan. Ini adalah sinyal jelas tentang di mana sebenarnya batas hukum dalam pengambilan data pada tahun 2026. Dan batas itu tidak berada di tempat yang biasanya dicari oleh para insinyur.
Apa yang diputuskan pengadilan pada 31 Juli
Kasus Reddit, Inc. v. SerpApi LLC et al. (No. 1:25-cv-08736) diajukan oleh Reddit pada 22 Oktober 2025, dan pada Februari 2026, keluhan tersebut diperluas. Terdapat empat tergugat, dan komposisinya penting: perusahaan AI Perplexity AI, agregator hasil SerpApi, dan dua penyedia proxy โ Oxylabs UAB dan AWMProxy.
Logika tuduhan adalah sebagai berikut: perantara secara besar-besaran mengambil konten Reddit bukan dari server Reddit itu sendiri, tetapi dari hasil pencarian Google, menyembunyikan asal-usulnya untuk menghindari perlindungan; Perplexity membeli data ini dan menyajikannya ke dalam mesin AI-nya.
Hakim Engelmayer memisahkan klaim:
- Yang bertahan: klaim utama berdasarkan DMCA ยง 1201(a) โ penghindaran langkah teknis kontrol akses. Pengadilan mengakui bahwa mekanisme perlindungan Google SearchGuard memenuhi syarat sebagai langkah kontrol akses menurut hukum, dan Reddit berada "dalam zona kepentingan" norma anti-penghindaran DMCA. Menurut pernyataan hakim, platform tersebut "mewakili pasar digital global untuk karya yang dilindungi," yang menjadi tujuan pengesahan DMCA.
- Yang ditolak: klaim tentang "trafiking" berdasarkan ยง 1201(b) terhadap SerpApi, serta gugatan tentang persaingan tidak sehat dan pengayaan tanpa sebab terhadap kedua tergugat.
Penting untuk dicatat: ini adalah keputusan mengenai permohonan untuk menolak gugatan, bukan putusan mengenai substansi. Pengadilan hanya mengatakan bahwa kasus ini berhak untuk dilanjutkan ke sidang. Namun, pada tahap ini, biasanya gugatan yang lemah terhadap pengambil data akan mati โ yang ini tidak mati.
Mengapa Google kalah, sementara Reddit lolos
Pada 20 Juli 2026, hakim ketua Yvonne Gonzalez Rogers di Distrik Utara California menolak gugatan Google terhadap SerpApi berdasarkan DMCA โ tanpa hak untuk mengajukan kembali dalam bentuk sebelumnya. Kami membahas keputusan ini secara mendetail: pengadilan setuju bahwa penggantian sidik jari browser, rotasi IP, dan penyelesaian captcha adalah penghindaran teknis, tetapi penghindaran itu sendiri tidak ilegal jika di balik penghalang tidak ada karya yang dilindungi hak cipta.
Google terjatuh di sini. Perusahaan tidak menyatakan bahwa hasil pencariannya dilindungi oleh Undang-Undang Hak Cipta, dan tidak menunjukkan bahwa mereka menerapkan SearchGuard "dengan izin pemegang hak," seperti yang diharuskan oleh 17 U.S.C. ยง 1201(a)(3)(B). Penghalang melindungi pendapatan iklan โ dan DMCA melindungi bukan pendapatan, tetapi hak cipta.
Reddit masuk dari sisi yang berbeda. Di balik SearchGuard yang sama, menurut Reddit, terdapat bukan "hasil yang datar dan tidak relevan," tetapi pos-pos pengguna โ teks dari orang-orang hidup, yang haknya dilisensikan oleh Reddit, termasuk melalui transaksi keuangan dengan Google dan OpenAI. Perbedaannya bukan pada teknik penghindaran. Perbedaannya adalah apa yang sebenarnya ada di balik penghalang.
Kesimpulan yang perlu dicatat oleh insinyur dan pemilik data: identitas teknis dari tindakan tidak berarti identitas hukum dari konsekuensi. Skrip yang sama dengan rotasi IP residensial dalam satu kasus โ pekerjaan yang sah dengan fakta publik, dalam kasus lain โ penghindaran perlindungan karya yang dilindungi.
Di mana peran proxy dalam kasus ini
Bagi industri kami, hal yang paling menarik dalam kasus ini bukanlah Perplexity, tetapi dua nama lain dalam daftar tergugat. Oxylabs dan AWMProxy terlibat bukan sebagai saksi dan bukan sebagai "alat pihak ketiga," tetapi sebagai tergugat: penggugat percaya bahwa infrastruktur anonimisasi adalah bagian dari skema penghindaran.
Permohonan Oxylabs untuk menolak gugatan ditangguhkan oleh pengadilan โ karena adanya tumpang tindih substansial antara argumennya dengan argumen SerpApi dan Perplexity, briefing dibekukan hingga permohonan tergugat diselesaikan. Permohonan ini sekarang telah diselesaikan, dan teori anti-penghindaran dasar bertahan. Artinya, giliran telah sampai pada penyedia proxy, dan mereka mendekatinya dalam posisi negosiasi yang jauh lebih buruk dibandingkan enam bulan lalu.
Dua detail lagi dari materi kasus yang banyak berbicara tentang skala dan metode pembuktian:
- Menurut data yang diperoleh melalui permintaan pengadilan, SerpApi selama dua minggu di bulan Juli 2025 mengakses sekitar 1,8 miliar halaman hasil pencarian Google yang berisi data Reddit.
- Reddit menerapkan jebakan klasik: menempatkan konten yang hanya terlihat oleh crawler Google, dan kemudian menemukannya dalam jawaban Perplexity. Ini adalah jenis bukti yang mengubah "mereka mengambil data dari suatu tempat" menjadi rantai pasokan yang konkret.
Metode "umpan beracun" ini perlu diingat juga karena alasan lain. Ini menunjukkan bahwa platform besar telah lama beralih dari pemblokiran ke pengumpulan bukti: konten yang ditandai, halaman honeypot, snippet unik. Ketelitian Anda di tingkat jaringan tidak menyelamatkan jika konten itu sendiri sudah ditandai.
Kelemahan gugatan yang jarang dibahas
Reddit telah melewati filter pertama, tetapi posisinya jauh dari sempurna, dan pembelaan menyerang dua titik lemah.
Pertama โ siapa yang sebenarnya memiliki pos. Ketentuan layanan Reddit mempertahankan hak atas publikasi oleh penulis, sementara platform mendapatkan lisensi non-eksklusif. SerpApi bersikeras bahwa celah ini "fatal untuk setiap poin" dalam gugatan: tidak mungkin melindungi hak cipta atas sesuatu yang tidak Anda miliki. Argumen yang sama terhadap Google sama sekali tidak berhasil โ di sana, perselisihan terjadi tentang hasil pencarian mereka sendiri.
Kedua โ kemampuan perlindungan dari contoh-contoh tertentu. Dalam keluhan yang diperluas, Reddit memberikan contoh materi yang dianggapnya sebagai karya cipta: fragmen kebijakan privasi, daftar film, tanggal dan alamat klub jazz. Pembelaan dengan tepat menjawab bahwa daftar, fakta, dan fragmen pendek tidak mencapai ambang perlindungan. Ditambah dengan argumen terpisah: SearchGuard bukanlah "langkah kontrol akses yang efektif," karena seseorang dapat melewatinya tanpa hambatan โ satu jalur akses selalu terbuka.
Argumen-argumen ini tidak hilang โ mereka hanya ditunda hingga tahap substansi. Jadi, "Reddit menang" โ adalah penyederhanaan yang kuat. Lebih tepatnya: teori anti-penghindaran terhadap pengambil data dan pembeli data mendapatkan hak untuk hidup di pengadilan New York. Di AS, keputusan satu distrik tidak mengikat distrik lain, dan kami menyaksikan perpecahan praktik secara real-time.
Apa artinya secara praktis
Jika Anda mengumpulkan data untuk bisnis, dari keputusan 31 Juli terdapat hal-hal yang cukup praktis.
- Evaluasi bukan penghalang, tetapi konten di baliknya. Menghindari captcha di halaman dengan harga, jadwal, atau alamat โ adalah satu cerita risiko. Menghindari penghalang yang sama untuk teks, foto, dan ulasan, yang haknya dimiliki oleh seseorang โ adalah hal yang sama sekali berbeda. Eksposur hukum ditentukan oleh objek, bukan alat.
- Pembeli data tidak lagi aman. Perplexity membangun pembelaan dengan menyatakan bahwa mereka hanya pembeli akhir dan "merangkum diskusi publik." Pengadilan tidak menganggap argumen ini cukup untuk menutup kasus. Ini adalah sinyal langsung bagi semua yang membeli dataset siap pakai: asal data harus dapat dijelaskan.
- Kontrak dan ToS hidup terpisah dari DMCA. Bahkan di mana teori hak cipta runtuh, pelanggaran syarat penggunaan tetap menjadi dasar yang independen. Kalahnya platform dalam DMCA tidak berarti bahwa pengambilan data "diizinkan oleh pengadilan."
- Lapisan infrastruktur menjadi terlihat bagi penggugat. Ketika penyedia proxy menjadi salah satu tergugat, pertanyaan "apa yang diketahui dan dicatat penyedia saya tentang lalu lintas saya" tidak lagi menjadi paranoid. Pilih penyedia yang memiliki sumber kolam yang jelas, kebijakan penggunaan yang jelas, dan KYC โ ini adalah bagian administratif yang membosankan yang membedakan mitra infrastruktur dari peserta dalam skema orang lain. Kami telah menulis tentang kriteria dalam analisis praktik pengumpulan data yang sah melalui proxy.
- Pisahkan tugas berdasarkan tingkat risiko. Pemantauan harga, pemeriksaan hasil pencarian, kontrol ketersediaan sumber daya sendiri, dan pengujian geo โ adalah skenario tipikal dengan profil hukum yang dapat diprediksi; untuk mereka, proxy residensial atau alamat data center yang murah cocok, jika platform tidak memerlukan asal "residensial." Pengambilan massal konten hak cipta orang lain untuk melatih model โ adalah skenario yang sekarang berpindah ke ruang sidang, dan harus diselesaikan dengan lisensi, bukan rotasi IP.
Secara singkat
Dua pengadilan federal dalam sebelas hari berbeda dalam penilaian tentang penghindaran yang sama dari penghalang yang sama. California: penghindaran perlindungan pencarian tanpa hak cipta di belakangnya โ bukan pelanggaran DMCA. New York: jika di balik penghalang terdapat konten pengguna yang dilindungi, klaim anti-penghindaran berhak untuk dipertimbangkan, bersama dengan klaim terhadap perantara dan pembeli data.
Bagi mereka yang bekerja dengan data secara profesional, ada satu kesimpulan: sisi teknis pengumpulan tidak lagi menjadi faktor risiko utama. Yang utama adalah pertanyaan tentang hak atas apa yang Anda ambil, dan transparansi rantai di mana data tersebut sampai kepada Anda. Tonggak berikutnya dalam kasus ini adalah permohonan Oxylabs, yang pengadilan bekukan setelah keputusan mengenai tergugat.
