Zurück zum Blog

Gericht weist Reddit-Klage gegen Perplexity zurück: Zwei Entscheidungen zum Scraping in 11 Tagen

Am 31. Juli 2026 weigerte sich Richter Engelmaier (SDNY), die Klage von Reddit gegen Perplexity AI und SerpApi zu schließen: Die Anti-Circumvention-Ansprüche gemäß DMCA hielten stand. 11 Tage zuvor hatte ein Gericht in Kalifornien eine nahezu identische Klage von Google gegen denselben Beklagten abgewiesen. Warum erhielt dasselbe Umgehungsverfahren gegensätzliche Bewertungen, welche Rolle spielen die Proxy-Anbieter Oxylabs und AWMProxy und was folgt daraus?

📅3. August 2026
Gericht weist Reddit-Klage gegen Perplexity zurück: Zwei Entscheidungen zum Scraping in 11 Tagen
```html

Am 31. Juli 2026 wies der Bundesrichter Paul Engelmayer (Südlicher Bezirk von New York) die Klage von Reddit gegen Perplexity AI und den Suchergebnisaggregator SerpApi zurück. Die wesentlichen Ansprüche gemäß dem Anti-Circumvention-Artikel DMCA § 1201(a) blieben bestehen – der Fall geht weiter. Elf Tage zuvor hatte ein anderer Bundesrichter in Nordkalifornien eine nahezu identische Klage von Google gegen dasselbe SerpApi abgewiesen. Dieselbe technische Barriere, derselbe Beklagte – und zwei gegensätzliche Ergebnisse.

Dies ist kein Widerspruch zwischen den Gerichten. Es ist ein klares Signal dafür, wo die rechtliche Grenze beim Scraping im Jahr 2026 tatsächlich verläuft. Und sie verläuft nicht dort, wo Ingenieure es gewohnt sind, sie zu suchen.

Was genau entschied das Gericht am 31. Juli

Der Fall Reddit, Inc. v. SerpApi LLC et al. (Nr. 1:25-cv-08736) wurde von Reddit am 22. Oktober 2025 eingereicht und im Februar 2026 erweitert. Es gibt vier Beklagte, und die Zusammensetzung ist wichtig: Das KI-Unternehmen Perplexity AI, der Ergebnisaggregator SerpApi und zwei Proxy-Anbieter – Oxylabs UAB und AWMProxy.

Die Logik der Anklage ist folgende: Die Vermittler haben in industriellem Maßstab Inhalte von Reddit nicht von den Servern von Reddit selbst, sondern aus den Google-Suchergebnissen extrahiert und ihre Herkunft verschleiert, um den Schutz zu umgehen; Perplexity kaufte diese Daten und speiste sie in ihre KI-Engine ein.

Richter Engelmayer teilte die Ansprüche auf:

  • Bestanden: Der Hauptanspruch gemäß DMCA § 1201(a) – Umgehung der technischen Zugangskontrollmaßnahme. Das Gericht erkannte an, dass der Schutzmechanismus Google SearchGuard als Zugangskontrollmaßnahme im Sinne des Gesetzes qualifiziert ist und Reddit sich „in der Interessenszone“ der Anti-Circumvention-Normen des DMCA befindet. Nach der Formulierung des Richters verkörpert die Plattform „den globalen digitalen Markt geschützter Werke“, dessen Entwicklung der DMCA fördern sollte.
  • Abgelehnt: Der Anspruch auf „Traffic-Interception“ gemäß § 1201(b) gegen SerpApi sowie die Klagen wegen unlauterer Konkurrenz und ungerechtfertigter Bereicherung gegen beide Beklagte.

Wichtiger Vorbehalt: Dies ist eine Entscheidung über den Antrag auf Abweisung der Klage, nicht ein Urteil in der Sache selbst. Das Gericht stellte lediglich fest, dass der Fall das Recht hat, bis zur Verhandlung fortgeführt zu werden. Aber genau in dieser Phase sterben normalerweise schwache Klagen gegen Scraper – diese ist nicht gestorben.

Warum Google verlor und Reddit den Filter bestand

Am 20. Juli 2026 wies die vorsitzende Richterin Yvonne Gonzalez Rogers im Nordbezirk von Kalifornien die Klage von Google gegen SerpApi gemäß DMCA zurück – ohne das Recht auf Wiederholung in der bisherigen Form. Wir haben diese Entscheidung ausführlich analysiert: Das Gericht stimmte zu, dass das Fälschen von Browser-Fingerabdrücken, die Rotation von IP-Adressen und die Lösung von Captchas technisch eine Umgehung darstellen, aber die Umgehung selbst ist nicht rechtswidrig, wenn hinter der Barriere keine urheberrechtlich geschützten Werke stehen.

Darüber stolperte Google. Das Unternehmen machte nicht geltend, dass die Ergebnisse seiner Suche durch das Urheberrecht geschützt sind, und zeigte nicht, dass es SearchGuard „mit Genehmigung des Rechteinhabers“ implementiert hat, wie es 17 U.S.C. § 1201(a)(3)(B) verlangt. Die Barriere schützte die Werbeeinnahmen – und der DMCA schützt nicht die Einnahmen, sondern das Urheberrecht.

Reddit ging von einer anderen Seite heran. Hinter demselben SearchGuard liegen laut Reddit nicht „flache irrelevante Ergebnisse“, sondern Benutzerbeiträge – Texte lebender Menschen, an denen Reddit Rechte lizenziert, einschließlich finanzieller Transaktionen mit Google und OpenAI. Der Unterschied liegt nicht in der Technik der Umgehung. Der Unterschied liegt darin, was genau hinter der Barriere steht.

Die Erkenntnis, die Ingenieure und Dateninhaber festhalten sollten: Die technische Identität der Handlungen bedeutet nicht die rechtliche Identität der Folgen. Dasselbe Skript mit der Rotation von Residential IPs ist in einem Fall eine legale Arbeit mit öffentlichen Fakten, im anderen Fall die Umgehung des Schutzes eines geschützten Werkes.

Wo in diesem Fall die Proxys stehen

Für unsere Branche ist das Interessanteste an dem Fall nicht Perplexity, sondern die beiden anderen Namen in der Liste der Beklagten. Oxylabs und AWMProxy wurden nicht als Zeugen oder als „Instrument Dritter“ herangezogen, sondern als Mitbeklagte: Der Kläger ist der Ansicht, dass die Anonymisierungsinfrastruktur Teil des Umgehungsschemas war.

Das Abweisungsersuchen von Oxylabs wurde vom Gericht ausgesetzt – aufgrund der wesentlichen Überschneidung ihrer Argumente mit den Argumenten von SerpApi und Perplexity wurde das Briefing bis zur Entscheidung über die Anträge der Mitbeklagten eingefroren. Diese Anträge sind nun entschieden, und die grundlegende Anti-Circumvention-Theorie hat überlebt. Das heißt, die Reihe kam zu dem Proxy-Anbieter, und er kommt in einer deutlich schlechteren Verhandlungsposition an als vor sechs Monaten.

Noch zwei Details aus den Akten, die viel über das Ausmaß und die Methoden der Beweisführung aussagen:

  • Nach Daten, die durch eine gerichtliche Anfrage erhalten wurden, wandte sich SerpApi in zwei Wochen im Juli 2025 an etwa 1,8 Milliarden Seiten von Google-Suchergebnissen, die Daten von Reddit enthielten.
  • Reddit verwendete eine klassische Falle: Es platzierte Inhalte, die nur für den Google-Crawler sichtbar waren, und entdeckte sie dann in den Antworten von Perplexity. Dies ist die Art von Beweis, die das abstrakte „sie holen die Daten irgendwoher“ in eine konkrete Lieferkette verwandelt.

Die Methode mit dem „vergifteten Köder“ sollte aus einem anderen Grund in Erinnerung bleiben. Sie zeigt, dass große Plattformen längst von Blockierungen zu Beweissammlungen übergegangen sind: markierte Inhalte, Honeypot-Seiten, einzigartige Snippets. Ihre Sorgfalt auf Netzwerkebene schützt nicht, wenn der Inhalt selbst markiert ist.

Schwächen der Klage, über die selten geschrieben wird

Reddit hat den ersten Filter bestanden, aber seine Position ist bei weitem nicht makellos, und die Verteidigung zielt auf zwei Schwachstellen ab.

Erste – wem gehören überhaupt die Beiträge. Die Nutzungsbedingungen von Reddit behalten die Rechte an den Veröffentlichungen bei den Autoren, während die Plattform eine nicht-exklusive Lizenz erhält. SerpApi besteht darauf, dass diese Lücke „fatal für jeden Punkt“ der Klage ist: Man kann nicht durch Urheberrecht schützen, was man nicht besitzt. Dasselbe Argument gegen Google funktionierte überhaupt nicht – dort ging es um die eigene Ausgabe.

Zweite – die Schutzfähigkeit spezifischer Beispiele. In der erweiterten Klage führte Reddit Beispiele für Material an, das es als urheberrechtlich geschützt ansieht: einen Auszug aus der Datenschutzrichtlinie, eine Liste von Filmen, das Datum und die Adresse eines Jazzclubs. Die Verteidigung antwortet berechtigterweise, dass Listen, Fakten und kurze Auszüge nicht den Schutzschwellenwert erreichen. Außerdem ein separates Argument: SearchGuard ist keine „effektive Zugangskontrollmaßnahme“, da eine Person sie nahtlos durchqueren kann – ein Zugangspfad bleibt immer offen.

Diese Argumente sind nicht verschwunden – sie wurden einfach auf die Sachverhaltsstufe verschoben. Daher ist „Reddit hat gewonnen“ eine starke Vereinfachung. Richtig wäre: Die Anti-Circumvention-Theorie gegen Scraper und Datenkäufer hat im New Yorker Gericht das Recht auf Leben erhalten. In den USA bindet die Entscheidung eines Bezirks nicht den anderen, und wir beobachten eine Spaltung der Praxis in Echtzeit.

Was das praktisch bedeutet

Wenn Sie Daten für Ihr Geschäft sammeln, ergeben sich aus der Entscheidung vom 31. Juli durchaus praktische Dinge.

  1. Bewerten Sie nicht die Barriere, sondern den Inhalt dahinter. Die Umgehung von Captchas auf einer Seite mit Preisen, Zeitplänen oder Adressen ist eine Risikogeschichte. Die Umgehung derselben Barriere für Texte, Fotos und Bewertungen, an denen jemand Rechte hat, ist prinzipiell eine andere. Die rechtliche Exposition wird durch das Objekt und nicht durch das Werkzeug bestimmt.
  2. Datenkäufer sind nicht mehr sicher. Perplexity baute ihren Schutz darauf auf, dass sie nur der Endkäufer ist und „öffentliche Diskussionen zusammenfasst“. Das Gericht hielt dieses Argument nicht für ausreichend, um den Fall abzulehnen. Dies ist ein direktes Signal an alle, die fertige Datensätze kaufen: Die Herkunft der Daten muss erklärbar sein.
  3. Vertrag und ToS leben getrennt vom DMCA. Selbst dort, wo die Urheberrechtstheorie zerfällt, bleibt die Verletzung der Nutzungsbedingungen als eigenständige Grundlage bestehen. Eine Niederlage der Plattform gemäß DMCA bedeutet nicht, dass Scraping „vom Gericht genehmigt“ ist.
  4. Die Infrastruktur-Ebene wurde für die Kläger sichtbar. Wenn Proxy-Anbieter zu den Beklagten gehören, hört die Frage „Was weiß und protokolliert mein Anbieter über meinen Traffic?“ auf, paranoid zu sein. Wählen Sie einen Anbieter, dessen Quellenpool klar sind, der eine verständliche Politik für zulässige Nutzung und KYC hat – das ist genau der langweilige Papierkram, der einen Infrastrukturpartner von einem Teilnehmer an einem fremden Schema unterscheidet. Über die Kriterien haben wir in der Analyse rechtlicher Praktiken zur Datensammlung über Proxys geschrieben.
  5. Trennen Sie Aufgaben nach Risikostufen. Preisüberwachung, Überprüfung von Ergebnissen, Kontrolle der Verfügbarkeit eigener Ressourcen und Geo-Tests sind typische Szenarien mit vorhersehbarem rechtlichem Profil; dafür eignen sich Residential Proxys oder günstige Rechenzentrumsadressen, wenn die Plattform keine „residential“ Herkunft verlangt. Massives Extrahieren fremder urheberrechtlich geschützter Inhalte zur Schulung von Modellen ist ein Szenario, das jetzt in die Gerichtssäle wandert, und es muss mit einer Lizenz und nicht mit IP-Rotation gelöst werden.

Kurz gesagt

Zwei Bundesgerichte haben sich innerhalb von elf Tagen in der Bewertung derselben Umgehung derselben Barriere unterschieden. Kalifornien: Umgehung des Suchschutzes ohne Urheberrecht dahinter – kein Verstoß gegen den DMCA. New York: Wenn hinter der Barriere geschützte Benutzerinhalte liegen, hat die Anti-Circumvention-Klage das Recht auf Prüfung, zusammen mit den Ansprüchen gegen Vermittler und Datenkäufer.

Für diejenigen, die professionell mit Daten arbeiten, gibt es eine Erkenntnis: Die technische Seite der Sammlung ist nicht mehr der Hauptfaktor des Risikos. Der Hauptfaktor ist die Frage der Rechte an dem, was Sie entnehmen, und der Transparenz der Kette, durch die diese Daten zu Ihnen gelangten. Der nächste Meilenstein in dem Fall ist der Antrag von Oxylabs, der nach der Entscheidung über die Mitbeklagten wieder aufgetaut wurde.

```