Zurück zum Blog

Reddit schließt öffentliches Data API: Erster Stichtag am 30. September

Am 5. August 2026 kündigte Reddit die Einstellung der öffentlichen Data API an: Anwendungen wechseln auf die geschlossene Plattform Devvit, wo der Code auf den Servern des Unternehmens ausgeführt wird und nur JavaScript und TypeScript unterstützt werden. Der 30. September ist die Frist für die Registrierung, ein Datum für die Abschaltung der API gibt es nicht. Wir analysieren die Chronologie der Schließung, die tatsächlichen Limits und vier Wege, die denjenigen verbleiben, die Daten von Reddit sammeln.

📅11. September 2026
Reddit schließt öffentliches Data API: Erster Stichtag am 30. September

Bis zum 30. September 2026 müssen die Besitzer von Anwendungen, die das Reddit Data API nutzen, diese neu registrieren. Dies ist die erste strikte Frist in dem Plan, den Reddit am 5. August im Subreddit r/redditdev veröffentlicht hat: Das öffentliche Data API wird eingestellt, und Drittanbieteranwendungen wechseln zur geschlossenen Plattform Developer Platform (Devvit), wo der Code auf den Servern des Unternehmens ausgeführt wird. Es gibt kein Datum für die Abschaltung des API – und genau das macht die Situation unangenehm für alle, die auf den Daten von Reddit irgendetwas aufbauen.

Was genau am 5. August angekündigt wurde

Die Formulierungen in der Ankündigung sind betont sanft. Reddit verspricht, „alle neuen Anfragen“ an das öffentliche Data API schrittweise einzuschränken und beruhigt direkt: „None of this is changing today. It honestly won't happen this year“ – heute ändert sich nichts, und in diesem Jahr wird es nicht geschehen. Bereits genehmigte OAuth-Schlüssel funktionieren weiterhin, neue werden jedoch nur nach manueller Genehmigung ausgegeben.

Hinter dieser Sanftheit steht ein Architekturwechsel, kein Tarifwechsel. Devvit führt nur JavaScript und TypeScript aus, der Speicher bietet seine Dienste (Redis und Blob-Speicher), und der Code lebt innerhalb der Infrastruktur von Reddit. Über Python wird in der Ankündigung separat und unmissverständlich gesagt: „Python support is not currently on our roadmap“. Für einen Markt, in dem der überwiegende Teil der Datenpipeline in Python über PRAW und Requests geschrieben ist, ist das keine „Migration“, sondern ein Neuschreiben von Grund auf für eine fremde Laufzeitumgebung – mit dem Verlust des Rechts, die Daten selbst zu behalten.

Der Kalender sieht heute so aus:

  • 30. September 2026 – Frist für die Registrierung bestehender Anwendungen. Die Registrierung ist kostenlos und verpflichtet nicht zur Migration, aber ohne sie wird die Anwendung nicht erfasst.
  • 31. Dezember 2026 – Frist für den Abschluss der Migration für diejenigen, die am Migration Program teilnehmen.
  • Es gibt kein Datum für die Abschaltung des Data API. Eine strikte Frist wurde nicht veröffentlicht – die Einschränkungen werden „schrittweise“ eingeführt.

Der Umzug wird durch Geld versüßt: Reddit hat etwa 1 Million Dollar für das Migrationsprogramm bereitgestellt, und ein spezifischer Entwickler erhält eine einmalige Zahlung von 1.000 Dollar, nachdem seine Anwendung umgezogen und genehmigt wurde. Das Auswahlkriterium ist, dass die Anwendung „wesentliche Vorteile oder Moderationsfunktionen“ für Gemeinschaften mit einer wöchentlichen aktiven Nutzerzahl von mindestens 1.000 bietet. Das heißt, das Programm richtet sich an Moderationsbots und nicht an analytische und Forschungs-Pipelines: Wenn Sie Reddit-Daten für Marktüberwachung, Produktanalytik oder Modelltraining sammeln, fallen Sie überhaupt nicht in diese Kategorie.

Chronologie: Warum das nicht überraschend aussieht

Die Ankündigung vom 5. August ist kein Umbruch, sondern der nächste Schritt in einer Reihe, die sich über drei Jahre erstreckt.

  1. Juli 2023 – Das Data API wird kostenpflichtig, der Tarif liegt bei etwa 0,24 Dollar pro 1.000 Aufrufen. Drittanbieter-Clients werden eingestellt.
  2. Ende 2025 – Im Rahmen der Responsible Builder Policy wird die Selbstregistrierung von OAuth-Anwendungen abgeschafft. Der Zugang wird jetzt über ein Ticket im Support angefragt, die Wartezeit beträgt Wochen, SLA wird nicht veröffentlicht, und eine Ablehnung ist der übliche Ausgang.
  3. August 2025 – Reddit sperrt die Wayback Machine für die Indizierung von Seiten von Posts, Kommentarsträngen und Profilen: Der Archiv bleibt praktisch nur die Hauptseite. Der Grund dafür ist, dass KI-Unternehmen Inhalte von Reddit über das Archiv extrahiert haben. Die Technik ist aufschlussreich: In der robots.txt gibt es keine separate Regel für das Internet Archive – dort steht nur User-agent: * / Disallow: /, und die Blockade wird auf Infrastruktur-Ebene umgesetzt.
  4. 28.–30. Mai 2026 – Der älteste Scraping-Endpoint stirbt: nicht authentifizierte .json-Endpunkte beginnen, 403 zurückzugeben.
  5. Juni 2026 – Reddit schließt old.reddit.com für nicht eingeloggte Nutzer. Der Administrator des Unternehmens erklärte dies direkt: „Old Reddit's logged-out experience is a significant source of abusive scraping“.
  6. 5. August 2026 – Ankündigung der Einstellung des öffentlichen Data API.

Über die alte Benutzeroberfläche von Reddit spricht man ausweichend: „We don't have a hard timeline right now“, und Mitbegründer Steve Huffman beschreibt die Optionen als „Zugang einschränken, wichtige Szenarien verschieben oder neu schreiben“. Parallel wird AutoMod durch das LLM-System Rules Hub ersetzt – das heißt, die Moderation zieht ebenfalls in die Plattform um.

Es ergibt sich ein klares Bild: Reddit schließt systematisch jeden Zugang, über den Inhalte kostenlos nach außen gelangen konnten, und verkauft gleichzeitig dieselben Inhalte lizenziert – öffentliche Geschäfte mit Google und OpenAI bestätigen dies. Die rechtliche Front arbeitet in dieselbe Richtung: Am 31. Juli 2026 wies der Bundesrichter von Manhattan, Paul Engelmayer, im Wesentlichen den Antrag auf Einstellung der Klage von Reddit gegen Perplexity, SerpApi, Oxylabs und AWMProxy zurück – das Unternehmen beschuldigt sie, ihre Daten auf Umwegen zu erhalten, durch die Google-Suchergebnisse. Eine separate Klage von Reddit gegen Google selbst wurde zehn Tage zuvor, am 20. Juli, eingestellt. Der Streit dreht sich genau darum, ob der Zugang zu öffentlichen Inhalten über einen Vermittler als Umgehung des Schutzes gilt – und bisher neigt das Gericht dazu, dass diese Frage einer substantiven Prüfung bedarf.

Was bleibt denen, die Reddit-Daten sammeln

Realistisch: Es gibt keinen kostenlosen offiziellen Weg mehr zu den Daten von Reddit. Es bleiben vier Routen, und jede hat einen klaren Preis.

1. Registrieren Sie Ihre Anwendung bis zum 30. September. Wenn Sie eine funktionierende OAuth-Anwendung haben – es ist günstiger, dies zu tun, als es nicht zu tun. Die Registrierung ist kostenlos und verpflichtet zu nichts, aber das Fehlen im Register ist eine schlechte Position, wenn die „schrittweisen Einschränkungen“ Ihren Client erreichen. Genehmigte Schlüssel funktionieren vorerst, die Obergrenze liegt bei 100 Anfragen pro Minute für die OAuth-Client-ID, wobei dies über einen gleitenden zehnminütigen Zeitraum gemessen wird. In der Praxis liegt die stabile Rate bei etwa 60 Anfragen pro Minute: der Rest wird durch Spitzen verbraucht. Achten Sie auf die Header X-Ratelimit-Used, X-Ratelimit-Remaining und X-Ratelimit-Reset – das ist das einzige Feedback, das Sie haben.

2. Devvit – wenn Ihr Produkt innerhalb von Reddit lebt. Moderationsbot, Tool für ein Subreddit, interaktiver Post – ja, dafür gibt es Platz, und für den Umzug wird sogar bezahlt. Für Analytik, die Daten nach außen exportieren muss, gibt es dort keinen Platz: Code auf fremden Servern gibt Ihnen keine eigene Kopie der Daten.

3. Kommerzielle Lizenz. Direkte Verhandlungen, spürbare Geldsummen, greifbare Ergebnisse. Für eine Unternehmensaufgabe mit Budget – die vorhersehbarste Option und die einzige, die nicht durch die nächste Ankündigung zusammenbrechen wird.

4. Historische Archive. Für retrospektive Analysen wird das offizielle API oft überhaupt nicht benötigt. Pushshift ist seit Mai 2023 nur für Moderatoren zugänglich, aber sein Nachfolger Arctic Shift hat das Archiv überarbeitet und veröffentlicht es offen: etwa 2,5 Milliarden Elemente (ca. 1,3 Milliarden Kommentare und 1,3 Milliarden Posts), 261,8 GB komprimiertes Parquet, die Daten reichen bis Februar 2026, monatliche Veröffentlichungen. PullPush wiederholt das Schema der Pushshift-Endpunkte mit einer Obergrenze von etwa 1.000 Anfragen pro Stunde und ist für regelmäßige Ausfälle bekannt. Für die Offline-Analyse gibt es einen Dump auf Academic Torrents mit einem Volumen von 3,97 TB – ohne Such-API, nur Download. Wenn Ihre Aufgabe darin besteht, „zu zählen, worüber 2019–2025 diskutiert wurde“, deckt das Archiv dies vollständig und ohne Risiko ab.

Wo verläuft die Grenze der Verantwortung von Proxys

Bei solchen Nachrichten kommt immer der verlockende Vorschlag auf, eine einfache Lösung anzubieten: Der offizielle Kanal ist geschlossen – nehmen Sie einen Pool von Adressen und laden Sie wie früher herunter. Das ist grundsätzlich falsch, und es ist wichtig, die Grenze klar zu ziehen.

Proxys lösen Aufgaben der Verfügbarkeit und Verteilung: regionale Einschränkungen umgehen, nicht an die Begrenzung einer ausgehenden Adresse bei legitimer paralleler Erfassung öffentlicher Seiten stoßen, überprüfen, wie die Ausgabe aus einem anderen Land aussieht, unabhängige Arbeitssitzungen aufbauen. Residential-Adressen sind dort erforderlich, wo das Ziel Rechenzentrumsbereiche filtert; Rechenzentrumsproxies sind günstiger und schneller, wo es keine solche Filterung gibt.

Was Proxys nicht tun – sie geben keine Autorisierung aus. Keine Adresse verwandelt 403 an einem geschlossenen Endpoint in 200, ersetzt den OAuth-Schlüssel und hebt die Einschränkungen der Nutzungsbedingungen der Plattform auf. Reddit schließt den Zugang nicht nach IP, sondern nach Zugriffsrechten – und in dieser Situation ist es technisch sinnlos und rechtlich riskant, die IP zu ändern, insbesondere vor dem Hintergrund der aktiven Klage gegen vier Unternehmen gleichzeitig. Wir haben diese Logik ausführlicher in einem Artikel behandelt, wann man den offiziellen API, wann ein Dataset und wann Parsing wählen sollte, und die Praxis der Arbeit mit Reddit-Limits in einem Leitfaden zur Datensammlung von Reddit.

Was diese Woche zu tun ist

Wenn Reddit-Daten Teil Ihres Produkts sind, bleiben bis zum 30. September weniger als drei Wochen. Ein vernünftiges Minimum:

  • Führen Sie eine Bestandsaufnahme durch. Finden Sie alle Stellen, an denen der Code auf Reddit zugreift: Anwendungen mit OAuth, vergessene Skripte auf .json, Drittanbieter-Services als Vermittler. Skripte auf .json sind bereits tot – wenn eines von ihnen stillschweigend nichts zurückgibt, haben Sie es einfach noch nicht bemerkt.
  • Registrieren Sie funktionierende Anwendungen. Kostenlos, ohne Verpflichtungen, und es beseitigt die Frage „was wäre wenn“.
  • Teilen Sie Aufgaben in historische und operative auf. Alles, was im Archiv gezählt werden kann, sollte auf Arctic Shift verschoben werden – dieser Teil wird für immer nicht mehr von den Entscheidungen von Reddit abhängen.
  • Bewerten Sie, was ohne Echtzeit bleibt. Wenn das Produkt ohne frische Daten an Bedeutung verliert, kalkulieren Sie die Lizenzkosten jetzt und nicht im Dezember.
  • Planen Sie einen Puffer für die Limits ein. Planen Sie eine Pipeline mit 60 Anfragen pro Minute, nicht mit 100: Bei der Durchschnittsberechnung über ein zehnminütiges Fenster fressen Spitzen den Rest auf.

Fazit

Reddit „tötet das API“ nicht über Nacht – es zieht die Schließung so in die Länge, dass die Teams heute keinen Grund zur Panik haben, und bis die tatsächlichen Einschränkungen eintreten, gibt es keine Alternativen mehr. Der 30. September ist das einzige genaue Datum in diesem Plan, und es ist kostenlos: es wäre seltsam, es nicht zu nutzen. Alles andere reduziert sich auf die ehrliche Frage, die besser im September als im Dezember beantwortet werden sollte: Wie viel kosten die Reddit-Daten konkret für Ihr Produkt, und sind Sie bereit, dafür zu zahlen – mit Zeit für das Neuschreiben für Devvit, Geld für die Lizenz oder mit dem Verzicht auf Echtzeit zugunsten des Archivs.