Retour au blog

Reddit ferme son API de données public : 30 septembre, première échéance

5 août 2026, Reddit a annoncé la fermeture de son API Data public : les applications migrent vers la plateforme fermée Devvit, où le code s'exécute sur les serveurs de l'entreprise et seuls JavaScript et TypeScript sont pris en charge. Le 30 septembre est la date limite d'inscription, il n'y a pas de date de désactivation de l'API. Nous examinons la chronologie de la fermeture, les limites réelles et quatre options restantes pour ceux qui collectent des données Reddit.

📅11 septembre 2026
Reddit ferme son API de données public : 30 septembre, première échéance

Jusqu'au 30 septembre 2026, les propriétaires d'applications utilisant l'API Data de Reddit doivent les réenregistrer. C'est la première échéance stricte dans le plan publié par Reddit le 5 août sur le subreddit r/redditdev : l'API Data publique est en cours de fermeture, et les applications tierces migrent vers la plateforme fermée Developer Platform (Devvit), où le code s'exécute sur les serveurs de l'entreprise elle-même. Il n'y a pas de date de désactivation de l'API — et c'est précisément ce qui rend la situation désagréable pour tous ceux qui construisent quelque chose sur les données de Reddit.

Qu'est-ce qui a été annoncé le 5 août

Les formulations de l'annonce sont délibérément douces. Reddit promet de « limiter progressivement toutes les nouvelles demandes » à l'API Data publique et rassure directement : « None of this is changing today. It honestly won't happen this year » — rien ne change aujourd'hui, et cela ne se produira pas cette année. Les clés OAuth déjà approuvées continuent de fonctionner, de nouvelles sont délivrées, mais par approbation manuelle.

Sous cette douceur se cache un changement d'architecture, et non de tarification. Devvit exécute uniquement JavaScript et TypeScript, le stockage fournit son propre (Redis et blob-storage), et le code vit au sein de l'infrastructure de Reddit. Concernant Python, l'annonce est claire et sans ambiguïté : « Python support is not currently on our roadmap ». Pour un marché où la grande majorité des pipelines de collecte de données sont écrits en Python sur PRAW et requests, ce n'est pas une « migration », mais une réécriture depuis zéro pour un runtime étranger — avec la perte du droit de garder les données chez soi.

Le calendrier à ce jour est le suivant :

  • 30 septembre 2026 — date limite d'enregistrement de l'application existante. L'enregistrement est gratuit et n'oblige pas à migrer, mais sans lui, l'application ne sera pas prise en compte.
  • 31 décembre 2026 — date limite pour terminer la migration pour ceux qui ont rejoint le Migration Program.
  • Il n'y a pas de date de désactivation de l'API Data. L'échéance stricte n'est pas publiée — les restrictions sont mises en place « progressivement ».

Le déménagement est adouci par des fonds : Reddit a alloué environ 1 million de dollars au programme de migration, et un développeur spécifique reçoit un paiement unique de 1 000 dollars après que son application ait migré et passé la vérification. Le critère de sélection est que l'application doit apporter « un bénéfice substantiel ou des fonctions de modération » à des communautés comptant au moins 1 000 utilisateurs actifs par semaine. Ainsi, le programme est destiné aux bots de modération, et non aux pipelines analytiques et de recherche : si vous collectez des données Reddit pour la surveillance du marché, l'analyse produit ou l'entraînement de modèles, vous ne rentrez pas du tout dans cette catégorie.

Chronologie : pourquoi cela ne semble pas surprenant

L'annonce du 5 août n'est pas un revirement, mais une étape suivante dans une séquence qui dure depuis trois ans.

  1. Juillet 2023 — L'API Data devient payante, avec un tarif d'environ 0,24 dollar pour 1 000 appels. Les clients tiers ferment.
  2. Fin 2025 — Dans le cadre de la Responsible Builder Policy, l'auto-enregistrement des applications OAuth est annulé. L'accès est désormais demandé par ticket au support, l'attente se mesure en semaines, le SLA n'est pas publié, et le refus est un résultat courant.
  3. Août 2025 — Reddit bloque l'indexation des pages de posts, des fils de commentaires et des profils par Wayback Machine : l'archive ne conserve pratiquement que la page d'accueil. La raison invoquée est que les entreprises d'IA extraient le contenu de Reddit via l'archive. La technique est révélatrice : il n'y a pas de règle distincte pour Internet Archive dans le robots.txt — il y a un User-agent: * / Disallow: / général, et le blocage est mis en œuvre au niveau de l'infrastructure.
  4. 28–30 mai 2026 — le plus ancien label de scraping disparaît : les points de terminaison .json non authentifiés commencent à renvoyer 403.
  5. Juin 2026 — Reddit ferme old.reddit.com pour les utilisateurs non connectés. Un administrateur de l'entreprise a expliqué cela directement : « Old Reddit's logged-out experience is a significant source of abusive scraping ».
  6. 5 août 2026 — annonce de la fermeture de l'API Data publique.

Concernant l'ancien interface de Reddit, les déclarations sont évasives : « We don't have a hard timeline right now », et le co-fondateur de l'entreprise, Steve Huffman, a décrit les options comme « limiter l'accès, transférer des scénarios importants ou réécrire complètement ». Parallèlement, AutoMod est remplacé par le système LLM Rules Hub — c'est-à-dire que la modération est également transférée à l'intérieur de la plateforme.

Une image se dessine : Reddit ferme méthodiquement chaque accès par lequel le contenu sortait gratuitement, tout en vendant le même contenu sous licence — les transactions publiques avec Google et OpenAI le confirment. Le front juridique travaille dans la même direction : le 31 juillet 2026, le juge fédéral de Manhattan, Paul Engelmaier, a principalement rejeté la demande de cessation de l'action en justice de Reddit contre Perplexity, SerpApi, Oxylabs et AWMProxy — l'entreprise les accuse d'avoir contourné l'accès direct à ses données via les résultats de recherche Google. Une action distincte de Reddit contre Google lui-même a été abandonnée dix jours plus tôt, le 20 juillet. Le litige porte précisément sur la question de savoir si l'obtention de contenu public par l'intermédiaire d'un tiers constitue un contournement de la protection — et pour l'instant, le tribunal semble pencher vers l'idée que cette question mérite un examen au fond.

Que reste-t-il à ceux qui collectent des données Reddit

Sobrement : il n'y a plus aucun chemin officiel gratuit vers les données de Reddit. Il reste quatre itinéraires, chacun avec un prix clair.

1. Enregistrer une application avant le 30 septembre. Si vous avez une application OAuth fonctionnelle — c'est moins cher de le faire que de ne pas le faire. L'enregistrement est gratuit et n'engage à rien, mais l'absence dans le registre est une mauvaise position au moment où les « restrictions progressives » atteindront votre client. Les clés approuvées sont encore actives, le plafond est de 100 requêtes par minute par ID client OAuth, et cela est calculé sur une moyenne sur une fenêtre glissante de dix minutes. En pratique, cela se maintient autour de 60 requêtes par minute : le reste est consommé par des pics. Surveillez les en-têtes X-Ratelimit-Used, X-Ratelimit-Remaining et X-Ratelimit-Reset — c'est le seul retour d'information que vous avez.

2. Devvit — si votre produit vit à l'intérieur de Reddit. Un bot de modération, un outil pour un subreddit, un post interactif — oui, cela a sa place là-bas, et ils paieront même pour la migration. L'analyse, qui doit extraire des données vers l'extérieur, n'a pas sa place là-bas : le code sur des serveurs étrangers ne vous donne pas votre propre copie des données.

3. Licence commerciale. Négociations directes, argent tangible, résultat fonctionnel. Pour une tâche d'entreprise avec un budget — l'option la plus prévisible, et la seule qui ne sera pas affectée par la prochaine annonce.

4. Archives historiques. Pour une analyse rétrospective, l'API officielle n'est souvent pas nécessaire. Pushshift est disponible uniquement pour les modérateurs depuis mai 2023, mais son successeur Arctic Shift a retravaillé l'archive et la publie ouvertement : environ 2,5 milliards d'éléments (environ 1,3 milliard de commentaires et 1,3 milliard de posts), 261,8 Go de Parquet compressé, les données sont mises à jour jusqu'en février 2026, avec des sorties mensuelles. PullPush répète le schéma des points de terminaison de Pushshift avec un plafond d'environ 1 000 requêtes par heure et est connu pour ses temps d'arrêt réguliers. Pour l'analyse hors ligne, il existe un dump sur Academic Torrents d'une taille de 3,97 To — sans API de recherche, uniquement du téléchargement. Si votre tâche est de « compter ce qui a été discuté en 2019–2025 », l'archive la couvre complètement et sans risque.

Où se situe la limite de responsabilité des proxies

Dans de telles nouvelles, il y a toujours la tentation de proposer une solution simple : le canal officiel est fermé — prenez un pool d'adresses et téléchargez comme avant. Cela est fondamentalement incorrect, et il vaut la peine de clarifier la limite directement.

Les proxies résolvent des problèmes d'accessibilité et de distribution : contourner les restrictions régionales, ne pas être bloqué par une limite sur une seule adresse sortante lors de la collecte publique légitime de pages, vérifier à quoi ressemble les résultats depuis un autre pays, établir des sessions de travail indépendantes. Les adresses résidentielles sont nécessaires là où l'objectif filtre les plages de centres de données ; les adresses de centres de données sont moins chères et plus rapides là où il n'y a pas de filtrage.

Ce que les proxies ne font pas — c'est fournir une autorisation. Aucune adresse ne transforme un 403 sur un point de terminaison fermé en 200, ne remplace une clé OAuth et ne lève les restrictions de l'accord d'utilisateur de la plateforme. Reddit ferme l'accès non pas par IP, mais par droits d'accès — et changer d'IP dans cette situation est techniquement inutile et juridiquement risqué, surtout dans le contexte d'une action en justice active contre quatre entreprises à la fois. Nous avons examiné cette logique plus en détail dans un article sur quand choisir l'API officielle, quand un dataset, et quand le parsing, et la pratique de travail avec les limites de Reddit dans le guide de collecte de données Reddit.

Que faire cette semaine

Si les données de Reddit font partie de votre produit, il reste moins de trois semaines avant le 30 septembre. Un minimum raisonnable :

  • Faites un inventaire. Trouvez tous les endroits où le code interagit avec Reddit : applications avec OAuth, scripts oubliés sur .json, services intermédiaires tiers. Les scripts sur .json sont déjà morts — si l'un d'eux renvoie silencieusement une réponse vide, vous ne l'avez tout simplement pas encore remarqué.
  • Enregistrez des applications fonctionnelles. Gratuitement, sans obligations, et cela élimine la question « et si ».
  • Divisez les tâches en historiques et opérationnelles. Tout ce qui peut être calculé à partir de l'archive doit être transféré sur Arctic Shift — cette partie ne dépendra plus jamais des décisions de Reddit.
  • Évaluez ce qui restera sans données en temps réel. Si le produit perd son sens sans données fraîches, évaluez le coût de la licence maintenant, et non en décembre.
  • Prévoyez une marge pour les limites. Planifiez un pipeline de 60 requêtes par minute, et non de 100 : lors de la moyenne sur une fenêtre de dix minutes, les pics consomment le reste.

Conclusion

Reddit ne « tue pas l'API » en un jour — il étale la fermeture de manière à ce que les équipes n'aient pas de raison de paniquer aujourd'hui, et au moment des véritables restrictions, il n'y ait plus d'alternatives. Le 30 septembre est la seule date précise dans ce plan, et elle est gratuite : ne pas en profiter serait étrange. Tout le reste se résume à une question honnête, à laquelle il vaut mieux répondre en septembre, plutôt qu'en décembre : combien valent les données de Reddit pour votre produit spécifique et êtes-vous prêt à les payer — en temps pour réécrire pour Devvit, en argent pour une licence ou en renonçant à des données en temps réel au profit de l'archive.