Tapez « reddit seo » dans Google depuis la France. Le 12 août 2026, la première page renvoie neuf résultats organiques, et quatre d'entre eux sont des pages de Reddit lui-même : r/SEO, r/bigseo, r/localseo, r/TechSEO. Les cinq autres sont des guides, et quatre de ces cinq promettent des backlinks ou du trafic dès leur titre ou leur description. Un AI Overview coiffe l'ensemble.
La requête « reddit ia » donne un résultat différent et plus instructif. On y trouve les subreddits attendus, mais aussi Radio France, Le Monde et Le Point, qui racontent tous la même histoire : Reddit est devenu la matière première la plus convoitée de l'industrie de l'IA. D'un côté une presse qui explique que Reddit vend son contenu très cher. De l'autre une littérature SEO qui explique comment y publier gratuitement pour récupérer des liens. Personne ne met les deux bouts ensemble.
Il vaut la peine de les mettre ensemble, parce que le résultat contredit à peu près tout ce que la première page de Google recommande sur ce sujet.
Trois commandes qui posent le problème
Commençons par le fait le plus simple à vérifier. Voici, en entier, le fichier robots.txt de Reddit tel qu'il répond aujourd'hui :
# Welcome to Reddit's robots.txt
# Reddit believes in an open internet, but not
# the misuse of public content.
# See [...] Reddit's Public Content Policy for
# access and use restrictions to Reddit content.
# See https://www.reddit.com/r/reddit4researchers/
# for details on how Reddit continues to support
# research and non-commercial use.
User-agent: *
Disallow: /
Deux directives. Aucune ligne Allow. Aucun agent nommé. Aucune ligne Sitemap. Le site le plus cité par les moteurs génératifs demande à la totalité des robots de la planète de ne rien explorer chez lui.
On pourrait soupçonner un fichier de circonstance, servi aux clients suspects et différent de celui que voient les vrais robots. La Wayback Machine permet d'écarter cette hypothèse : les captures du 1er juin 2025 et du 14 avril 2026 contiennent ce fichier au caractère près. Le fichier est stable depuis plus d'un an, et il s'agit donc bien de la position publique de Reddit. Pour mémoire, les captures plus anciennes montrent un fichier tout à fait conventionnel, avec un Allow: /, une ligne de sitemap et une poignée de robots nommément écartés.
Le second test est plus parlant encore. Si l'on rejoue la même requête en s'annonçant comme Googlebot ou comme GPTBot depuis une adresse quelconque, on ne reçoit pas de robots.txt du tout :
HTTP 403
whoa there, pardner!
Your request has been blocked due to a network policy.
Un client qui se présente comme un navigateur obtient le fichier. Un client qui se présente comme un robot se fait refouler avant même de pouvoir lire les règles. Cela ne dit rien de ce que reçoit le vrai Googlebot depuis les adresses de Google, que je ne peux pas tester. Cela établit une chose plus limitée et suffisante : chez Reddit, le blocage n'est pas une consigne polie déposée dans un fichier texte, c'est une politique appliquée au niveau du réseau. La différence avec la question habituelle du robots.txt et des crawlers IA est nette : la plupart des sites déclarent une préférence, Reddit ferme la porte.
Et pourtant, c'est la source numéro un
L'étude la plus solide disponible sur ce point est celle de Semrush publiée le 10 novembre 2025, signée Luke Harsel avec Aleksandr Drozdov et Christine Skopec. Son périmètre est sérieux : plus de 230 000 prompts, des relevés hebdomadaires entre le 14 juillet et le 12 octobre 2025, soit treize semaines, sur ChatGPT search, Google AI Mode et Perplexity, et plus de 100 millions de citations analysées. Chaque semaine, les vingt-cinq domaines les plus cités sont relevés.
Le verdict est sans ambiguïté. Reddit et LinkedIn figurent parmi les cinq domaines les plus cités sur les trois moteurs à la fois. Sur ChatGPT, Reddit et Wikipédia sont les deux premiers, et l'étude précise qu'avant septembre 2025 ces deux domaines étaient cités « about five times as much as the next most-cited domains », cinq fois plus que le suivant. Sur Google AI Mode, le classement de tête est LinkedIn, YouTube, Reddit, Google et le blog de Google. Sur Perplexity, Reddit arrive encore premier.
Mettons les deux constats côte à côte. Le domaine qui interdit l'exploration à tous les robots est le domaine le plus présent dans les réponses générées. La contradiction n'est qu'apparente, et elle renseigne sur le mécanisme réel.
L'accès ne s'explore pas, il s'achète
Klaudia Jaźwińska, dans la Columbia Journalism Review du 2 octobre 2025, donne la chronologie. En février 2024, le jour même du dépôt de son dossier d'introduction en bourse, Reddit signe avec Google un accord de licence de contenu à soixante millions de dollars par an, qui donne à Google l'accès au contenu en temps réel de ses forums. Un accord comparable est conclu avec OpenAI, estimé à environ soixante-dix millions par an. Et l'article ajoute la phrase qui referme le raisonnement : l'été précédent, Reddit avait modifié ses règles pour bloquer la plupart des robots automatisés, obligeant les entreprises d'IA à passer par un contrat de licence.
L'ordre des opérations compte. Reddit n'a pas fermé sa porte parce qu'il était pillé, puis constaté que cela lui coûtait de la visibilité. Il a fermé sa porte pour créer un marché, et il a vendu la clé. Le même article note d'ailleurs que Reddit a également restreint l'accès de la Wayback Machine à la plupart de ses pages, précisément pour empêcher que ses archives servent de porte dérobée, et qu'il a lancé son propre outil de recherche conversationnelle, Reddit Answers, adossé au modèle Gemini de Google.
Ce que devient cette clé quand on ne l'achète pas se lit dans les tribunaux. Le 23 octobre 2025, Reddit assigne Perplexity devant une cour fédérale de New York, aux côtés de trois fournisseurs de services de collecte : SerpApi, Oxylabs et AWMProxy. L'argument de la plainte vaut d'être cité tel quel : ces défendeurs sont comparés à des braqueurs qui, sachant qu'ils ne peuvent pas entrer dans la chambre forte, s'attaquent au fourgon blindé qui transporte l'argent. Le fourgon blindé, ici, ce sont les pages de résultats de Google, moissonnées en masse pour en extraire le contenu Reddit qu'elles affichent. Pour l'établir, Reddit dit avoir publié un message de test accessible au seul robot de Google, et constaté que Perplexity en restituait le contenu quelques heures plus tard. Perplexity conteste les accusations et parle d'extorsion. En juin 2025, Reddit avait déjà poursuivi Anthropic, en soutenant que ses serveurs avaient été sollicités plus de cent mille fois après l'engagement d'arrêter.
Le tableau est cohérent. Reddit est dans les réponses de Google et d'OpenAI parce que ces deux entreprises paient. Il est dans celles des autres par des chemins qu'il attaque en justice.
Première conséquence : le mécanisme n'est pas reproductible
Revenons à la première page de Google sur « reddit seo », celle qui explique comment obtenir des backlinks et du trafic depuis les subreddits. Ces conseils ne sont pas faux dans leur registre, celui de l'acquisition classique. Mais s'ils sont présentés comme une méthode pour entrer dans les réponses des IA, ils reposent sur une erreur d'attribution.
Reddit n'est pas cité massivement parce que ses fils de discussion sont bien découpés, parce que ses réponses sont autonomes ou parce qu'un balisage exemplaire les rend lisibles. Il est cité parce qu'un contrat a versé son corpus dans les systèmes. Aucune qualité rédactionnelle ne produit un contrat de licence, et aucun travail de structure ne reproduit ce que soixante millions de dollars par an achètent.
Cela invalide un raisonnement très répandu, celui qui consiste à observer les domaines les plus cités puis à imiter leur forme. Les propriétés qui font entrer un contenu dans une réponse générée, une fois qu'il est dans le corpus, restent celles que décrit l'article sur le query fan-out et l'autonomie des passages. Mais y entrer est une question d'accès, pas de forme. Confondre les deux revient à étudier le style vestimentaire des gens présents dans une salle dont on ignore qu'elle est sur invitation.
Il y a d'ailleurs une leçon en creux pour les sites ordinaires. Reddit peut se permettre de tout fermer parce qu'il vend l'entrée. Un site qui ferme sans rien vendre obtient la première moitié de l'opération et jamais la seconde, ce que détaille l'article sur le contenu derrière formulaire.
Deuxième conséquence : la position est révocable
C'est le passage le plus intéressant de l'étude Semrush, et le plus rarement repris. Entre le début du mois d'août et la mi-septembre 2025, la part des réponses de ChatGPT citant Reddit passe de près de 60 % à environ 10 %. Wikipédia suit exactement la même courbe sur la même période, de 55 % à moins de 20 %.
Six semaines, une division par six, sur le domaine le plus cité au monde. Et pas la moindre modification du contenu de Reddit pour l'expliquer.
Le contrôle est fourni par les deux autres moteurs. Sur AI Mode et sur Perplexity, la part de Wikipédia ne bouge pas, tenant autour de 3 % et de 0,8 % respectivement. La chute est donc isolée à ChatGPT, ce qui exclut un phénomène de fond touchant l'ensemble des systèmes.
Restait à en trouver la cause, et deux lectures se sont affrontées. Lily Ray, chez Amsive, a relevé la coïncidence de dates avec la suppression par Google du paramètre num=100, aux alentours du 11 septembre 2025 : si ChatGPT s'appuyait sur ce paramètre pour lire les résultats au-delà de la première page, la perte d'accès aux positions profondes expliquerait la chute. Sergei Rogulin, responsable de la visibilité organique et IA chez Semrush, propose une autre explication et l'appuie sur un chiffre : sur les quelque 263 millions de mots-clés pour lesquels Reddit se positionne dans Google, environ 90 millions, soit 34 %, se situent entre les positions 21 et 100. L'ordre de grandeur ne colle pas avec l'ampleur observée. Sa lecture, qu'il présente comme une opinion, est que « the main reason for the drop is an attempt to avoid over-citing on certain websites, to be less biased toward them ».
Le mot de la fin de l'étude est le bon : l'épisode « exposed how volatile AI visibility can be ».
Deux choses sont à retenir. La première est de méthode, et elle prolonge ce que dit l'article sur les tests A/B en GEO : entre deux explications plausibles, celle qui survit est celle dont l'ordre de grandeur correspond à l'effet observé, et il a suffi d'un calcul de proportion pour départager. La seconde est stratégique. Si votre visibilité repose sur votre présence dans un domaine tiers, elle dépend d'un arbitrage interne pris chez un fournisseur, qui peut la diviser par six en six semaines sans prévenir et sans que rien n'ait changé de votre côté. C'est précisément le genre de mouvement qu'un suivi des citations IA sérieux doit être capable de distinguer d'une contre-performance de votre part.
Troisième conséquence : le bail est en renégociation
L'accord Google arrive à échéance. Le 22 juillet 2026, le Wall Street Journal rapporte que les discussions de renouvellement sont difficiles et que les dirigeants de Reddit envisagent de restreindre, voire de couper, l'accès de Google à leur contenu. L'information, relayée notamment par CNBC, fait reculer l'action de l'entreprise le jour même. Un porte-parole de Reddit déclare aborder la négociation en se demandant ce qui sert le mieux Reddit, et ajoute que beaucoup de choses ont changé depuis la signature des premiers accords.
Aucune décision n'était prise à cette date, et il serait imprudent d'anticiper une issue. Ce qu'il faut retenir tient moins au dénouement qu'à la nature du risque. La composition des réponses générées, sur des millions de requêtes, dépend en partie d'une négociation commerciale entre deux entreprises. Cette variable n'apparaît dans aucun audit technique, ne se mesure dans aucun outil, et ne se corrige par aucune optimisation.
Ce qui reste réellement actionnable
Trois choses sont couramment confondues sous l'étiquette « faire du Reddit ». Les séparer suffit à savoir quoi faire.
Publier soi-même. C'est ce que recommande la première page de Google, et c'est la moins utile des trois pour la visibilité générative. Vous placez un texte sur un domaine que vous ne contrôlez pas, dans une communauté qui sanctionne durement la promotion déguisée, et le bénéfice éventuel revient à la page Reddit, pas à la vôtre. Comme canal d'acquisition directe, cela peut se défendre. Comme levier de citation, cela revient à travailler pour le corpus de quelqu'un d'autre.
Être mentionné par d'autres. C'est le mécanisme qui compte, et il n'est pas sous votre contrôle direct. Quand un modèle est interrogé sur votre catégorie et qu'il récupère un fil Reddit, ce qu'il lit sur vous est ce que des inconnus ont écrit. Cela rejoint exactement ce qu'établit l'article sur l'E-E-A-T et les moteurs génératifs : la réputation est un signal hors site, et elle ne se rédige pas depuis votre propre domaine. Elle se gagne en amont, par le produit et par le service.
Mesurer ce qui s'y dit. C'est la partie la plus négligée et la moins chère. Cherchez votre marque et vos concurrents sur Reddit, lisez les fils qui remontent, et vous aurez sous les yeux une bonne approximation de ce qu'un modèle lit sur vous. Si les trois premiers fils datent de 2021 et racontent un incident résolu depuis, vous connaissez une partie de votre problème de visibilité, et elle ne se réglera pas en réécrivant vos balises.
Un mot sur le marché qui se forme autour de cette question. Des prestataires spécialisés dans la présence de marque sur Reddit apparaissent, y compris en France, et l'un d'eux se positionne d'ailleurs sur la requête « reddit ia » évoquée en ouverture. La prudence s'impose pour une raison simple : les faux comptes et les recommandations téléguidées sont contraires aux règles de la plateforme, et Reddit consacre depuis deux ans des moyens considérables à protéger la valeur de son corpus. Miser sur la manipulation d'un actif que son propriétaire défend en justice n'est pas un pari raisonnable.
La leçon dépasse Reddit
Ce dossier est un cas particulier d'une règle générale : une part importante de ce que les moteurs génératifs disent de vous provient de domaines qui ne vous appartiennent pas, et chacun de ces domaines a son propre régime d'accès. Reddit se vend au contrat. Wikipédia reste ouvert mais applique des critères d'admissibilité stricts. LinkedIn monte régulièrement dans les relevés, et c'est aussi un jardin fermé.
Le travail sur votre propre site garde tout son sens : c'est la seule surface où vous décidez, et c'est là que se joue tout ce que traitent les articles sur l'analyse des logs de crawlers IA et sur le trafic référent des IA. Mais tenir un tableau de bord qui ne regarde que votre domaine revient à surveiller une seule des deux sources qui alimentent les réponses vous concernant.
Ce que cet article ne dit pas
Il ne dit pas que Reddit est sans intérêt. C'est la première source citée par plusieurs moteurs, et ce que l'on y lit sur une marque pèse. Il dit que le mécanisme qui l'y installe n'est pas transposable à un site ordinaire.
Il ne dit pas que Google ou OpenAI explorent Reddit en violation de son robots.txt. Un fichier robots.txt régit l'exploration ouverte ; un accès négocié par contrat, via une interface de données dédiée, emprunte un autre chemin et n'a pas à y figurer. Ce qui est établi, et c'est déjà beaucoup, c'est que le fichier public de Reddit n'accorde rien à personne, et que la présence de son contenu dans les réponses s'explique donc ailleurs que par la crawlabilité.
Il ne dit pas que les chiffres de l'étude Semrush valent pour votre marché. Le relevé porte sur trois moteurs, sur treize semaines de l'été 2025, et l'article ne fournit pas de ventilation par langue. Les parts observées en France en 2026 peuvent différer, et la seule façon de le savoir est de les mesurer sur votre propre jeu de prompts.
Il ne tranche pas non plus la cause de la chute de septembre 2025. L'explication de Sergei Rogulin est argumentée et son calcul de proportion est vérifiable, mais elle reste une interprétation, et OpenAI n'a rien publié à ce sujet.
Enfin, il ne prédit pas l'issue de la négociation entre Reddit et Google. À la date de publication, elle est en cours.
Le geste le plus utile après cette lecture tient en quelques minutes : cherchez le nom de votre entreprise sur Reddit, puis posez à ChatGPT et à Perplexity trois questions que vos clients se posent avant d'acheter, et regardez quels domaines apparaissent dans les sources. Si les réponses reposent sur des fils de discussion où vous n'existez pas, aucun chantier technique ne le corrigera. Si vous préférez faire poser ce diagnostic, c'est l'un des volets de notre audit GEO, et la question des sources tierces revient dans presque toutes les missions, aux côtés du référencement sur Perplexity. Pour la distinction de fond entre les deux disciplines, la page sur les différences entre GEO et SEO la pose en détail.