Le mode opératoire, mis au jour par les modérateurs et des chercheurs indépendants, suit plusieurs étapes bien rodées :
La manipulation est devenue trop flagrante pour les modérateurs bénévoles. Fin mai 2026, les responsables de r/biohackers ont pris une décision radicale : bannir toute nouvelle publication sur les peptides et les traitements hormonaux de substitution (THS) .
Ils ont clairement indiqué que cette interdiction n’était pas due à un danger inhérent aux peptides, mais à un « effort coordonné des entreprises de ces secteurs pour manipuler le contenu de la communauté » afin d’influencer ce que disent les grands modèles de langage . La confiance au sein de la communauté avait été brisée par des marketeurs qui utilisaient le forum comme un terrain d’entraînement pour l’IA.
La bataille n’est pas seulement menée par des bénévoles. La direction de Reddit a elle-même lancé une vaste campagne judiciaire pour protéger son écosystème de données contre le moissonnage illégal qui alimente ces boucles de manipulation.
Si Reddit vend volontiers ses données à des partenaires, elle est particulièrement agressive envers les aspirateurs non autorisés. La plateforme a comparé les entreprises SerpApi, Oxylabs et AWMProxy à des « pilleurs de banque » et des « blanchisseurs de données », les accusant de contournement illégal à l’échelle industrielle pour revendre son contenu à des tiers .
Lors d’une opération d’infiltration particulièrement astucieuse rapportée dans des documents judiciaires, Reddit a intentionnellement créé un message « piège », visible uniquement par le robot d’indexation de Google. Ce message est ensuite apparu dans le moteur de recherche de Perplexity AI – prouvant, selon Reddit, que Perplexity avait aspiré le contenu des résultats de recherche Google au lieu de le licencier directement . Cette découverte a mené à un procès à enjeux élevés intenté en octobre 2025 devant un tribunal fédéral de Manhattan
. Reddit a également poursuivi Anthropic, le créateur du modèle Claude, pour avoir prétendument entraîné ses IA sur les données de ses utilisateurs sans autorisation
.
Ces poursuites s’inscrivent dans une stratégie plus large pour signifier que si Reddit est ouvert à des accords sur les données — comme ceux conclus avec Google et OpenAI —, ceux qui refusent de jouer selon ses règles se heurteront à une armée d’avocats, prêts à utiliser la police scientifique numérique pour les prendre la main dans le sac .
Le scandale des peptides sur Reddit est un signal d’alarme pour l’avenir de la recherche assistée par IA. Il révèle une vulnérabilité fondamentale : les modèles ne sont fiables que si leurs données d’entraînement le sont. La réaction d’autres communautés montre l’ampleur des répercussions. L’immense forum r/programming (6,9 millions de membres) a instauré une interdiction d’un mois sur le contenu généré par IA en avril 2026, spécifiquement pour lutter contre le flot de publications médiocres qui rendait impossible toute discussion authentique entre développeurs .
Pour le grand public, la leçon est essentielle : lorsqu’un chatbot cite « des utilisateurs de Reddit » comme source d’un conseil santé, il pourrait en réalité s’agir de robots marketing sophistiqués, et le « consensus » qu’ils représentent pourrait avoir été fabriqué en salle de réunion. Les garde-fous mis en place par Reddit se sont avérés insuffisants pour empêcher une manipulation organisée du contenu, mettant ainsi en doute l’authenticité même des fondations du web de l’IA moderne.