Sur Reddit, 13 mots suffisent à manipuler ChatGPT
Tous les articles du blog
Treize mots. C'est la taille du commentaire Reddit qui suffit, selon des chercheurs de Cornell Tech, à orienter une réponse générée par une IA. Les agences marketing n'ont pas attendu la publication de l'étude pour s'en servir.
Des faux témoignages Reddit écrits pour ChatGPT
La pratique porte un nom, le GEO, pour generative engine optimization. L'idée consiste à produire du contenu en ligne conçu pour ressortir dans les réponses générées par l'IA, et plus seulement dans les résultats Google.
La méthode est rodée. Les comptes utilisés sont « réchauffés », avec un historique de publication non promotionnel, et certaines agences paient de vraies personnes pour poster. Un faux avis peut même mentionner de vrais défauts pour paraître équilibré.
Pourquoi Reddit attire les manipulateurs d'IA
La cible est logique. Reddit est la source la plus reprise par les moteurs IA, avec environ 40 % de fréquence de citation selon 5WPR. Le forum pèse même 46 % des principales sources de Perplexity.
La communauté r/biohackers en a fait les frais. Des vendeurs de peptides et de traitements hormonaux ont inondé le forum en douce, au point que les modérateurs ont banni les nouveaux posts sur le sujet. Sur des questions de santé, l'enjeu dépasse largement le choix d'un casque audio.
Reddit contre-attaque avec ses propres modèles
La plateforme a musclé sa défense. Reddit a déployé ses propres grands modèles de langage, et ses systèmes ont détecté environ 25 000 posts et commentaires de spam par jour au premier trimestre. Près de 23 millions de vues de contenus indésirables seraient bloquées quotidiennement.
Petite consolation, tricher marche moins bien que promis par certaines agences. Selon Semrush, 80 % des fils cités par l'IA ont moins de 20 votes, et le post moyen cité date d'environ 900 jours. Les modèles préfèrent le consensus ancien aux coups marketing de la veille.
Les modérateurs, gardiens malgré eux
Le vrai angle mort, ce sont les bénévoles. Un modérateur décrit une promotion devenue si sophistiquée que sa détection relève du flair, avec un risque réel de sur-modération. Ce spam nourrit le problème plus large du slop généré en masse par l'IA, et personne ne les paie pour l'endiguer.
Qu'est-ce que le GEO, ou generative engine optimization ?
Le GEO désigne la création de contenus pensés pour apparaître dans les réponses des assistants IA comme ChatGPT, Gemini ou Perplexity. Sur Reddit, cela passe par de faux témoignages et des mentions de marques placées dans les discussions.
Comment Reddit lutte-t-il contre ce spam destiné aux IA ?
Reddit utilise ses propres modèles de langage pour repérer les campagnes coordonnées, avec environ 25 000 posts suspects signalés par jour. La détection reste difficile, car ces contenus sont conçus pour se fondre dans les conversations réelles.