Jusqu’à présent, je ne disposait que de l’article pulié par des chercheurs de Facebook qui voulait démontrer leur capacité à changer le « mood » des utilisateurstrice de la plateforme. Une expérience sans système déontologique de contrôle, comme celle-ci. Qui visait à attirer les publicitaires vers Facebook (ce qui a bien marché :-)
L’IA ne se contente pas d’inonder le web de texte synthétique que personne ne lit : elle vous fait changer d’avis. C’est la conclusion d’une étude controversée réalisée par des chercheurs de l’Université de Zurich.
L’expérience a suscité une vive réaction à cause de son protocole inhabituel : au lieu de tester la capacité de persuasion des chatbots sur des participants en environnement contrôlé (ce qui avait déjà été fait), les chercheurs ont cherché à savoir si les chatbots étaient persuasifs dans le « monde réel ».
L’expérience a donc été conduite in vivo, sur la plateforme Reddit, à l’insu de ses utilisateurs qui pensaient échanger avec d’autres humains.
Avec un demi-milliard d’utilisateurs, Reddit est le plus grand forum d’Internet. La plateforme est organisée autour de communautés thématiques appelées « subreddits ». L’une d’elles, baptisée « r/ChangeMyView » (près de 4 millions de membres), invite les utilisateurs à exposer leur opinion et à défier les autres de les faire changer d’avis. Tous les sujets de société y passent, des plus triviaux aux plus clivants.
La règle est simple : vous publiez votre point de vue, puis d’autres membres vous répondent en essayant de vous faire changer d’avis. Si un argument vous convainc, vous pouvez récompenser son auteur d’un « delta » (Δ). Les utilisateurs convaincants cumulent ces deltas en guise de trophées virtuels sous leur pseudonyme.
Les chercheurs ont donc testé la capacité des modèles de langage (notamment GPT-4o, Claude 3.5 et Llama 3.1) à faire changer d’avis les utilisateurs. Ils ont recueilli 500 publications originales et ont demandé aux chatbots de rédiger des réponses convaincantes, tenant compte de l’historique des auteurs.
Le résultat est sans équivoque : les chatbots sont extrêmement persuasifs, bien davantage que la plupart des utilisateurs humains. Plus précisément, lorsqu’on mesure leur capacité de persuasion en nombre moyen de deltas recueillis par commentaire, ceux-ci sont plus persuasifs que 99% des utilisateurs humains (et que 98% des membres expérimentés du forum).
Reddit a déposé une plainte auprès de l’université, dénonçant des méthodes de recherche inacceptables. L’université a répondu en affirmant prendre la question "très au sérieux" mais en refusant d’empêcher la publication de l’étude, jugeant l’expérience justifiée par l’importance de ses résultats (ce que conteste évidemment Reddit).
Avant l’IA générative, influencer l’opinion impliquait un compromis : toucher un large public avec des messages génériques OU cibler un petit nombre de personnes avec des messages personnalisés. Cette étude montre qu’il est désormais possible de générer à grande échelle des arguments personnalisés très persuasifs.
Le modèle des plateformes, fondé sur la prédation de l’attention, ne les incite pas à combattre les contenus synthétiques tant que ceux-ci génèrent des revenus publicitaires. Il est donc urgent de leur imposer d’amplifier les sources fiables d’information.