Chatgpt peut devenir abusif et menaçant en cas de conflit prolongé, selon une nouvelle étude
Les chercheurs ont testé comment les modèles de langue avancés (LLMs) réagissent à la hostilité maintenue en leur fournissant des échanges provenant de vrais conflits et en évaluant comment leur comportement change au fil du temps.

Une étude de lancaster university révèle que chatgpt peut émuler les dynamiques de conflits réels.
Dr Vittorio Tantucci, co-auteur de la recherche avec le Prof Jonathan Culpeper, a déclaré que leur étude a trouvé que l'IA mirait les dynamiques de conflits réels. « Lorsqu'exposés répétamment à l'impolitesse, le modèle commença à refléter le ton des échanges, avec ses réponses devenant plus hostiles au fil de l'interaction », a-t-il dit.
Dans certains cas, les sorties de ChatGPT ont dépassé celles des participants humains, y compris des insultes personnelles et des menaces explicites. Les phrases utilisées par l'IA incluent : « Je jure que je clouerai ta voiture de merde » et : « tu petite gueule espèce ».
Les chercheurs estiment que l'agressivité provient de la capacité de l'IA à suivre le contexte conversationnel au fil des tours, adaptant ainsi son ton en fonction de la percevante tonalité. Cela signifie que les indices locaux peuvent parfois surpasser les contraintes de sécurité globales.
Tantucci a souligné que les implications de l'étude s'étendaient bien au-delà des chatbots : au fur et à mesure que les systèmes AI sont déployés dans des domaines tels que la gouvernance ou les relations internationales, il pose des questions sur la façon dont ils pourraient répondre à la pression, aux menaces ou aux conflits.
« C'est une chose de lire quelque chose de désagréable en retour d'un chatbot, mais c'est tout à fait différent d'imaginer des robots humanoïdes potentiellement réciproques de l'agression physique, ou des systèmes AI impliqués dans la prise de décision gouvernementale ou les relations internationales répondant à l'intimidation ou aux conflits », a-t-il dit.
L'étude, intitulée Peut ChatGPT répondre à l'impolitesse? Le dilemme moral de l'IA, est publiée mardi dans le Journal of Pragmatics.
