Lâhistoire selon ChatGPT | Le Devoir
â»https://www.ledevoir.com/societe/le-devoir-de/807380/devoir-education-histoire-selon-chatgpt
Si ces Ă©carts ont pu faire sourire les Ă©tudiants, ils ont cependant trouvĂ© moins drĂŽle que les Ă©lans dâinventivitĂ© non contrĂŽlĂ©s de ChatGPT, ou « hallucinations », comme les dĂ©signe le jargon de lâIA par un anthropomorphisme abusif, sâĂ©tendent aux rĂ©fĂ©rences bibliographiques.
LâĂ©tudiant qui travaillait sur le physicien Louis NĂ©el avait peinĂ© Ă collecter des sources pour documenter son travail. Il fut donc surpris de constater que la biographie produite par ChatGPT renvoyait Ă plusieurs ouvrages universitaires quâil avait Ă©tĂ© incapable de trouver, avant dâĂȘtre encore plus Ă©tonnĂ© de dĂ©couvrir que ces rĂ©fĂ©rences Ă©taient en fait inventĂ©es de toutes piĂšces.
Une Ă©tudiante ayant choisi dâexplorer la carriĂšre du mĂ©decin Ignace Philippe Semmelweis a non seulement dĂ©couvert que ChatGPT lui avait suggĂ©rĂ© des rĂ©fĂ©rences inexistantes, bien quâelles parussent Ă premiĂšre vue plausibles, mais que mĂȘme les vraies rĂ©fĂ©rences quâil avait fournies ne mentionnaient Semmelweis que de façon anecdotique.
Fait intĂ©ressant : un des ouvrages mentionnĂ©s par ChatGPT Ă©tait mĂȘme considĂ©rĂ© comme une rĂ©fĂ©rence de qualitĂ© mĂ©diocre par les historiens sĂ©rieux du mĂ©decin austro-hongrois. DeuxiĂšme constat, mĂ©thodologique cette fois, lâagent conversationnel Ă©tait non seulement susceptible dâenrichir lâhistoriographie dâoeuvres imaginaires, mais mĂȘme lorsquâil proposait des rĂ©fĂ©rences rĂ©elles, la qualitĂ© de sa revue de littĂ©rature pouvait sâavĂ©rer faible et peu pertinente.
Dâun point de vue pĂ©dagogique, jâaurais pu exploiter ces rĂ©fĂ©rences bibliographiques inventĂ©es pour expliquer aux Ă©tudiants la « mĂ©canique » derriĂšre le fonctionnement de ChatGPT. Ses « hallucinations » ne sont pas uniquement dues, comme on lâentend souvent, au fait que les donnĂ©es sur lesquelles il a Ă©tĂ© entraĂźnĂ© (en gros, le contenu dâInternet jusquâen 2021) contiennent elles-mĂȘmes des erreurs factuelles ou des informations contradictoires et biaisĂ©es, puisque les rĂ©fĂ©rences erronĂ©es quâil produit nâexistent tout simplement pas sur Internet.
Ces « hallucinations » sont en rĂ©alitĂ© indissociables de lâoutil lui-mĂȘme, qui reste un trĂšs puissant gĂ©nĂ©rateur de textes⊠probabilistes, formant des phrases Ă partir de la probabilitĂ© que des mots apparaissent dans des phrases et des contextes similaires. Autrement dit, ni intelligent ni crĂ©atif, ChatGPT est un algorithme qui sâappuie sur des mĂ©thodes statistiques de calcul de probabilitĂ©s et une quantitĂ© massive de donnĂ©es dâapprentissage pour gĂ©nĂ©rer le texte ayant les chances les plus Ă©levĂ©es de rĂ©pondre « correctement » Ă une question qui lui est posĂ©e.
MĂȘme sâil Ă©tait entraĂźnĂ© sur un corpus de donnĂ©es « parfaites », la probabilitĂ© quâil gĂ©nĂšre des erreurs ne serait pas nulle. ChatGPT rĂ©pond donc en termes probabilistes et non en fonction de critĂšres de vĂ©ritĂ© ; son « intelligence » nâest par consĂ©quent quâapparente, comme lâest celle de tous les algorithmes.

