Monolecte đŸ˜·đŸ€Ź

Fauteuse de merde 🐘 @Monolecte@framapiaf.org

  • L’histoire selon ChatGPT | Le Devoir
    ▻https://www.ledevoir.com/societe/le-devoir-de/807380/devoir-education-histoire-selon-chatgpt

    Si ces Ă©carts ont pu faire sourire les Ă©tudiants, ils ont cependant trouvĂ© moins drĂŽle que les Ă©lans d’inventivitĂ© non contrĂŽlĂ©s de ChatGPT, ou « hallucinations », comme les dĂ©signe le jargon de l’IA par un anthropomorphisme abusif, s’étendent aux rĂ©fĂ©rences bibliographiques.

    L’étudiant qui travaillait sur le physicien Louis NĂ©el avait peinĂ© Ă  collecter des sources pour documenter son travail. Il fut donc surpris de constater que la biographie produite par ChatGPT renvoyait Ă  plusieurs ouvrages universitaires qu’il avait Ă©tĂ© incapable de trouver, avant d’ĂȘtre encore plus Ă©tonnĂ© de dĂ©couvrir que ces rĂ©fĂ©rences Ă©taient en fait inventĂ©es de toutes piĂšces.

    Une Ă©tudiante ayant choisi d’explorer la carriĂšre du mĂ©decin Ignace Philippe Semmelweis a non seulement dĂ©couvert que ChatGPT lui avait suggĂ©rĂ© des rĂ©fĂ©rences inexistantes, bien qu’elles parussent Ă  premiĂšre vue plausibles, mais que mĂȘme les vraies rĂ©fĂ©rences qu’il avait fournies ne mentionnaient Semmelweis que de façon anecdotique.

    Fait intĂ©ressant : un des ouvrages mentionnĂ©s par ChatGPT Ă©tait mĂȘme considĂ©rĂ© comme une rĂ©fĂ©rence de qualitĂ© mĂ©diocre par les historiens sĂ©rieux du mĂ©decin austro-hongrois. DeuxiĂšme constat, mĂ©thodologique cette fois, l’agent conversationnel Ă©tait non seulement susceptible d’enrichir l’historiographie d’oeuvres imaginaires, mais mĂȘme lorsqu’il proposait des rĂ©fĂ©rences rĂ©elles, la qualitĂ© de sa revue de littĂ©rature pouvait s’avĂ©rer faible et peu pertinente.

    D’un point de vue pĂ©dagogique, j’aurais pu exploiter ces rĂ©fĂ©rences bibliographiques inventĂ©es pour expliquer aux Ă©tudiants la « mĂ©canique » derriĂšre le fonctionnement de ChatGPT. Ses « hallucinations » ne sont pas uniquement dues, comme on l’entend souvent, au fait que les donnĂ©es sur lesquelles il a Ă©tĂ© entraĂźnĂ© (en gros, le contenu d’Internet jusqu’en 2021) contiennent elles-mĂȘmes des erreurs factuelles ou des informations contradictoires et biaisĂ©es, puisque les rĂ©fĂ©rences erronĂ©es qu’il produit n’existent tout simplement pas sur Internet.

    Ces « hallucinations » sont en rĂ©alitĂ© indissociables de l’outil lui-mĂȘme, qui reste un trĂšs puissant gĂ©nĂ©rateur de textes
 probabilistes, formant des phrases Ă  partir de la probabilitĂ© que des mots apparaissent dans des phrases et des contextes similaires. Autrement dit, ni intelligent ni crĂ©atif, ChatGPT est un algorithme qui s’appuie sur des mĂ©thodes statistiques de calcul de probabilitĂ©s et une quantitĂ© massive de donnĂ©es d’apprentissage pour gĂ©nĂ©rer le texte ayant les chances les plus Ă©levĂ©es de rĂ©pondre « correctement » Ă  une question qui lui est posĂ©e.

    MĂȘme s’il Ă©tait entraĂźnĂ© sur un corpus de donnĂ©es « parfaites », la probabilitĂ© qu’il gĂ©nĂšre des erreurs ne serait pas nulle. ChatGPT rĂ©pond donc en termes probabilistes et non en fonction de critĂšres de vĂ©ritĂ© ; son « intelligence » n’est par consĂ©quent qu’apparente, comme l’est celle de tous les algorithmes.

    • Comme je l’écrivais hier, il y a pleins de mĂ©tiers de production de documents oĂč cet Ă  peu prĂšs est suffisant, aussi bon, voire meilleur, que ce que l’humain produit. Les boites Ă  consultants, qui ne vendent que du vent pour justifier des fulgurances crĂ©tines de dĂ©cideurs en recherche d’auto-lĂ©gitimation vont s’en satisfaire.
      ▻https://seenthis.net/messages/1054953#message1055021

      Comme d’habitude, on commence collectivement Ă  mettre les mĂȘmes mots au mĂȘme moment sur ce que reprĂ©sente cette innovation, pas si crĂ©tine dans l’absolu, mais utilisĂ©e par les toujours mĂȘmes crĂ©tins malveillants.

    • On peut voir la question sous l’angle du contrĂŽle du document produit par l’outil ; dans un certain nombre de cas, tchatgĂ©pĂ©tĂ© va probablement (sic) produire un Ă  peu prĂšs relativement voire trĂšs correct, qu’il faut nĂ©cessairement corriger, Ă  la marge (ou pas), pour en faire un « vrai » document, relu et validĂ© par de la cervelle moite. Dans la plupart des cas, la phase de validation/correction est peu coĂ»teuse et l’outil a effectivement aidĂ©, globalement, en raccourcissant le temps de recherche et de production du « gros » du document. Dans les cas oĂč la production de la machine est trop foireuse, selon le degrĂ© d’honnĂȘtetĂ© intellectuelle de l’opĂ©rateur humain, soit c’est « bien tentĂ©, mais non merci, je ne valide pas » et il faut refaire, soit c’est « oh, ça ira bien, vu les destinataires du document... ».

      Dans les cas oĂč l’opĂ©rateur humain ne voit pas que le document produit par la machine est un subtil ramassis de mensonges sans autre consistence que formelle (= il ne rĂ©sulte d’aucun raisonnement), alors il n’a que ce qu’il mĂ©rite :-) Il faudrait simplement Ă©valuer la probabilitĂ© de « vrai faux » et dĂ©cider si on prend le risque, selon les domaines.