Objectiver l'intertexte ? Emmanuel Macron, deep learning et statistique textuelle
- Creators
- Mayaffre, Damon
- Vanni, Laurent
- Others:
- BCL, équipe Logométrie : corpus, traitements, modèles ; Bases, Corpus, Langage (UMR 7320 - UCA / CNRS) (BCL) ; Université Nice Sophia Antipolis (1965 - 2019) (UNS) ; COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-Centre National de la Recherche Scientifique (CNRS)-Université Côte d'Azur (UCA)-Université Nice Sophia Antipolis (1965 - 2019) (UNS) ; COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-Centre National de la Recherche Scientifique (CNRS)-Université Côte d'Azur (UCA)
- Modèles et algorithmes pour l'intelligence artificielle (MAASAI) ; Inria Sophia Antipolis - Méditerranée (CRISAM) ; Institut National de Recherche en Informatique et en Automatique (Inria)-Institut National de Recherche en Informatique et en Automatique (Inria)-Université Nice Sophia Antipolis (1965 - 2019) (UNS) ; COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-Laboratoire Jean Alexandre Dieudonné (JAD) ; Université Nice Sophia Antipolis (1965 - 2019) (UNS) ; COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-Centre National de la Recherche Scientifique (CNRS)-Université Côte d'Azur (UCA)-Centre National de la Recherche Scientifique (CNRS)-Université Côte d'Azur (UCA)-Scalable and Pervasive softwARe and Knowledge Systems (Laboratoire I3S - SPARKS) ; Laboratoire d'Informatique, Signaux, et Systèmes de Sophia Antipolis (I3S) ; Université Nice Sophia Antipolis (1965 - 2019) (UNS) ; COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-Centre National de la Recherche Scientifique (CNRS)-Université Côte d'Azur (UCA)-Université Nice Sophia Antipolis (1965 - 2019) (UNS) ; COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-Centre National de la Recherche Scientifique (CNRS)-Université Côte d'Azur (UCA)-Laboratoire d'Informatique, Signaux, et Systèmes de Sophia Antipolis (I3S) ; Université Nice Sophia Antipolis (1965 - 2019) (UNS) ; COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-COMUE Université Côte d'Azur (2015-2019) (COMUE UCA)-Centre National de la Recherche Scientifique (CNRS)-Université Côte d'Azur (UCA)-Centre National de la Recherche Scientifique (CNRS)
Description
The present paper suggests that intertextuality can be brought out objectively by resorting to specific methodological tools. The case in point is political intertextuality in the speeches of the French president Emmanuel Macron. Deep learning (convolutional model) is first used to "learn" (satisfactory accuracy rate of 92.3%) the French presidential speeches since 1958: the speeches of De Gaulle, Pompidou, Giscard, Mitterrand, Chirac, Sarkozy and Hollande are then considered as the potential intertext of Macron's own speeches. Next, Macron's texts-hitherto unknown to the machine-are included in the model and the machine is instructed to assign Macron's quotations to one of his predecessors based on their linguistic content. Finally, the algorithm extracts and describes Macron's quotations and linguistic units (wTDS, lexical specificities, co-occurrences, morpho-syntactic labels) as they were interpreted by the machine in comparison to those of De Gaulle or Sarkozy, of Mitterrand or Holland. Macron's discourse is permeated with, sometimes explicitly but more often than not implicitly, by the discourse of former French presidents-a phenomenon that we shall refer to as "intertextuality"-and it turns out that Artificial Intelligence and textual statistics are able to identify such phenomena of borrowing, imitation and even plagiarism.
Abstract (French)
Cette contribution propose un parcours méthodologique susceptible d'objectiver l'intertexte ; l'intertexte politique des discours du président français Emmanuel Macron en l'occurrence.Le deep learning (modèle convolutionnel) est d'abord utilisé pour « apprendre » (taux d'accuracy satisfaisant de 92,3%) le discours présidentiel français depuis 1958 : les discours de de Gaulle, Pompidou, Giscard, Mitterrand, Chirac, Sarkozy et Hollande sont alors considérés comme l'intertexte potentiel des discours de Macron.Ensuite, les textes de Macron – inconnus jusqu'ici du système – sont versés dans le modèle et nous forçons la machine à attribuer les passages de Macron à l'un de ses prédécesseurs en fonction de leur composition linguistique. Enfin, l'algorithme extrait et décrit les passages et les unités linguistiques (wTDS, spécificités lexicales, cooccurrences, étiquettes morpho-syntaxiques) de Macron interprétées par la machine comme ressemblant à celles de de Gaulle ou Sarkozy, à celles de Mitterrand ou de Hollande.Le discours de Macron est traversé, de manière explicite parfois, de manière implicite le plus souvent, par les discours de ses prédécesseurs – phénomène que l'on appellera « intertextualité » – et l'Intelligence artificielle et la statistique textuelle peuvent repérer les phénomènes d'emprunt, d'imitation voire de plagiat.
Abstract
International audience
Additional details
- URL
- https://hal.archives-ouvertes.fr/hal-02894990
- URN
- urn:oai:HAL:hal-02894990v1
- Origin repository
- UNICA