Skip to Main content Skip to Navigation
Conference papers

Romanciers et romancières du XIXème siècle : une étude automatique du genre sur le corpus GIRLS

Résumé : Cette étude porte sur les différences entre les romans français du XIXe siècle écrits par des hommes et ceux écrits par des femmes en trois étapes. Premièrement, nous observons que ces textes peuvent être distingués par apprentissage supervisé selon ce critère. Un modèle simple a un score de 99% d’exactitude sur cette tâche si d’autres œuvres de la même personne figurent dans le jeu d’entraînement, et de 72% d’exactitude sinon. Cette différence s’explique par le fait que le langage de l’individu est plus distinctif qu’un éventuel style propre au genre. Deuxièmement, notre étude textométrique met au jour des stéréotypes de genre chez les hommes et les femmes. Troisièmement, nous présentons un modèle de coréférence entraîné sur des textes littéraires pour étudier le genre des personnages. Nous montrons ainsi que les personnages féminins sont plus nombreux chez les femmes, et prennent généralement une place plus proéminente que chez les hommes.
Document type :
Conference papers
Complete list of metadata

https://hal.archives-ouvertes.fr/hal-03701468
Contributor : Yannick Parmentier Connect in order to contact the contributor
Submitted on : Friday, June 24, 2022 - 4:31:07 PM
Last modification on : Thursday, July 7, 2022 - 5:41:49 AM
Long-term archiving on: : Sunday, September 25, 2022 - 9:26:18 PM

File

2362.pdf
Publisher files allowed on an open archive

Identifiers

  • HAL Id : hal-03701468, version 1

Citation

Marco Naguib, Marine Delaborde, Blandine Andrault, Anaïs Bekolo, Olga Seminck. Romanciers et romancières du XIXème siècle : une étude automatique du genre sur le corpus GIRLS. Traitement Automatique des Langues Naturelles, 2022, Avignon, France. pp.66-77. ⟨hal-03701468⟩

Share

Metrics

Record views

34

Files downloads

0