paper-with-me

홈 › Papers

Romanciers et romancières du XIXème siècle : une étude automatique du genre sur le corpus GIRLS (Male and female novelists : an automatic study of gender of authors and their characters )

2022-06-01 · JEP/TALN/RECITAL 2022 6 · Marco Naguib, Marine Delaborde, Blandine Andrault, Anaïs Bekolo, Olga Seminck

Cette étude porte sur les différences entre les romans français du XIXe siècle écrits par des hommes et ceux écrits par des femmes en trois étapes. Premièrement, nous observons que ces textes peuvent être distingués par apprentissage supervisé selon ce critère. Un modèle simple a un score de 99% d’exactitude sur cette tâche si d’autres œuvres de la même personne figurent dans le jeu d’entraînement, et de 72% d’exactitude sinon. Cette différence s’explique par le fait que le langage de l’individu est plus distinctif qu’un éventuel style propre au genre. Deuxièmement, notre étude textométrique met au jour des stéréotypes de genre chez les hommes et les femmes. Troisièmement, nous présentons un modèle de coréférence entraîné sur des textes littéraires pour étudier le genre des personnages. Nous montrons ainsi que les personnages féminins sont plus nombreux chez les femmes, et prennent généralement une place plus proéminente que chez les hommes.

📄 PDF Abstract BibTeX

Code (0)

등록된 구현이 없습니다.

Similar Papers 제목 키워드 기반

Biais de genre dans un système de traduction automatiqueneuronale : une étude préliminaire (Gender Bias in Neural Translation : a preliminary study )

2021-06-01 · JEP/TALN/RECITAL 2021 6 · Guillaume Wisniewski, Lichao Zhou, Nicolas Ballier, François Yvon

Cet article présente les premiers résultats d’une étude en cours sur les biais de genre dans les corpus d’entraînements et dans les systèmes de traduction neuronale. Nous étudions en particulier un corpus minimal et cont…

Caract\'eriser les discours acad\'emiques et de vulgarisation : quelles propri\'et\'es ?

2015-06-01 · JEPTALNRECITAL 2015 6 · Amalia Todirascu, Beatriz Sanchez Cardenas

L{'}article pr{\'e}sente une {\'e}tude des propri{\'e}t{\'e}s linguistiques (lexicales, morpho-syntaxiques, syntaxiques) permettant la classification automatique de documents selon leur genre (articles scientifiques et a…

ArticlesGeneral Classification

FENEC : un corpus équilibré pour l’évaluation des entités nommées en français (FENEC : a balanced sample corpus for French named entity recognition )

2022-06-01 · JEP/TALN/RECITAL 2022 6 · Alice Millour, Yoann Dupont, Alexane Jouglar, Karën Fort

Nous présentons ici FENEC (FrEnch Named-entity Evaluation Corpus), un corpus à échantillons équilibrés contenant six genres, annoté en entités nommées selon le schéma fin Quæro. Les caractéristiques de ce corpus nous per…

named-entity-recognitionNamed Entity RecognitionNamed Entity Recognition (NER)

French CrowS-Pairs: Extension à une langue autre que l’anglais d’un corpus de mesure des biais sociétaux dans les modèles de langue masqués (French CrowS-Pairs : Extending a challenge dataset for measuring social bias in masked language models to a language other than English)

2022-06-01 · JEP/TALN/RECITAL 2022 6 · Aurélie Névéol, Yoann Dupont, Julien Bezançon, Karën Fort

Afin de permettre l’étude des biais en traitement automatique de la langue au delà de l’anglais américain, nous enrichissons le corpus américain CrowS-pairs de 1 677 paires de phrases en français représentant des stéréot…

Expressions polylexicales verbales : \'etude de la variabilit\'e en corpus (Verbal MWEs : a corpus-based study of variability)

2017-06-01 · JEPTALNRECITAL 2017 6 · Caroline Pasquer

La reconnaissance et le traitement appropri{\'e} des expressions polylexicales (EP) constituent un enjeu pour diff{\'e}rentes applications en traitement automatique des langues. Ces expressions sont susceptibles d{'}appa…