Lénition et fortition des occlusives en coda finale dans deux langues romanes : le français et le roumain

Lénition et fortition des occlusives en coda finale dans deux langues romanes : le français et le roumain
Mathilde Hutin, Adèle Jatteau, Ioana Vasilescu, Lori Lamel and Martine Adda-Decker
L’exploration automatisée de grands corpus permet d’analyser plus finement la relation entre motifs de variation phonétique synchronique et changements diachroniques durables : les erreurs dans les transcriptions automatiques sont riches d’enseignements sur la variation contextuelle en parole continue et sur les possibles mutations systémiques sur le point d’apparaître. Dès lors, il est intéressant de se pencher sur des phénomènes phonologiques largement attestés dans les langues en diachronie comme en synchronie pour établir leur émergence ou non dans des langues qui n’y sont pas encore sujettes. La présente étude propose donc d’utiliser l’alignement forcé avec variantes de prononciation pour observer les alternances de voisement en coda dans deux langues romanes : le français et le roumain. Il sera mis en évidence, notamment, que voisement et dévoisement non-canoniques des codas françaises comme roumaines ne sont pas le fruit du hasard mais bien des instances de dévoisement final et d’assimilation régressive de trait laryngal, qu’il s’agisse de voisement ou de non-voisement.

Génération automatique de définitions pour le français

Génération automatique de définitions pour le français
Timothee Mickus, Mathieu Constant and Denis Paperno
La génération de définitions est une tâche récente qui vise à produire des définitions lexicographiques à partir de plongements lexicaux. Nous remarquons deux lacunes : (i) l’état de l’art actuel ne s’est penché que sur l’anglais et le chinois, et (ii) l’usabilité escomptée en tant que méthode d’évaluation des plongements lexicaux doit encore être vérifiée. Pour y remédier, nous proposons un jeu de données pour la génération de définitions en français, ainsi qu’une évaluation des performances d’un modèle de génération de définition simple selon les plongements lexicaux fournis en entrée.

Analyse de sentiments des vidéos en dialecte algérien



Analyse de sentiments des vidéos en dialecte algérien
Mohamed Amine Menacer, Karima Abidi, Nouha Othman and Kamel Smaïli
La plupart des travaux existant sur l’analyse de sentiments traitent uniquement l’arabe standard moderne, et ne prennent pas en compte les dialectes. Cet article présente un système d’analyse de sentiments des vidéos en dialecte algérien.
Dans ce travail, nous avons deux défis à surmonter, la reconnaissance automatique de la parole pour le dialecte algérien et l’analyse de sentiments du texte reconnu. Le développement du système de reconnaissance automatique de la parole est basé sur un corpus oral restreint. Ce système est amélioré en tirant profit de données acoustiques ayant un impact sur le dialecte algérien, à savoir le l’arabe standard et le français. L’analyse de sentiments est basée sur la détection automatique de la polarité des mots en fonction de leur proximité sémantique avec d’autres mots ayant une polarité prédéterminée.