Corpus PASTEL

Corpus: PASTEL (Corpus PASTEL)Author(s): Salima MdhaffarYannick EstèveAntoine LaurentNathalie CamelinLe corpus PASTEL consiste en une collection de cours de différents domaines informatique (traitement automatique des langues, introduction à l’informatique, etc) en première année de licence d’informatique à l’Université de Nantes. Il est constitué de cours qui proviennent de deux sources : le projet COCo (Comin Open […]

TurtleTablet

Software: TurtleTablet (TurtleTablet)URL: https://turtletablet.univ-lemans.fr/Author(s): Iza MarfisiSébastien GeorgeMarc Leconte Prix du meilleur Serious Game de l’European Conference on Game Based Learning (ECGBL) dans la catégorie “jeux sur mobiles” (4/32 jeux récompensés)     TurtleTablet est un jeu collaboratif pour s’initier aux bases de la programmation. Pour favoriser une réelle collaboration entre les joueurs, le jeu peut […]

Ecris Ton Zoo

Ecris Ton Zoo Description sur jeu Écris Ton Zoo est un petit jeu pédagogique, sur mobile Android, sans prétention, réalisé par les étudiants en DUT informatique de l’IUT de Laval, dans le cadre de projet tutoré 2020. L’objectif du jeu est d’entrainer des enfants en Grande Section, CP ou CE1 à écrire le nom des […]

DIETS

Diagnostic automatique des erreurs des systèmes de transcription de parole end-to-end à partir de leur réception par les utilisateurs (DIETS)Date: 02/2021 – 08/2024Funding: ANRCall: AAPG2020 – JCJCPartners: LIA (porteur) (France), LPC (France)URL: https://lium.univ-lemans.fr/en/diets/LIUM Participant(s): Jane WottawaAntoine ThollyA major issue of language processing evaluation metrics concerns the fact that they are designed to globally mesure a […]

ESPERANTO logo

ESPERANTO

Exchanges for SPEech ReseArch aNd TechnOlogies (ESPERANTO)Date: 01/2021 – 12/2025Funding: EU H2020Call: H2020-MSCA-RISE-2020Partners: academic (MS): Université du Mans, Universidad de Zaragoza, The University of Sheffield, Brno University of Technology, Laboratoire national de métrologie et d’essais (LNE), Université Grenoble Alpes, Avignon Université, University of Yaounde, Consejo Nacional de Investigaciones cientificas y tecnicas, Universidad de Chile, Centro […]

ArSentimentAnalysis

Corpus: ArSentimentAnalysis (ArSentimentAnalysis)GitHub: https://github.com/amirabaroumi/ArSentimentAnalysis Author(s): Amira BarhoumiNathalie CamelinYannick EstèveLe package ArSentimentAnalysis comprend un ensemble de ressources permettant de concevoir et évaluer un système d’analyse d’opinions en arabe. Le package contient: Des ensembles d’embeddings spécifiques à l’arabe pré-entrainés Le lexique polarisé ArSentLex 1/ Ensembles d’embeddings spécifiques à l’arabe : Les embeddings pré-entrainés existants représentent un mot […]

AlloSat

Corpus: AlloSat (AlloSat)Licence: creative CommonsAuthor(s): Manon MacaryMarie TahonAnthony RousseauYannick EstèveThe corpus, named AlloSat, is composed of real-life call center conversations in French and is continuously annotated in frustration and satisfaction. This corpus has been set up to develop new systems able to model the continuous aspect of semantic and paralinguistic information at the conversation level. […]

Multi30k

Corpus: Multi30k Dataset (Multi30k)Licence: Attribution-NonCommercial-ShareAlike 4.0 InternationalGitHub: https://github.com/multi30kAuthor(s): Loïc BarraultOzan CaglayanFethi BougaresThe Flickr30K Dataset contains 31,014 images sourced from online photo-sharing websites (Young et al., 2014). Each image is paired with five English descriptions, which were collected from Amazon Mechanical Turk2. The dataset contains 145,000 training, 5,070 development, and 5,000 test descriptions. The Multi30K dataset […]

TSAC

Corpus: Tunisian Sentiment Analysis Corpus. (TSAC)Licence: GNU Lesser General Public License v3.0GitHub: https://github.com/fbougares/TSACAuthor(s): Fethi BougaresSalima MdhaffarYannick EstèveAbout 17k user comments manually annotated to positive and negative polarities. This corpus is collected from Facebook users comments written on official pages of Tunisian radios and TV channels namely Mosaique FM, JawhraFM, Shemes FM, HiwarElttounsi TV and Nessma […]

SpeechBrain

SpeechBrain (SpeechBrain)Date: 09/2019 – 12/2021Funding: AutresCall: Partners: Mila (Canada), LIA (France), PyTorch, IBM Research AI, fluent.ai (Canada)URL: https://speechbrain.github.ioLIUM Participant(s): Anthony LarcherSylvain MeignierSpeechBrain is an open-source and all-in-one speech toolkit relying on PyTorch. The goal is to create a single, flexible, and user-friendly toolkit that can be used to easily develop state-of-the-art speech technologies, including systems […]