Dans le cadre de la politique de la science ouverte menée au CNRS et de façon à contribuer à la transparence et l'éthique de nos recherches ainsi qu'à favoriser la réutilisation des données, les chercheur·ses du laboratoire ont réalisé différents corpus qui sont librement accessibles dans des entrepôts de données.
- Voir l'ensemble des corpus déposés sur Ortolang
- Voir l'ensemble des corpus déposés sur Cocoon
Quelques exemples :
- Ressource Sign Languages resources du consortium européen CLARIN composée de 51 corpus et 24 lexiques en langues des signes : https://www.clarin.eu/resource-families/sign-language-resources
- Corpus CREAGEST - dépôt sur ORTOLANG 1 | 2 lié au projet CREAGEST
- Corpus VILLA (dépôt intégral sur ORTOLANG accessible sur demande) - lié au projet VILLA
- Ressources disponibles en langues des signes sur COllections de COrpus ORaux Numériques (COCOON)
- Corpus PLPNat : base de données formée de corpora de jeunes enfants (entre 1 et 4 ans) enregistrés en vidéo, en situation de production naturelle et en interaction avec leur entourage (Dominique Bassano, avec I. Maillochon, M. Lavielle & S. Yaiche).
- Corpus du projet Langues et Grammaires en (Ile-De-)France (COCOON)
- Corpus de thèse d'Emmanuella Martinod (Ortolang)
- Corpus de thèse de Simona Anastasio (Ortolang)
- Corpus Pauline, I. Maillochon & D. Bassano (Childes)
- Corpus ESF, C. Perdue & W.Klein (Talkbank)
- Corpus PhonBank Berbère, M. Lahrouchi (Talkbank)
French