NOVLEX: Une Base de Données Lexicales pour les Elèves de Primaire | |
La base de données lexicales NOVLEX est un outil permettant d'estimer l'étendue et la fréquence lexicale du vocabulaire écrit adressé à des élèves francophones de l'enseignement primaire. Elle a été constituée grâce à l'analyse de livres scolaires et extra-scolaires destinés à des élèves de CE2 (8-9 ans). NOVLEX est construit à partir d'un corpus d'à peu près 417 000 mots, ne comprenant ni noms propres, ni prénoms, ni noms de ville, ni onomatopées et ramenés en minuscule ("Un", "UN" et "un" sont une même entrée). De ce corpus nous avons extraits 20 600 entrées orthographiquement différentes (base d'occurences) et 9300 racines lexicales (base lexicale) distinctes (déterminées à l'aide du dictionnaire Larousse© ). | |
|
http://www2.mshs.univ-poitiers.fr/novlex/index.htm
Vous pourrez accéder rapidement à cet outil bien utile par le lien permanent situé sur le côté du blog.