Aller au contenu principalAller à la recherche
Episciences
Revues en libre accès
Connexion(nouvelle fenêtre)
Data & Corpus. La revue des données en SHS logo
Data & Corpus. La revue des données en SHS
Data & Corpus. La revue des données en SHS logo
Data & Corpus. La revue des données en SHS
Connexion(nouvelle fenêtre)
Articles & volumes
Tous les articlesTous les volumesDernier volumeAuteurs/Autrices
À propos
La revueActualités
Comités
Publier
Pour les auteurs/autricesCharte éthique
Submit
Data & Corpus. La revue des données en SHS logo
Notice de la revue
|
Contact
|
Crédits
eISSN 3099-5299
|
RSS
|
Atom
Episciences
Documentation
|
Remerciements
|
Politique de publication
Accessibilité : non conforme
|
Mentions légales
|
Déclaration de confidentialité
|
Termes d'utilisation
  1. Accueil > Articles & volumes >
  2. Rubriques >
  3. Articles de méthodologie

Articles de méthodologie

rubrique
2 articles
2 articles
Article
Les manuels cités par les enseignant·es dans les enquêtes Elfe-école: Démarche de construction de variables dans le cadre d’un projet d’analyses secondaires de données
Sandra Fontanaud, Mélissa Arneton, Thomas Venet, Bertrand Geay
Résumé
Dans le cadre de l’étude longitudinale française depuis l’enfance (Elfe), des informations relatives aux outils à disposition des élèves ainsi que ceux à disposition des enseignant·es pour la préparation et la réalisation des cours en moyenne section de maternelle (en 2016) puis en cours préparatoire (en 2018) ont été collectées. Concernant les apprentissages liés au langage et à la lecture, 9148 précisions (manuels, sites internet, cahiers d’exercices, logiciels) ont été fournies dans des champs ouverts. L’apurement et le traitement des outils mobilisés par 2743 enseignant·es en moyenne section puis par 2675 enseignant·es en cours préparatoire (CP) ont été menés dans le cadre d’un projet de recherche sur les conditions de vie, la littératie et les apprentissages de la lecture en début d’école primaire. La méthodologie mise en œuvre est présentée. Comparativement à des travaux basés sur la seule déchiffrabilité des ressources pédagogiques, ces données inédites permettent d’accéder aux usages et pratiques enseignantes dans toutes leurs complexités. À terme, ces variables recodées et anonymisées seront incluses dans le catalogue des données de la cohorte Elfe.
Publié le 23 juillet 2026
PDF
Article
Corpus multilingues pour l'étude de nouveaux concepts en SHS : le cas de « l’innovation non technologique »
Revekka Kyriakoglou, Anna Pappa
Résumé
Cet article présente une méthodologie hybride pour la création d’un corpus multilingue des-tiné à faire émerger des termes associés à des concepts nouveaux en sciences humaines et so-ciales (SHS), en prenant pour cas d’étude « l’innovation non technologique ». Le corpus repose surdeux sources textuelles complémentaires : (1) des contenus extraits automatiquement des sitesweb d’entreprises, nettoyés pour le français et l’anglais, et (2) des rapports annuels collectés etfiltrés automatiquement selon des critères documentaires (année, format, duplication). Le pipelineintègre la détection automatique des langues, le filtrage des contenus non pertinents, l’extraction desegments pertinents et l’enrichissement en métadonnées structurelles.À partir de ce corpus initial, un dataset dérivé en anglais est construit pour des usages en appren-tissage automatique. Il regroupe, pour chaque occurrence d’un terme du lexique expert, un bloccontextuel de cinq phrases (deux précédant et deux suivant la phrase contenant le terme). Chaqueoccurrence est annotée avec la catégorie thématique associée au terme, permettant de structurerles données pour des tâches de l’apprentissage automatique.Cette approche produit une ressource reproductible, extensible et adaptée à l’analyse de la varia-bilité lexicale autour de concepts nouveaux, ainsi qu’à la création de jeux de données destinés auxapplications de traitement automatique des langues.
Publié le 23 juillet 2026
PDF