Bibliographic record
Abstract
Au cours de la dernière décennie, plusieurs études ont montré que le traitement des mots est influencé par leurs caractéristiques orthographiques, lexicales et sémantiques. Les valeurs élevées des variables sémantiques, telles que la familiarité conceptuelle, l’imageabilité, la concrétude et l’expérience sensorielle, sont généralement associées à un traitement plus rapide et plus précis des mots lors d’une tâche de décision lexicale sur présentation écrite. Cependant, les normes relatives à l’une des variables sémantiques cruciales, comme la familiarité conceptuelle, et à une autre nouvelle variable, celle de la force perceptuelle d’une modalité spécifique, ne sont pas disponibles pour une large base de données francophones. Cette thèse présente des normes de familiarité conceptuelle, de force perceptuelle visuelle et auditive pour 3 596 mots en français. Ces normes ont été collectées auprès de 313 participants franco-canadiens, âgés entre 18 et 35 ans. Des statistiques descriptives et des analyses corrélationnelles ont été conduites sur ces normes et sur d’autres variables subjectives déjà publiées (âge d’acquisition, imageabilité, concrétude) et objectives (nombre de lettres, fréquence objective). Les analyses de corrélation ont révélé la nature sémantique de nos variables. Plus spécifiquement, les estimations de la force perceptuelle visuelle et auditive ont montré une relation forte avec les variables sémantiques, d’où l’importance du rôle de l’expérience perceptuelle dans la représentation conceptuelle des mots. Nous avons ensuite démontré l'utilité de ces nouvelles normes, de familiarité conceptuelle et de force perceptuelle, en évaluant leur contribution aux temps de réponse dans une tâche de décision lexicale. En utilisant des analyses de régression par étapes, nous avons démontré l’apport indépendant de la familiarité conceptuelle et de la force perceptuelle au-delà d’autres variables psycholinguistiques bien connues, telles que la longueur des mots, la fréquence, l’imageabilité, l’âge d’acquisition et la concrétude. Nos résultats procurent des données probantes en français sur la connaissance des caractéristiques psycholinguistiques et leurs impacts dans le traitement des mots. Les banques de données développées dans ces études constituent un apport significatif sur les études futures qui éclaireront davantage l'interaction entre les systèmes linguistique, sémantique et perceptuel. Ces études aideront les chercheurs à sélectionner des stimuli en français avec des caractéristiques psycholinguistiques spécifiques pour des expériences dans lesquelles la familiarité conceptuelle et la force perceptuelle doivent être prises en compte. Ces normes auront également un large domaine d’utilisation, comme la recherche sur les sciences humaines de la santé et la création de matériel didactique et des tests d’évaluation du langage.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.004 | 0.020 |
| Meta-epidemiology (narrow) | 0.000 | 0.000 |
| Meta-epidemiology (broad) | 0.000 | 0.001 |
| Bibliometrics | 0.001 | 0.001 |
| Science and technology studies | 0.001 | 0.001 |
| Scholarly communication | 0.002 | 0.001 |
| Open science | 0.000 | 0.001 |
| Research integrity | 0.000 | 0.000 |
| Insufficient payload (model declined to judge) | 0.006 | 0.001 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".