MétaCan
Menu
Back to cohort
Record W7161820551 · doi:10.82308/41677

Estimating vocabulary size with verbal fluency scores

2021· dissertation· en· W7161820551 on OpenAlexaboutno aff
Daphnée Dubé

Bibliographic record

Venuenot available
Typedissertation
Languageen
FieldPsychology
TopicLanguage Development and Disorders
Canadian institutionsnot available
Fundersnot available
KeywordsFluencyVerbal fluency testVocabularyAcacia mearnsii

Abstract

fetched live from OpenAlex

Les orthophonistes travaillent souvent avec des clients chez qui l’une ou plusieurs de leurs langues ne peuvent être évaluées pour de différentes raisons. Nous avons proposé l’usage d’une tâche expérimentale bien établie, la tâche de fluence verbale, à utiliser lorsque l’utilisation d’un outil normalisé n’est pas possible. À travers d’une série d’analyses, 193 enfants et adolescents unilingues et multilingues ont été évalués avec des évaluations de vocabulaire et de fluence verbale. Les participants étaient exposés à de différentes combinaisons de langues et ont été testés au Canada (anglais, français) et en Islande (islandais, anglais, autres langues). D’abord, des mesures de fluence verbale ont été évaluées en tant que prédicteurs de taille de vocabulaire dans des langues pour lesquelles la taille de vocabulaire pouvait être mesurée directement (n = 193). Les prédicteurs ont inclus des mesures bien établies (nombre de mots corrects, taille moyenne de cluster, nombre de cluster switches) et une nouvelle mesure modifiée de nombre de mots corrects sur deux tâches de fluence verbale (sémantique et phonémique). En utilisant des régressions linéaires simples sur les données des participants qui ont complété les tâches de fluence verbale ainsi que les évaluations de vocabulaire, les deux mesures de mots corrects (traditionnelle et modifiée) étaient les meilleurs prédicteurs de scores de vocabulaire. De manière innovante, nous avons ensuite étendu nos analyses à des langues pour lesquelles la taille de vocabulaire ne pouvait être mesurée (n = 36). Dans ces langues, des auto-évaluations de la performance ont été utilisée au lieu d’évaluations de vocabulaire. Encore une fois, la fluence verbale a prédit la performance. En plus d’évaluer la valeur de mesures traditionnelles, nous avons étudié les réponses de nouvelles manières, incluant l’usage de mots non-fréquents et de traductions et la performance longitudinale, ainsi que l’implication de ces mesures pour les connaissances de vocabulaire. Cette thèse supporte l’usage des tâches de fluence verbale comme outil rapide et simple à utiliser comme estimation de connaissances de vocabulaire

Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.

How this classification was reachedexpand

Full frame machine prediction

Teacher imitation

Not calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.

metaresearch head score (Codex)0.002
metaresearch head score (Gemma)0.019
Version: metacan-v3-hybrid-931329e0061cValidation status: machine_predicted_unvalidated
Candidate categoriesnone
Consensus categoriesnone
DomainCandidate signal: none · Consensus signal: none
Study designCandidate signal: Bench or experimental · Consensus signal: none
GenreCandidate signal: Empirical · Consensus signal: Empirical
Teacher disagreement score0.018
Threshold uncertainty score0.036

Distilled classifier scores by category (both heads)

CategoryCodexGemma
Metaresearch0.0020.019
Meta-epidemiology (narrow)0.0010.000
Meta-epidemiology (broad)0.0000.001
Bibliometrics0.0030.001
Science and technology studies0.0000.001
Scholarly communication0.0020.001
Open science0.0010.001
Research integrity0.0010.000
Insufficient payload (model declined to judge)0.0040.001

Machine scores (provisional)

The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.

Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.

Opus teacher head0.007
GPT teacher head0.286
Teacher spread0.278 · how far apart the two teachers sit on this one work
Validation statusscore_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from it

Classification

machine, unvalidated

Machine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.

The models applied no category: nothing in the taxonomy fit this work.
Study designBench or experimental
Domainnot available
GenreEmpirical

How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".

Quick stats

Citations0
Published2021
Admission routes1
Has abstractyes

Explore more

Same topicLanguage Development and DisordersFrench-language works237,207