What's in a grade? A mixed methods investigation of teacher assessment of grammatical ability in L2 academic writing
Bibliographic record
Abstract
Cette recherche s'intéresse à la façon d'évaluer les compétences grammaticales dans les cours universitaires d'écriture langue seconde (L2). Selon la littérature, les compétences grammaticales comprennent la syntaxe et la morphologie (Purpura, 2004; Weigle, 2002) de même que les formes lexicales, la cohésion et la gestion de l'information au niveau sous-phrastique, phrastique et supra-phrastique (Purpura, 2004). Par conséquent, les professeurs d'écriture devraient, lors de l'étude de textes en L2, miser sur la morphosyntaxe et sur d'autres aspects grammaticaux utiles à l'organisation de l'information et assurant la cohésion au niveau de la phrase, du paragraphe et du texte. En s'appuyant sur une approche méthodologique mixte (Creswell & Plano Clark, 2007), utilisant une triangulation de données qualitatives et quantitatives, cette recherche vise à déterminer quels sont les indicateurs de performance grammaticale sur lesquels s'appuient les professeurs d'écriture (n = 2) lorsqu'ils évaluent les compositions de leurs étudiants (n = 33). Les étudiants de l'échantillon étaient inscrits à une université canadienne anglophone et suivaient un cours d'anglais de niveau intermédiaire ou avancé. D'autre part, cette recherche a pour objectif de déterminer à quel point l'apprentissage des étudiants est influencé par les critères d'évaluation de leur professeur. Dans la première partie de la recherche, les compositions des étudiants et les notes de grammaire données par le professeur ont été collectées et analysées quantitativement, en utilisant des mesures de justesse et de complexité grammaticales comme indicateurs de la compétence morphosyntaxique. Elles ont également été analysées qualitativement dans un cadre linguistique systémique fonctionnel afin de déterminer la compétence des étudiants à gérer l'information dans leurs textes. Dans la seconde partie de la recherche, des questionnaires ont été administrés aux étudiants et certaines entrevues ont été menées afin d'évaluer la connaissance qu'avaient les étudiants des critères d'évaluation de leur professeur en ce qui a trait à la grammaire. Dans la troisième partie, les professeurs ont été interviewés au sujet de leurs critères et priorités dans l'évaluation de la grammaire. Enfin, les résultats des trois parties et des quatre sources d'informations ont été réunis afin d'en arriver à une interprétation globale des conclusions. Les résultats révèlent que les professeurs d'écriture priorisent surtout la justesse grammaticale lorsqu'ils évaluent les compétences grammaticales de leurs étudiants. Par conséquent, les professeurs d'écriture semblent s'appuyer sur une définition plus limitée de la compétence grammaticale dans l'évaluation des textes de leurs étudiants que ce qui est défini par la littérature à ce sujet, ce qui a nécessairement un effet sur la façon d'apprendre des étudiants qui suivent des cours d'écriture. Cette thèse se termine par une discussion qui met en lumière ce qu'impliquent ces résultats et où sont émises certaines recommandations au sujet de l'évaluation en écriture dans un cours de L2.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame distilled prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. Learned from the 10,348 direct Codex labels and 10,348 direct Gemma labels. Candidate is the union of thresholded teacher heads; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels or direct frontier model labels.
Codex and Gemma teacher scores by category
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.005 | 0.001 |
| Meta-epidemiology (narrow) | 0.000 | 0.000 |
| Meta-epidemiology (broad) | 0.001 | 0.000 |
| Bibliometrics | 0.000 | 0.000 |
| Science and technology studies | 0.000 | 0.001 |
| Scholarly communication | 0.000 | 0.002 |
| Open science | 0.000 | 0.000 |
| Research integrity | 0.000 | 0.001 |
| Insufficient payload (model declined to judge) | 0.001 | 0.000 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one teacher head, not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".