An Analysis of Large-Scale Writing Assessments in Canada (Grades 5-8)
Notice bibliographique
Résumé
This paper reports on an analysis of large-scale assessments of Grades 5-8 students’ writing across 10 provinces and 2 territories in Canada. Theory, classroom practice, and the contributions and constraints of large-scale writing assessment are brought together with a focus on Grades 5-8 writing in order to provide both a broad view of Canada-wide assessments and specific recommendations for enhancing the validity of provincial and territorial writing assessment in Canada. We deductively analyzed the primary assessment administration documents found on the provincial and territorial education websites using the categories of (a) design (e.g., grades at which the tests are written, the goals of the tests, the number and types of written compositions that are gathered, (b) administration (e.g., time of year, length of time provided to students to write, and pre-writing activities), and (c) the scoring of the assessments. We also used tenets of effective writing assessment from a process writing approach and from a multiliteracies approach to analyze the assessment procedures. Our analysis shows that process writing approaches have influenced the administration procedures in terms of the provision of time to talk with peers before writing and the recognition of various composition and thinking processes. However, composing processes are directed to be less idiosyncratic and recursive than composition theorists and noted teachers of writing would recommend. The assessments do not yet reflect an awareness of multiliteracies theory, as there is little use of digital technology to write and portfolio assessments and the collaborative writing of Web 2.0 practices are non-existent. Cet article fait état d’une analyse d’évaluations à grande échelle de rédactions d’élèves de la 5e à la 8e année dans 10 provinces et 2 territoires au Canada. Se penchant sur les rédactions écrites par des élèves de la 5e à la 8e année, nous réunissons la théorie, la pratique en salle de classe et les avantages et les contraintes liés aux évaluations à grande échelle pour élaborer un aperçu général des évaluations pancanadiennes et des recommandations spécifiques visant l’augmentation de la validité des évaluations de l’écriture dans les provinces et les territoires du Canada. Nous avons analysé par déduction les documents administratifs de l’évaluation principale tirés des sites Web d’éducation des provinces et des territoires. Notre analyse reposait sur les trois catégories suivantes : (a) conception (p. ex. niveau scolaire auquel on écrit les examens, objectifs des examens, nombre et type de rédactions exigées), (b) administration (p.ex. période de l’année, temps de rédaction accordée aux élèves, activités de pré-écriture et (c) évaluation des examens. Nous nous sommes également appuyés sur les principes de l’évaluation efficace des rédactions selon une approche processus et une approche axée sur la multilittératie pour analyser les procédures d’évaluation. Notre analyse démontre que les approches processus à l’écriture ont influencé les procédures administratives quant au temps accordé à la discussion avec les pairs avant l’écriture et quant à la reconnaissance de divers processus de rédaction et de réflexion. Toutefois, les processus d’écriture imposés sont moins idiosyncratiques et récursifs que des théoriciens de l’écriture et des enseignants éminents de la rédaction recommanderaient. Les évaluations ne reflètent pas encore une prise de conscience de la théorie de la multilittératie, l’emploi de la technologie numérique pour écrire étant très limité, et les évaluations de portfolios et l’écriture coopérative qui découle des pratiques de Web 2.0 étant inexistantes.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,002 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».