Développement d’un dispositif d’évaluation diagnostique pour cibler les erreurs d’accord du verbe et des participes passés à la fin du 1er cycle du secondaire
Notice bibliographique
Résumé
La maitrise de l’écrit est importante et nous savons que celle-ci est loin d’être assurée par l’ensemble des scripteurs du français, au Québec comme ailleurs. À titre d’exemple, les performances des élèves du secondaire québécois en écriture (Ministère de l’Éducation et de l'Enseignement supérieur, 2019), et plus particulièrement en orthographe grammaticale, se conforment peu aux attentes sociales. Pour soutenir l’apprentissage des élèves dans ce domaine, dans une perspective de différenciation pédagogique, l’établissement d’un diagnostic initial permettant de cibler les forces et les faiblesses des apprenants s’avère une étape primordiale. Pour ce faire, les enseignants doivent disposer d’outils d’évaluation diagnostique adéquats qui permettent de brosser le portrait des difficultés rencontrées par leurs élèves. \nLa présente recherche doctorale vise à répondre à ce besoin en développant un dispositif d’évaluation diagnostique qui cible, par l’analyse des erreurs commises et selon une approche cognitive, les difficultés rencontrées par les élèves de la fin du 1er cycle du secondaire avec l’accord du verbe et des participes passés. Les objectifs spécifiques de cette recherche consistent en la conception, la réalisation, la mise à l’essai et la finalisation de ce dispositif en suivant le cadre méthodologique général de Harvey et Loiselle (2009). La validation du dispositif et de la démarche employée pour l’élaborer se réalise de diverses façons : par l’emploi d’une approche « fondée sur des preuves » (Mislevy, Steinberg, et Almond, 2003) pour la conception du dispositif, par le recours à des experts de contenu pour valider les bases conceptuelles du dispositif, par un questionnaire aux enseignants (n= 4) et deux entrevues semi-dirigées menées avec eux à la suite des mises à l’essai empiriques (auprès de 360 élèves de 2e secondaire) pour vérifier la convivialité du dispositif et son adéquation aux besoins dégagés et, finalement, par l’analyse psychométrique des items des deux tests composant le dispositif créé. Des critères de scientificité sont aussi établis et respectés pour s’assurer que la recherche-développement réalisée comporte les caractéristiques attendues d’un tel type de recherche. \nL’objet résultant de cette recherche-développement, le dispositif nommé DIAgramm, est un outil d’évaluation diagnostique informatisé et accessible en ligne, composé de deux tests visant des niveaux de diagnostic différents (niveaux constat et recherche des causes, voir B. Rey, 2016) et générant des rapports de résultats complets et précis pour les enseignants. Le niveau constat de DIAgramm vise à cerner les configurations syntaxiques qui posent problème aux élèves alors que le niveau recherche des causes vise à identifier la cause des erreurs commises. \nLes résultats de cette recherche-développement nous laissent penser que DIAgramm répond tout à fait aux besoins éprouvés par les enseignants, tant en ce qui concerne la qualité des portraits diagnostiques brossés que la convivialité de l’instrument lui-même (administration facile, clarté des rapports de résultats fournis, etc.).
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,001 |
| Études des sciences et des technologies | 0,013 | 0,001 |
| Communication savante | 0,000 | 0,001 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».