Identification et mise à l'épreuve des variables permettant la prédiction du niveau de difficulté de tâches d'évaluation pour des équations du premier degré en mathématiques au secondaire
Bibliographic record
Abstract
Cette étude s'intéresse à l'élaboration de tâches d'évaluation pour des équations du premier degré à deux inconnues en mathématiques, au secondaire. Nous nous sommes intéressés plus précisément à l'identification des paramètres permettant de connaître a priori le niveau de difficulté d'un échantillon de tâches d'évaluation en algèbre et notre recherche s'est limitée à la modélisation d'un seul paramètre, à savoir le niveau de difficulté. Le travail effectué dans le cadre de cette recherche a porté sur l'identification et la classification de variables prédictives pour le niveau de difficulté. Afin d'atteindre nos objectifs, nous avons choisi de travailler avec les données de la banque d'instruments de mesure du réseau secondaire (BIM). Les épreuves desquelles résultent ces données ont été soumises à des élèves de plusieurs commissions scolaires de la province de Québec. À partir de ces données, nous avons procédé au classement des tâches d'évaluation reliées aux équations du premier degré. Par la suite, une application du modèle de régression linéaire a été réalisée afin de vérifier si le taux de réussite des tâches d'évaluation pouvait être expliqué par les variables prédictives retenues. Les résultats obtenus ont montré que les variables prédictives expliquent le taux de réussite des tâches d'évaluation des équations du premier degré avec un coefficient de détermination de 0,78. Ainsi, même si les tâches d'évaluation utilisées pour cette étude ont été produites par des enseignants différents provenant de plusieurs régions du Québec, il a été possible de prédire efficacement leur niveau de difficulté. Les résultats obtenus par les corrélations sont comparables à ceux d'autres études du même type. L'originalité de notre travail a été de montrer comment élaborer des tâches d'évaluation en utilisant des variables prédictives. Ce concept a été validé selon deux modèles: un modèle à une équation et l'autre à deux équations. De plus, nous avons présenté des étapes afin de construire des tâches d'évaluation avec un niveau de difficulté déterminé à l'avance. Au niveau pratique, le modèle développé pourra être utilisé directement par les enseignants lors des évaluations classiques en salle de classe. Mais aussi pour le développement d'environnements d'évaluation informatisés. ______________________________________________________________________________ MOTS-CLÉS DE L’AUTEUR : Production de tâches d'évaluation, Équations du premier degré, Variables prédictives, Niveau de difficulté de tâches d'évaluation.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.004 | 0.012 |
| Meta-epidemiology (narrow) | 0.002 | 0.001 |
| Meta-epidemiology (broad) | 0.001 | 0.002 |
| Bibliometrics | 0.003 | 0.002 |
| Science and technology studies | 0.001 | 0.001 |
| Scholarly communication | 0.004 | 0.002 |
| Open science | 0.001 | 0.001 |
| Research integrity | 0.001 | 0.002 |
| Insufficient payload (model declined to judge) | 0.005 | 0.002 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".