MétaCan
Menu
Retour à la cohorte
Enregistrement W6996631828

In the service of the stakeholder: a critical, mixed-method program of research in high-stakes language assessment

2011· dissertation· en· W6996631828 sur OpenAlexaboutno aff

Notice bibliographique

RevueeScholarship@McGill (McGill) · 2011
Typedissertation
Langueen
DomaineSocial Sciences
ThématiqueStudent Assessment and Feedback
Établissements canadiensnon disponible
Organismes subventionnairesnon disponible
Mots-clésTest (biology)CertificationStakeholderLanguage assessmentLanguage proficiencyPerceptionTask (project management)Service (business)Field (mathematics)
DOInon disponible

Résumé

récupéré en direct d'OpenAlex

The three studies presented here represent a two-year program of research that critically explored one case of high-stakes language assessment—English proficiency assessment for teacher certification in Quebec, Canada.The first study was an examination of the final administration of a writing test used for this purpose at one Quebec university before this test was replaced. In this study, mismatches were revealed in stakeholder perceptions of the task to be produced in this assessment. The second study examined the pilot administration of a new replacement test. It focused on the socio-political environment of the test—namely, how the perception of high or low stakes by raters affected scoring. Results from this study suggested that test stakes—to all stakeholders, including raters—is a worthwhile focus of study. The third study examined the first official administration of the new test, and focused on rater behavior from a socio-cognitive perspective, suggesting that information on decision-making style may provide insight into variability in rater scoring.This program of research has been critical in that •it has integrated social and political values into the test validation process;•test stakeholders, including the test takers themselves, have not only been consulted but have determined the direction of the research program to a great extent; and•the conflicting views and competing interests of the stakeholders have been embraced and have enriched the research program.These studies will make contributions to the field of language assessment, and in particular, in better understanding how all elements of the subjectively-scored assessment situation interact. Because of its critical approach, these studies have demonstrated a responsible and progressive approach to researching the assessment of language proficiency for professional certification. In addition, the use of mixed methods designs in all three studies has been somewhat innovative and will add to the emerging field of mixed method research.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,011
score de la tête « metaresearch » (Gemma)0,001
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMéta-épidémiologie (sens strict), Intégrité de la recherche
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Théorique ou conceptuel · Signal consensuel: aucune
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,805
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0110,001
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0010,000
Bibliométrie0,0010,003
Études des sciences et des technologies0,0010,000
Communication savante0,0000,001
Science ouverte0,0030,000
Intégrité de la recherche0,0010,002
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,104
Tête enseignante GPT0,441
Écart entre enseignants0,337 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Devis d'étudeThéorique ou conceptuel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations0
Publié2011
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueeScholarship@McGill (McGill)Même sujetStudent Assessment and FeedbackTravaux en français237 207