MétaCan
Menu
Retour à la cohorte
Enregistrement W4238272806 · doi:10.1017/s0261444802241890

Language testing

2003· article· en· W4238272806 sur OpenAlexaffabout
Anne Georges, James M. Hudson, Amy And Bruckman

Notice bibliographique

RevueLanguage Teaching · 2003
Typearticle
Langueen
DomaineArts and Humanities
ThématiqueEFL/ESL Teaching and Learning
Établissements canadiensTrinity Western University
Organismes subventionnairesnon disponible
Mots-clésContext (archaeology)LinguisticsForeign languageLanguage assessmentPsychologyHistoryPhilosophy

Résumé

récupéré en direct d'OpenAlex

03–174Andrews, Stephen (U. of Hong Kong SAR, China; Email: sandrews@hkucc.hku.hk ), Fullilove, John and Wong, Yama. Targeting washback – a case-study. System (Oxford, UK), 30, 2 (2002), 207–23. 03–175Bourguignon, Claire (Université du Havre, France). L'importance de la représentation dans l'activité d'évaluation de la communication langagière: application au project europoliglot. [The importance of representation patterns in assessing linguistic communication: A multi-language application – project EUROPOLIGLOT.] Les Cahiers de l'APLIUT (Grenoble, France), 21, 2 (2001), 62–78. 03–176Esmaeili, Hameed. Integrated reading and writing tasks and ESL students' reading and writing performance in an English language test. The Canadian Modern Language Review/La Revue canadienne des langues vivantes (Toronto, Ont.), 58, 4 (2002), 599–622. 03–177Ginther, April (Purdue U., USA; Email: aginther@purdue.edu ). Context and content visuals and performance on listening comprehension stimuli. Language Testing (London, UK), 19, 2 (2002), 133–67. 03–178Godev, Concepción B. (U. of North Carolina at Charlotte, USA), Martinez-Gibson, Elizabeth A. and Toris, Carol C. M. Foreign language reading comprehension test: L1 versus L2 in open-ended questions. Foreign Language Annals (New York, USA), 35, 2 (2002), 202–21. 03–179Goodfellow, Robin (Open U., Milton Keynes, UK; Email: r.goodfellow@open.ac.uk ), Lamy, Marie-Noëlle and Jones, Glyn. Assessing learners' writing using lexical frequency. ReCALL (Cambridge, UK), 14, 1 (2002), 133–45. 03–180Issac, Fabrice (Université Paris-Nord, France; Email: fabrice.issac@lli.univ-paris13.fr ) and Hû, Olivier. Formalism for evaluation: Feedback on learner knowledge representation. Computer Assisted Language Learning (Lisse, The Netherlands), 15, 2 (2002), 183–99. 03–181Kim, Duk-Ja (Hansung U., Seoul, Korea; Email: deog@hansung.ac.kr ) and Kyungmi, O. Washback on 12th grade English classes of the English tests within Korean University entrance exams. English Teaching (Korea), 57, 3 (2002), 303–31. 03–182Kobayashi, Miyoko (U. of Warwick, UK; Email: Miyoko.Kobayashi@warwick.ac.uk ). Method effects on reading comprehension test performance: Text organisation and response format. Language Testing (London, UK), 19, 2 (2002), 193–220. 03–183Major, Roy C. (Arizona State U., Tucson, USA), Fitzmaurice, Susan F., Bunta, Ferenc and Balasubramanian, Chandrika. The effects of nonnative accents on listening comprehension: Implications for ESL assessment. TESOL Quarterly (Alexandria, VA, USA), 36, 2 (2002), 173–90. 03–184Meara, Paul, Jacobs, Gabriel and Rodgers, Catherine (U. of Wales Swansea, UK; Email: p.m.meara@swan.ac.uk ). Lexical signatures in foreign language free-form texts. ITL Review of Applied Linguistics (Leuven, Belgium), 135–136 (2002), 85–96. 03–185Myers, Marie J. (Queens U., Ontario, Canada; Email: myersmj@educ.queensu.ca ). Computer-assisted second language assessment: To the top of the pyramid. ReCALL (Cambridge, UK), 14, 1 (2002), 167–81. 03–186O'Loughlin, Kieran (The U. of Melbourne, Australia; Email: kjo@unimelb.edu.au ). The impact of gender in oral proficiency testing. Language Testing (London, UK), 19, 2 (2002), 169–92. 03–187Orr, Michael (The British Council, Valencia, Spain; Email: mike.orr@es.britcounc.org ). The FCE Speaking test: Using rater reports to help interpret test scores. System (Oxford, UK), 30, 2 (2002), 143–54. 03–188Patri, Mrudula (City U. of Hong Kong; Email: elpatri@cityu.edu.hk ). The influence of peer feedback on self- and peer-assessment of oral skills. Language Testing (London, UK), 19, 2 (2002), 109–31. 03–189Song, Bailin and August, Bonne (City U. of New York, USA; Email: bsong@kbcc.cuny.edu ). Using portfolios to assess the writing of ESL students: A powerful alternative? Journal of Second Language Writing (Norwood, NJ, USA), 11, 1 (2002), 49–72. 03–190Wilhelm, Kim Hughes and Rivers, Marilyn (Southern Illinois U., USA). An audience approach to EAP writing assessment: Learners, teachers, outsiders. Applied Language Learning (Presidio of Monterey, CA, USA), 12, 2 (2001), 177–90. 03–191Yien, Liju (Nat. Lien Ho Inst. of Technology, Taiwan). Effective test-taking strategies on English tests: Implications from Taiwanese students. Hong Kong Journal of Applied Linguistics (Hong Kong), 6, 2 (2001), 22–43.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,006
score de la tête « metaresearch » (Gemma)0,019
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesCharge utile insuffisante (le modèle a refusé de juger)
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Sans objet · Signal consensuel: aucune
GenreSignal candidat: Autre · Signal consensuel: Autre
Score de désaccord entre enseignants0,309
Score d'incertitude au seuil0,985

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,0060,019
Méta-épidémiologie (sens strict)0,0010,000
Méta-épidémiologie (sens large)0,0010,001
Bibliométrie0,0020,001
Études des sciences et des technologies0,0020,001
Communication savante0,0040,003
Science ouverte0,0030,005
Intégrité de la recherche0,0010,003
Charge utile insuffisante (le modèle a refusé de juger)0,3090,246

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,032
Tête enseignante GPT0,266
Écart entre enseignants0,234 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.

Devis d'étudeSans objet
Domainenon disponible
GenreAutre

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations0
Publié2003
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueLanguage TeachingMême sujetEFL/ESL Teaching and LearningTravaux en français237 207