{"id":"W2288920388","doi":"10.18806/tesl.v32i0.1218","title":"Walk a Mile in My Shoes: Stakeholder Accounts of Testing Experience with a Computer-Administered Test","year":2016,"lang":"en","type":"article","venue":"TESL Canada Journal","topic":"Discourse Analysis in Language Studies","field":"Arts and Humanities","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Test (biology); Psychology; Context (archaeology); Language assessment; Stakeholder; Applied psychology; Social psychology; Pedagogy; Public relations; Political science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01941367,0.0006947996,0.0005905007,0.002544364,0.009921301,0.005519218,0.002447691,0.002349229,0.001838735],"category_scores_gemma":[0.05599122,0.0006168822,0.000561296,0.001577636,0.006054321,0.004496858,0.006376047,0.002612395,0.0003795311],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006696114,"about_ca_system_score_gemma":0.005701221,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.05481298,"about_ca_topic_score_gemma":0.07381057,"domain_scores_codex":[0.9690604,0.02284603,0.0009219826,0.001017407,0.003226864,0.002927376],"domain_scores_gemma":[0.9400685,0.03671,0.004225312,0.001958241,0.009773449,0.007264617],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.00007582518,0.00006515795,0.02504527,0.0000477933,0.000009993088,0.001417902,0.9639812,0.00006402376,0.00146341,0.0004124286,0.0005442427,0.00687283],"study_design_scores_gemma":[0.000003388719,0.0001016428,0.00787305,0.00006367295,0.000005443185,0.0003899998,0.987659,0.0003188424,0.0003927001,0.000142804,0.003016696,0.00003278668],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9950989,0.000146479,0.0009368655,0.00146351,0.00001634611,0.00005254374,0.00004952842,0.00001572395,0.00222002],"genre_scores_gemma":[0.9979268,0.0001607278,0.000617908,0.0004171524,0.00001110771,0.00004369392,0.00004455022,0.00002399731,0.0007539875],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.05481298,"threshold_uncertainty_score":0.1089879,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06509561069371143,"score_gpt":0.2435075109749999,"score_spread":0.1784119002812884,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}