{"id":"W1587813117","doi":"10.18806/tesl.v21i1.275","title":"Locally Developed Oral Skills Evaluation in ESL/EFL Classrooms: A Checklist for Developing Meaningful Assessment Procedures","year":2003,"lang":"en","type":"article","venue":"TESL Canada Journal","topic":"EFL/ESL Teaching and Learning","field":"Arts and Humanities","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Checklist; Psychology; Identification (biology); Mathematics education; Authentic assessment; Test (biology); Pedagogy; Alternative assessment; Medical education; Curriculum","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002889523,0.0002154593,0.0002683596,0.000166341,0.000889372,0.0003954211,0.0001853445,0.00005225148,0.004804063],"category_scores_gemma":[0.001424251,0.0001910198,0.00005574291,0.00008085676,0.00004737929,0.0002452978,0.00001589055,0.0006038551,0.00000219035],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001535978,"about_ca_system_score_gemma":0.009901351,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.01722005,"about_ca_topic_score_gemma":0.643398,"domain_scores_codex":[0.9977192,0.0003067513,0.0005529672,0.0002305434,0.0006941019,0.0004964302],"domain_scores_gemma":[0.9988032,0.0001767338,0.000279867,0.0001001611,0.0005247035,0.0001153077],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001853784,0.0005751929,0.01114043,0.0007231071,0.0007203835,0.0002874133,0.1082709,0.006868445,0.0002753542,0.5373902,0.2255583,0.1080049],"study_design_scores_gemma":[0.002638568,0.0001537265,0.005975889,0.0006301451,0.00008454265,0.0001793488,0.01314261,0.002849712,0.0000645377,0.007450444,0.9661063,0.0007241723],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8378677,0.0106025,0.02356544,0.007405846,0.005881884,0.002875218,0.00004435107,0.000244292,0.1115128],"genre_scores_gemma":[0.9801373,0.00001123454,0.009734172,0.007295046,0.0003783436,0.00005884904,0.00001907364,0.00004410336,0.002321827],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.740548,"threshold_uncertainty_score":0.9961057,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04566302773426684,"score_gpt":0.3105659843108914,"score_spread":0.2649029565766245,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}