{"id":"W2288795982","doi":"10.18806/tesl.v32i0.1215","title":"Building Teachers’ Assessment Capacity for Supporting English Language Learners Through the Implementation of the STEP Language Assessment in Ontario K-12 Schools","year":2016,"lang":"en","type":"article","venue":"TESL Canada Journal","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Ell; Christian ministry; Psychology; Mathematics education; Language proficiency; Pedagogy; English language; Sociology; Teaching method; Political science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002538096,0.0001355725,0.0001964812,0.00003916404,0.0006414492,0.0001417613,0.0005462321,0.0000506332,0.00254057],"category_scores_gemma":[0.0002159222,0.0000755796,0.0001125503,0.0001530012,0.00008935234,0.000370184,0.00007149936,0.0005378426,1.682167e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003322152,"about_ca_system_score_gemma":0.005203858,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.9203293,"about_ca_topic_score_gemma":0.9936873,"domain_scores_codex":[0.9974896,0.0003547567,0.0004843995,0.0001672613,0.0009901541,0.0005137937],"domain_scores_gemma":[0.998742,0.000333671,0.0005439514,0.0001755054,0.0001204949,0.000084422],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"qualitative","study_design_scores_codex":[0.00001387972,0.00006664889,0.7265593,0.00001143141,0.0001663721,0.00001269876,0.2263124,0.00002134251,0.004531132,0.009266588,0.01431238,0.0187258],"study_design_scores_gemma":[0.001573832,0.00005537066,0.3831591,0.00008653069,0.00006001389,0.000002512676,0.5854694,0.00000581742,0.000394612,0.0003451558,0.02865179,0.0001958594],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9909686,0.0001024926,0.001039453,0.00404298,0.0007461091,0.0006055205,0.00001901446,0.00001147159,0.002464329],"genre_scores_gemma":[0.9937114,0.000006845215,0.004364333,0.001053853,0.0003085495,0.00002830403,0.000001893662,0.0000127716,0.0005121082],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3591571,"threshold_uncertainty_score":0.9983712,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02933718519097863,"score_gpt":0.3732268630508298,"score_spread":0.3438896778598512,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}