{"id":"W4206815847","doi":"10.52547/johepal.2.4.121","title":"A Case Study of Teacher Candidates’ Experiences: Writing the Pilot Math Proficiency Test in Ontario, Canada","year":2021,"lang":"en","type":"article","venue":"Journal of Higher Education Policy And Leadership Studies","topic":"Education Systems and Policy","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Wilfrid Laurier University","funders":"","keywords":"Test (biology); Mathematics education; Psychology; Geology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007913285,0.00009219551,0.0002324476,0.0001191734,0.000396191,0.00005484537,0.0001224451,0.00002532838,0.00005836576],"category_scores_gemma":[0.0005721303,0.00006372452,0.00002439898,0.000391909,0.0001876658,0.0001542107,0.00001941921,0.0002130669,2.604525e-7],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004816398,"about_ca_system_score_gemma":0.008718997,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.9735105,"about_ca_topic_score_gemma":0.9900754,"domain_scores_codex":[0.9985031,0.0003544989,0.0005134589,0.0001082135,0.0003112572,0.0002094464],"domain_scores_gemma":[0.9985318,0.0004995033,0.0003950068,0.0001044844,0.0003865995,0.00008259539],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.000003639499,0.0004319393,0.2791561,0.00002430481,0.00002389627,0.00002962354,0.715033,8.923342e-7,0.000005452476,0.002298352,0.002902061,0.00009075878],"study_design_scores_gemma":[0.0001778948,0.0001058364,0.08424016,0.000077218,0.00001768908,0.0001687799,0.9023275,9.075513e-8,0.000006189285,0.00005621771,0.01276096,0.0000614568],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.97342,0.004369745,5.461107e-8,0.01998655,0.0005436428,0.0001502007,6.808397e-7,0.00000202193,0.001527067],"genre_scores_gemma":[0.9874167,0.00004573796,0.00001041676,0.0007560243,0.0007683365,0.00003218997,1.556255e-7,0.000004542354,0.01096586],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1949159,"threshold_uncertainty_score":0.9969006,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2290251381899379,"score_gpt":0.4172160715295438,"score_spread":0.1881909333396059,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}