{"id":"W2000242929","doi":"10.1007/s11092-014-9195-0","title":"Navigating dilemmas in transforming assessment practices: experiences of mathematics teachers in Ontario, Canada","year":2014,"lang":"en","type":"article","venue":"Educational Assessment Evaluation and Accountability","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":34,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Manitoba; University of Ottawa","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Situated; Accountability; Judgement; Pedagogy; Assessment for learning; Curriculum; Best practice; Mathematics education; Faculty development; Professional development; Psychology; Formative assessment; Political science; Computer science","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007283135,0.0003864357,0.0005916266,0.001161915,0.04574479,0.01124845,0.003105196,0.003032127,0.003672198],"category_scores_gemma":[0.01988227,0.0007989533,0.0004194494,0.0031913,0.01209818,0.002721237,0.007363375,0.004539494,0.0004474468],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.1425513,"about_ca_system_score_gemma":0.2911698,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.9924852,"about_ca_topic_score_gemma":0.9985344,"domain_scores_codex":[0.986188,0.004560778,0.0004456162,0.0008198289,0.003354494,0.004631273],"domain_scores_gemma":[0.9657706,0.006701896,0.002272701,0.0005416058,0.01055442,0.01415869],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.0000727877,0.0001028506,0.02611396,0.00008602405,0.00001177663,0.001204667,0.9481727,0.0001998083,0.0005432122,0.001508758,0.006378561,0.01560489],"study_design_scores_gemma":[0.00001162853,0.00004664168,0.0228979,0.0001207037,0.00001039913,0.0001114679,0.9361263,0.0001753319,0.0001542463,0.0003128931,0.03998844,0.00004404526],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9634714,0.0006880422,0.0005697182,0.01631497,0.000120964,0.0001591322,0.0001221893,0.00003352942,0.01852014],"genre_scores_gemma":[0.981501,0.0004688899,0.0007866142,0.00145112,0.00001713288,0.00003706638,0.00004552703,0.00003896136,0.01565375],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1425513,"threshold_uncertainty_score":0.994519,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0639113308409666,"score_gpt":0.4511814897350099,"score_spread":0.3872701588940433,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}