{"id":"W2112746316","doi":"","title":"Educational Quality and Accountability in Ontario: Past, Present, and Future","year":2007,"lang":"en","type":"article","venue":"Canadian Journal of Educational Administration and Policy","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":57,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Accountability; Scale (ratio); Educational assessment; Quality (philosophy); Political science; Public administration; Quality assessment; Public relations; Sociology; Pedagogy; Geography","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003426166,0.00009305104,0.0001539818,0.0005534229,0.0001694032,0.0002465057,0.0001202572,0.00006548153,0.001953951],"category_scores_gemma":[0.0004662893,0.00007834722,0.00002733399,0.0002909814,0.0001549816,0.0005062731,0.00000889885,0.0001916786,0.000004812674],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002604687,"about_ca_system_score_gemma":0.01379604,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.0592943,"about_ca_topic_score_gemma":0.7771057,"domain_scores_codex":[0.9983611,0.0001063699,0.0007520313,0.0001709711,0.0004408362,0.0001686549],"domain_scores_gemma":[0.9976403,0.0008439633,0.0003191297,0.000114985,0.0004706286,0.0006110605],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00003532313,0.00004160538,0.9274668,0.00000461492,0.00000545506,5.512994e-7,0.002658348,0.000001700628,0.000008441727,0.05700296,0.00305313,0.009721092],"study_design_scores_gemma":[0.000222719,0.00005387135,0.8619915,0.000007184369,0.000003102175,0.00009329285,0.001605447,0.000006577224,0.000004712812,0.03158531,0.1043586,0.00006760478],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8115441,0.0002043865,0.000009410359,0.1805117,0.0002983534,0.00008064362,0.00001291777,4.523803e-7,0.007338012],"genre_scores_gemma":[0.9946126,0.00001873058,0.0004062291,0.001236836,0.001808929,0.00000245199,0.00001186048,0.000002837837,0.001899525],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7178114,"threshold_uncertainty_score":0.9989584,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1666889239092964,"score_gpt":0.519257219435984,"score_spread":0.3525682955266876,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}