{"id":"W66999940","doi":"10.55016/ojs/ajer.v57i4.55527","title":"An Analysis of Large-Scale Writing Assessments in Canada (Grades 5-8)","year":2012,"lang":"en","type":"article","venue":"Alberta Journal of Educational Research","topic":"Writing and Handwriting Education","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta; University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Psychology; Scale (ratio); Mathematics education; Item analysis; Statistics; Psychometrics; Mathematics; Geography; Developmental psychology; Cartography","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005084773,0.00005315951,0.0001936749,0.0006653006,0.0002852367,0.00004860082,0.0003257338,0.00004091344,0.002529727],"category_scores_gemma":[0.004168364,0.00005363913,0.00006160624,0.001487142,0.00008530258,0.000465835,0.00001649508,0.0002880723,0.000003892481],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008844653,"about_ca_system_score_gemma":0.007167291,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.8946685,"about_ca_topic_score_gemma":0.9812751,"domain_scores_codex":[0.9972149,0.000725005,0.0004578789,0.00009383982,0.00103594,0.0004724134],"domain_scores_gemma":[0.9901918,0.008437241,0.0002247573,0.0001166664,0.0007504115,0.0002791271],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000007887406,0.0004119464,0.9812498,0.000008867531,0.00006372326,8.768536e-8,0.0084233,0.0000503618,0.00009626132,0.008467652,0.0009336371,0.0002864384],"study_design_scores_gemma":[0.0001093549,0.00002568628,0.9096466,0.00006163763,0.00005625128,0.000001362645,0.08741267,0.0001241046,0.00006195022,0.0001248312,0.002315576,0.0000600262],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9754868,0.0002721381,0.000002639817,0.003825851,0.0002357977,0.00005104637,0.000004593161,2.301379e-7,0.02012089],"genre_scores_gemma":[0.9975932,0.00005677643,0.0003376132,0.00004270065,0.0006716183,0.000004672819,0.00001322489,0.000005740944,0.00127442],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0866067,"threshold_uncertainty_score":0.9984611,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08472816661963128,"score_gpt":0.4968318331793457,"score_spread":0.4121036665597144,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}