{"id":"W4366449340","doi":"10.3138/cjpe.0022.012","title":"Achievement Assessment Programs in Reading and Writing: What Lessons Can Be Learned?","year":2008,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Writing and Handwriting Education","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Reading (process); Mathematics education; Literacy; Accountability; Test (biology); Psychology; Academic achievement; Achievement test; Pedagogy; Standardized test; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005453703,0.00008350291,0.0001441146,0.0002963463,0.0006791021,0.0004362704,0.00011863,0.00007914616,0.00003062148],"category_scores_gemma":[0.0003882129,0.0000906284,0.00004020832,0.0003325363,0.0002050106,0.0004811604,0.000005429718,0.000256254,5.71615e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008536302,"about_ca_system_score_gemma":0.004621448,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.01490483,"about_ca_topic_score_gemma":0.1954489,"domain_scores_codex":[0.9981144,0.0004594475,0.0003647966,0.0001445442,0.000551803,0.0003649821],"domain_scores_gemma":[0.9986964,0.00006927313,0.0002446984,0.00007359654,0.000499244,0.0004167181],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.000002697468,0.0000882386,0.137303,0.00001192225,0.00001255999,0.00001900091,0.03286038,0.0000262997,0.00001794657,0.003067298,0.0001787788,0.8264118],"study_design_scores_gemma":[0.00249947,0.001049272,0.5544779,0.001920432,0.0001736767,0.0001809276,0.3654923,0.001528097,0.00004727096,0.005418953,0.06657454,0.0006371526],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9656252,0.0006038552,0.00001586818,0.03133142,0.0003061954,0.0006945799,0.000001003254,0.0000145455,0.001407367],"genre_scores_gemma":[0.9965647,0.0003580372,0.002490025,0.0001146031,0.0002987501,0.00006745019,0.00001647464,0.000009640544,0.00008028985],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8257747,"threshold_uncertainty_score":0.991655,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3287598229889723,"score_gpt":0.4633364146822562,"score_spread":0.134576591693284,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}