{"id":"W4200548621","doi":"10.31219/osf.io/yh3zj","title":"Validity of Automated Learning Progress Assessment in English Written Expression for Students with Learning Difficulties","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Writing and Handwriting Education","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"Social Sciences and Humanities Research Council of Canada; Institute of Education Sciences; U.S. Department of Education","keywords":"Spelling; Narrative; Curriculum; Grammar; Writing assessment; Quality (philosophy); Mathematics education; Psychology; Expression (computer science); Applied psychology; Computer science; Pedagogy; Linguistics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0360043,0.0005303614,0.0005772436,0.002567686,0.0005000376,0.001459833,0.001167132,0.000615755,0.0008069959],"category_scores_gemma":[0.1297591,0.0003713366,0.0007251623,0.001126948,0.000867251,0.001552269,0.00218664,0.0006518712,0.0005381875],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006946003,"about_ca_system_score_gemma":0.001084457,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002487804,"about_ca_topic_score_gemma":0.00382587,"domain_scores_codex":[0.9711843,0.01364384,0.003218099,0.002934142,0.008459141,0.0005605234],"domain_scores_gemma":[0.8673123,0.06810339,0.02600681,0.009461533,0.02660131,0.002514656],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0006925362,0.0006196841,0.8979912,0.0001144533,0.000151089,0.00005358836,0.002661017,0.001053956,0.001375223,0.0001613742,0.0004554607,0.09467047],"study_design_scores_gemma":[0.00009956741,0.002417521,0.9805763,0.0001208982,0.00004974695,0.0001657523,0.001326362,0.01063517,0.002441225,0.0003046617,0.00181138,0.00005139515],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.994439,0.0001230671,0.002781822,0.00006197128,0.00003995184,0.0002741448,0.0001966337,0.00007252878,0.002010888],"genre_scores_gemma":[0.9944909,0.00004856782,0.004306514,0.00003283337,0.00001602177,0.0003453325,0.0002182115,0.00002121229,0.0005205183],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0360043,"threshold_uncertainty_score":0.1904112,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03886721325293378,"score_gpt":0.4050019376287716,"score_spread":0.3661347243758378,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}