{"id":"W2076996444","doi":"10.1177/0829573512437025","title":"Why We Need Reliable, Valid, and Appropriate Learning Disability Assessments","year":2012,"lang":"en","type":"article","venue":"Canadian Journal of School Psychology","topic":"Educational and Psychological Assessments","field":"Psychology","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Psychology; Plea; Medical diagnosis; Learning disability; Reliability (semiconductor); Test (biology); Applied psychology; Clinical psychology; Test validity; Medical education; Psychometrics; Developmental psychology; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001464992,0.0002558481,0.0004181206,0.0002577906,0.0002320579,0.00006884791,0.0004098249,0.0002789531,0.008507461],"category_scores_gemma":[0.0002001401,0.0002174196,0.0001274965,0.000356615,0.0003700455,0.0003769422,0.00002130896,0.001209326,0.0003053093],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001605448,"about_ca_system_score_gemma":0.0002074537,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001446103,"about_ca_topic_score_gemma":0.000382635,"domain_scores_codex":[0.9972961,0.0005433613,0.0007307872,0.0003475289,0.0002136166,0.0008686154],"domain_scores_gemma":[0.9968224,0.0001810269,0.0004396338,0.0003540952,0.0001818954,0.002021017],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00009787128,0.0002685551,0.9146231,0.00001105094,0.0001502429,0.00002848116,0.0005818481,0.000003314603,0.00006869968,0.001857945,0.07475348,0.007555415],"study_design_scores_gemma":[0.00094149,0.0003569371,0.726549,0.00002854266,0.00004425772,0.0003853689,0.001404658,7.795598e-7,0.000001920501,0.004469096,0.2656235,0.000194486],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9359134,0.003385772,0.0005269292,0.01799601,0.006973557,0.0002132714,0.00001346204,0.00001904547,0.03495859],"genre_scores_gemma":[0.9876578,0.000109905,0.001635929,0.008022285,0.001105761,0.00001818125,0.000008866115,0.00003107255,0.001410132],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.19087,"threshold_uncertainty_score":0.9923989,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09180826963602269,"score_gpt":0.4191663288089811,"score_spread":0.3273580591729584,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}