{"id":"W2149218812","doi":"10.1093/jpepsy/jsm140","title":"Commentary: Evidence-based Assessment--Strength in Numbers","year":2008,"lang":"en","type":"article","venue":"Journal of Pediatric Psychology","topic":"Child and Adolescent Psychosocial and Emotional Development","field":"Psychology","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary; University of Ottawa","funders":"","keywords":"Psychology; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0006420136,0.0001870607,0.0003813229,0.0005002389,0.00009587354,0.00000942571,0.0003561702,0.000156812,0.00131925],"category_scores_gemma":[0.00003995251,0.0001642002,0.0002080516,0.0005537115,0.0000908023,0.0001682851,0.00002051186,0.0006233053,0.00008811923],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001226752,"about_ca_system_score_gemma":0.0001957396,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003500137,"about_ca_topic_score_gemma":0.00000854467,"domain_scores_codex":[0.9978466,0.0002934324,0.0008657332,0.0002555868,0.0003601585,0.0003784983],"domain_scores_gemma":[0.9987957,0.0002419112,0.0005028913,0.0001848072,0.0001027477,0.0001719294],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002477232,0.001147695,0.6505446,0.00001118831,0.00004366551,0.000391312,0.0004068003,0.000007462607,0.00001990549,0.0002168264,0.344817,0.002145805],"study_design_scores_gemma":[0.003258813,0.0003193073,0.9674352,0.00006140424,0.00003363411,0.000265569,0.00009938232,0.000002228313,0.000001913049,0.0004206502,0.0279252,0.0001767206],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9539242,0.002352485,0.0004814032,0.02826097,0.006636243,0.0001467487,0.000007312379,0.00001823097,0.008172389],"genre_scores_gemma":[0.9785087,0.002673859,0.001326517,0.01461316,0.002617744,0.000004711816,0.000006209705,0.00001694327,0.0002321597],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3168918,"threshold_uncertainty_score":0.9995937,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06247175142504973,"score_gpt":0.3668908944960985,"score_spread":0.3044191430710487,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}