{"id":"W4306631416","doi":"10.53967/cje-rce.v45i3.5191","title":"Assessing Learning Skills and Work Habits: What Do Report Card Data Tell Us?","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Education / Revue canadienne de l éducation","topic":"School Choice and Performance","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University","funders":"","keywords":"Report card; Academic achievement; Mathematics education; Standardized test; Psychology; Accountability; Set (abstract data type); Construct (python library); Achievement test; Test (biology); Work (physics); Medical education; Pedagogy; Medicine; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02513693,0.0006061326,0.001503318,0.006295961,0.001762035,0.005638071,0.003139254,0.001905203,0.00226676],"category_scores_gemma":[0.1280174,0.0007529767,0.0007598049,0.01365438,0.00385997,0.005146726,0.00216294,0.001661065,0.0009844936],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006795967,"about_ca_system_score_gemma":0.009618301,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.730274,"about_ca_topic_score_gemma":0.8037043,"domain_scores_codex":[0.9760317,0.006105118,0.002908756,0.002190212,0.01146554,0.00129857],"domain_scores_gemma":[0.8533656,0.04331132,0.02989534,0.01742796,0.05098356,0.005016163],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001140617,0.00004953994,0.9127247,0.0007371132,0.0002833191,0.00005948502,0.005445238,0.0002791368,0.0002498099,0.001125969,0.007981004,0.07095062],"study_design_scores_gemma":[0.000009923105,0.000051767,0.9775597,0.000854116,0.0001041776,0.00007260423,0.004480273,0.0003112457,0.0001652996,0.0009904664,0.01534259,0.00005783089],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8073637,0.04010201,0.01734209,0.03860388,0.00131405,0.0005062029,0.05136821,0.0002868144,0.04311305],"genre_scores_gemma":[0.9534149,0.01350702,0.009414879,0.004010538,0.0004225802,0.0002846381,0.01591394,0.000140419,0.00289113],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.730274,"threshold_uncertainty_score":0.542629,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06164262493477819,"score_gpt":0.3397326991640287,"score_spread":0.2780900742292505,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}