{"id":"W16087079","doi":"10.1053/j.semtcvs.2005.04.002","title":"Assessing for Student Success and a Target Class Average: Balancing two grade-related goals facing university instructors and teaching assistants","year":2012,"lang":"en","type":"article","venue":"Seminars in Thoracic and Cardiovascular Surgery","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"","keywords":"Grading (engineering); Mathematics education; The arts; Psychology; Medical education; Computer science; Engineering; Political science; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007131025,0.0002209388,0.0006159797,0.0002292111,0.0009794098,0.0003042844,0.0001186272,0.0001612606,0.000005958541],"category_scores_gemma":[0.0001941363,0.0002337384,0.0002448543,0.0002417338,0.0002395199,0.001265519,0.0001589867,0.0002917488,3.602217e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001539755,"about_ca_system_score_gemma":0.00007610246,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004392694,"about_ca_topic_score_gemma":0.00005581797,"domain_scores_codex":[0.997333,0.0008492251,0.0002839505,0.0004121338,0.0005236787,0.0005979362],"domain_scores_gemma":[0.9987403,0.000716616,0.0001205304,0.0001694549,0.00004349702,0.0002096273],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001454564,0.00003379607,0.9390758,0.00006688885,0.000296516,0.00002630683,0.0103203,0.00001754485,0.00004927473,0.0006917397,0.00002562692,0.04938167],"study_design_scores_gemma":[0.0009609652,0.00001554643,0.8735054,0.0006396152,0.0004259399,0.00002828263,0.114711,0.0002202633,0.00007261538,0.0002756601,0.008383878,0.0007607649],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.984273,0.01189812,0.0007959479,0.0000480392,0.0005918987,0.0003399264,0.000006515523,0.00004998652,0.001996549],"genre_scores_gemma":[0.9968947,0.00198681,0.0008101297,0.00001491198,0.0001341047,0.000006029649,0.000009023823,0.00001952704,0.0001247609],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1043907,"threshold_uncertainty_score":0.9531575,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02535534479289702,"score_gpt":0.3408351853130464,"score_spread":0.3154798405201494,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}