{"id":"W2326090025","doi":"10.1097/01367895-200617040-00008","title":"COMPARISON OF STUDENT SELF-EVALUATION TO FACULTY EVALUATION OF SUMMATIVE OSCE PERFORMANCE—AFTER IMMEDIATE FEEDBACK BY FACULTY.","year":2006,"lang":"en","type":"article","venue":"The Journal of Physician Assistant Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Summative assessment; Medical education; Psychology; Medicine; Mathematics education; Formative assessment","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004201731,0.0001818297,0.0004601876,0.0002832527,0.00009805567,0.00001685026,0.0002141686,0.00007411333,0.00005820282],"category_scores_gemma":[0.000201106,0.0001302052,0.0001019139,0.0008802725,0.00009744124,0.0003166794,0.00002485988,0.0002883771,0.00001313328],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009570264,"about_ca_system_score_gemma":0.001322933,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003295835,"about_ca_topic_score_gemma":0.000005793556,"domain_scores_codex":[0.995437,0.0003567856,0.00131648,0.0001407321,0.002552303,0.0001966759],"domain_scores_gemma":[0.9922562,0.00005981888,0.001884226,0.0002930838,0.005456669,0.00004998832],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001871864,0.02145451,0.1703242,0.001054597,0.0008996527,2.567787e-7,0.07094571,0.004587234,0.12906,0.0003871974,0.2165481,0.3828667],"study_design_scores_gemma":[0.001670492,0.0006558506,0.9337919,0.0008062447,0.001763382,0.000005170287,0.01727893,0.004968753,0.03762536,0.0001966603,0.001075574,0.0001616195],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9944608,0.0003981315,0.0003993248,0.002190841,0.0006639322,0.001000756,0.00001776714,0.000007623134,0.0008608217],"genre_scores_gemma":[0.9974693,0.00001339511,0.001329093,0.0002748798,0.0005190978,0.00005857657,0.0002430165,0.00001888603,0.00007375174],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7634678,"threshold_uncertainty_score":0.5309614,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04226557893353971,"score_gpt":0.4267927904494097,"score_spread":0.3845272115158699,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}