{"id":"W3176879039","doi":"10.1097/acm.0000000000004089","title":"Numbers Encapsulate, Words Elaborate: Toward the Best Use of Comments for Assessment and Feedback on Entrustment Ratings","year":2021,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":60,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia; University of Northern British Columbia; Western University; The Wilson Centre; Sinai Health System","funders":"","keywords":"Operationalization; Premise; Documentation; Formative assessment; Temptation; Set (abstract data type); Computer science; Psychology; CLARITY; Medical education; Mathematics education; Social psychology; Epistemology; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1647338,0.001475566,0.001131819,0.007253951,0.004831487,0.0120003,0.002795466,0.00298115,0.005595632],"category_scores_gemma":[0.5109904,0.001476621,0.0007435254,0.004048347,0.01074451,0.02131415,0.01110269,0.005465101,0.008879212],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004904647,"about_ca_system_score_gemma":0.01321976,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002735096,"about_ca_topic_score_gemma":0.003063931,"domain_scores_codex":[0.7176741,0.2256666,0.02232238,0.005021628,0.02701271,0.002302632],"domain_scores_gemma":[0.4243437,0.3442127,0.04189981,0.03968407,0.1433957,0.00646397],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.0004552121,0.0001822772,0.005864967,0.001424881,0.00002596741,0.0004036753,0.1375169,0.0006381461,0.006689213,0.0680896,0.09280236,0.6859069],"study_design_scores_gemma":[0.0001597053,0.000799984,0.008531661,0.0102221,0.000105207,0.0008927109,0.1347626,0.006162881,0.01784277,0.09012132,0.7296637,0.0007353524],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.08921398,0.004600794,0.5975121,0.1622221,0.009454198,0.006687945,0.0009075255,0.008359241,0.1210422],"genre_scores_gemma":[0.355563,0.002797606,0.594068,0.01151219,0.001559052,0.006417968,0.0004570811,0.002892918,0.02473209],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.1647338,"threshold_uncertainty_score":0.8712062,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0919108077078394,"score_gpt":0.4182165258742775,"score_spread":0.3263057181664381,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}