{"id":"W4404207621","doi":"10.1016/j.jcjo.2024.10.014","title":"Prompting better feedback: investigating the effect of targeted form design on quality of narrative feedback in ophthalmology CBME assessments","year":2024,"lang":"en","type":"article","venue":"Canadian Journal of Ophthalmology","topic":"Innovations in Medical Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Kingston General Hospital; Queen's University","funders":"","keywords":"Narrative; Quality (philosophy); Visual feedback; Psychology; Computer science; Artificial intelligence; Art; Physics; Literature","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07617418,0.0006442438,0.0007968757,0.0009537062,0.0005847332,0.0019825,0.001024819,0.0009311466,0.002074444],"category_scores_gemma":[0.4238507,0.0004953624,0.001130485,0.0007910893,0.001011653,0.001976749,0.001739944,0.001003613,0.0003729791],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001837962,"about_ca_system_score_gemma":0.003035625,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008715247,"about_ca_topic_score_gemma":0.001717114,"domain_scores_codex":[0.8920103,0.07162561,0.01417824,0.004161111,0.01689273,0.001132112],"domain_scores_gemma":[0.4498706,0.4293657,0.07868822,0.01366137,0.02422783,0.004186368],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.052637,0.01200291,0.3222841,0.006422031,0.001683442,0.0002226888,0.021663,0.003920448,0.01546133,0.0003873434,0.002039375,0.5612764],"study_design_scores_gemma":[0.004978772,0.07970803,0.8706591,0.002100534,0.001743052,0.00047947,0.004414021,0.009337557,0.02081378,0.0007108203,0.00476922,0.0002857003],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9903735,0.0006606932,0.005598914,0.0002606297,0.0001126738,0.001837571,0.00009560783,0.00009831667,0.0009622147],"genre_scores_gemma":[0.9757023,0.0003096144,0.02091976,0.000182462,0.00006053905,0.002317723,0.00009198904,0.00003523092,0.0003805019],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9238258,"threshold_uncertainty_score":0.4028524,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06545079058414939,"score_gpt":0.3978133196026399,"score_spread":0.3323625290184905,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}