{"id":"W2793966157","doi":"10.4300/jgme-d-17-00578.1","title":"Feedback Credibility in a Formative Postgraduate Objective Structured Clinical Examination: Effects of Examiner Type","year":2018,"lang":"en","type":"article","venue":"Journal of Graduate Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"The Wilson Centre; McMaster University; University of Toronto; University Health Network","funders":"","keywords":"Credibility; Formative assessment; Odds; Specialty; Medicine; Objective structured clinical examination; Odds ratio; Medical education; Family medicine; Psychology; Internal medicine; Pedagogy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.004293845,0.0001907148,0.0006718397,0.0006286073,0.00005508536,0.0000123343,0.000240223,0.0002966486,0.000216649],"category_scores_gemma":[0.03998715,0.0001459797,0.0001391738,0.001529159,0.0007188437,0.0003112652,0.00004203734,0.001056336,0.00001603461],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003716256,"about_ca_system_score_gemma":0.003893852,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003798278,"about_ca_topic_score_gemma":0.00001554225,"domain_scores_codex":[0.9955806,0.0005187701,0.001933833,0.0002413443,0.001478689,0.0002467323],"domain_scores_gemma":[0.9933574,0.00049738,0.001189656,0.0003407132,0.004367585,0.0002472826],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001105257,0.005097437,0.05902173,0.0008689608,0.0002504901,0.00002898427,0.013012,8.577376e-7,0.0008417212,0.0006311195,0.02962,0.8895214],"study_design_scores_gemma":[0.002962516,0.002817247,0.9836705,0.001448595,0.0001571301,0.0002813341,0.002254459,0.0006827219,0.002934344,0.001977099,0.0006739263,0.0001401557],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9868148,0.0001634255,0.0006051086,0.005250033,0.005975073,0.0004871854,8.546754e-7,0.00001136113,0.0006921482],"genre_scores_gemma":[0.991761,0.0001407193,0.004455931,0.001607549,0.001850974,0.0000100535,0.00002765419,0.00001938975,0.0001266888],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9246488,"threshold_uncertainty_score":0.9680995,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03633261114153057,"score_gpt":0.4046097787321888,"score_spread":0.3682771675906583,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}