{"id":"W2914256565","doi":"10.1097/acm.0000000000002620","title":"Defining and Adopting Clinical Performance Measures in Graduate Medical Education: Where Are We Now and Where Are We Going?","year":2019,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Primary Care and Health Outcomes","field":"Health Professions","cited_by":60,"is_retracted":false,"has_abstract":true,"ca_institutions":"Institute of Health Services and Policy Research; McGill University Health Centre; Western University","funders":"","keywords":"Specialty; Graduate medical education; Medical education; Quality (philosophy); Health care; Quality management; Medicine; Psychology; Family medicine; Accreditation; Business; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.004748376,0.0002772727,0.0009372827,0.0001909801,0.0003482792,0.00000439322,0.0002864368,0.0008719648,0.000534219],"category_scores_gemma":[0.001406107,0.0002102606,0.00003312927,0.0002746549,0.0002314228,0.0002316452,0.0002535351,0.004486866,0.0001527916],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001905666,"about_ca_system_score_gemma":0.002079907,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001195351,"about_ca_topic_score_gemma":0.001141799,"domain_scores_codex":[0.9958341,0.0006207827,0.001536177,0.0005588976,0.0007516061,0.0006984644],"domain_scores_gemma":[0.9960549,0.00217512,0.0006756801,0.0003240752,0.0001615681,0.0006086392],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00005513558,0.000007958009,0.7632993,0.001997183,0.00001035133,0.000006026219,0.002817146,2.104018e-7,0.000001389396,0.0002111887,0.1971748,0.03441923],"study_design_scores_gemma":[0.002907405,0.0001708355,0.5055331,0.0197796,0.00004568075,0.0000384758,0.01850381,0.0002920072,4.974036e-7,0.0002904446,0.4521712,0.0002669289],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5682234,0.0818235,0.00001807916,0.3441215,0.001878036,0.0006026665,0.000003398224,0.00007563028,0.003253805],"genre_scores_gemma":[0.5361536,0.4152371,0.0001789619,0.04321581,0.001659327,0.00007409413,0.0000114785,0.00004323969,0.003426391],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3334136,"threshold_uncertainty_score":0.9978098,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1481214392543131,"score_gpt":0.4814540497308858,"score_spread":0.3333326104765727,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}