{"id":"W4406013678","doi":"10.1371/journal.pone.0313021","title":"Misbehavior or misalignment? Examining the drift towards bureaucratic box-ticking in Competency-Based Medical Education","year":2025,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Innovations in Medical Education","field":"Medicine","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Northern British Columbia; University of Alberta","funders":"University of Alberta","keywords":"Summative assessment; Formative assessment; Context (archaeology); Medical education; Bureaucracy; Process (computing); Psychology; Qualitative research; Medicine; Political science; Pedagogy; Computer science; Sociology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04339841,0.0003641807,0.0005531757,0.001883112,0.006518342,0.006435778,0.001686068,0.001431592,0.0009463094],"category_scores_gemma":[0.1190118,0.0008478957,0.0004544084,0.001661352,0.009411687,0.00614718,0.006410226,0.00369038,0.0002763444],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.008473585,"about_ca_system_score_gemma":0.01030139,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01615073,"about_ca_topic_score_gemma":0.0257142,"domain_scores_codex":[0.9388487,0.04216314,0.003004721,0.002356288,0.01045905,0.003167957],"domain_scores_gemma":[0.9068556,0.03517422,0.03592158,0.00653855,0.01101896,0.00449114],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.00007761996,0.0001392011,0.1832239,0.0001859142,0.00004404868,0.000297813,0.7738715,0.000169204,0.0006114517,0.00207711,0.0007751792,0.03852712],"study_design_scores_gemma":[0.000006844195,0.0002705887,0.1200268,0.0004780729,0.00002591415,0.000335719,0.8669388,0.0008212621,0.0007660786,0.00154919,0.008709329,0.00007132589],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9912134,0.0005029367,0.002666472,0.003394842,0.0000520894,0.00005101618,0.00001998432,0.00002481457,0.002074498],"genre_scores_gemma":[0.9975857,0.0002382519,0.001230333,0.0005049278,0.00001284283,0.00003338457,0.00001715366,0.00001321297,0.0003642803],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04339841,"threshold_uncertainty_score":0.2295155,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05393605348317221,"score_gpt":0.3486104945111508,"score_spread":0.2946744410279786,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}