{"id":"W2900696773","doi":"10.1111/medu.13749","title":"The challenges of detecting progress in generic competencies in the clinical setting","year":2018,"lang":"en","type":"article","venue":"Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"Medical Council of Canada","keywords":"Medical education; Harm; Psychology; Focus group; Variance (accounting); Educational measurement; Quarter (Canadian coin); Medicine; Curriculum; Social psychology; Pedagogy; Sociology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.006435825,0.00008167403,0.0001747171,0.0001304368,0.000116501,0.00001141564,0.0002747012,0.0001424383,0.0000471154],"category_scores_gemma":[0.01374249,0.00004634555,0.00003602852,0.0007441237,0.0007728832,0.00004430495,0.00003505624,0.000559045,0.000009642054],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007744769,"about_ca_system_score_gemma":0.001421353,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003980075,"about_ca_topic_score_gemma":0.0002306758,"domain_scores_codex":[0.9978185,0.0003362022,0.0007641814,0.0001875795,0.0006735876,0.0002199885],"domain_scores_gemma":[0.998515,0.0006021184,0.0002033155,0.0003576607,0.0002871314,0.00003484187],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00002060166,0.0005384553,0.1106153,0.00006374466,0.000006034086,0.000001231029,0.004290228,5.265458e-8,0.000006065174,0.002792858,0.002648918,0.8790165],"study_design_scores_gemma":[0.0006335989,0.0003004896,0.9445544,0.0007345608,0.00001936987,0.0000634168,0.03010814,0.002232788,0.00006669142,0.0009991715,0.02019812,0.00008925291],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9068811,0.002422634,0.00004654768,0.08781783,0.001269366,0.000358575,9.326619e-8,0.00001355424,0.001190273],"genre_scores_gemma":[0.9917492,0.0002342909,0.002406738,0.00422695,0.001223699,0.0001279954,0.000005106903,0.000008819428,0.00001720517],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8789272,"threshold_uncertainty_score":0.9945652,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04880348104982502,"score_gpt":0.4266068501876926,"score_spread":0.3778033691378676,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}