{"id":"W2900696773","doi":"10.1111/medu.13749","title":"The challenges of detecting progress in generic competencies in the clinical setting","year":2018,"lang":"en","type":"article","venue":"Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"Medical Council of Canada","keywords":"Medical education; Harm; Psychology; Focus group; Variance (accounting); Educational measurement; Quarter (Canadian coin); Medicine; Curriculum; Social psychology; Pedagogy; Sociology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1003611,0.000843512,0.001096601,0.003336539,0.001178274,0.003427411,0.00226915,0.00167331,0.001440509],"category_scores_gemma":[0.262941,0.0007602974,0.0008467056,0.002334925,0.002826049,0.003512865,0.003753175,0.00151126,0.0007972859],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001356264,"about_ca_system_score_gemma":0.00294301,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004435917,"about_ca_topic_score_gemma":0.006687328,"domain_scores_codex":[0.8817345,0.07156138,0.01609931,0.007211972,0.02102442,0.002368435],"domain_scores_gemma":[0.6746455,0.227342,0.04988417,0.01831863,0.02641613,0.003393599],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"qualitative","study_design_scores_codex":[0.0003595767,0.000307093,0.8617641,0.001291027,0.0002316785,0.0002209988,0.007557672,0.001232458,0.001484536,0.0006927579,0.001065899,0.1237922],"study_design_scores_gemma":[0.00004355949,0.00174963,0.968179,0.001249301,0.0001358553,0.001063115,0.009370667,0.006395794,0.004228241,0.003159216,0.004334329,0.0000913821],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9652789,0.002449025,0.02300161,0.00157155,0.0001777198,0.0007049631,0.0005781651,0.0001462098,0.006091942],"genre_scores_gemma":[0.9735008,0.0006469719,0.0240047,0.0002616555,0.00009893423,0.0007159992,0.0002236355,0.00002572921,0.0005215464],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8996389,"threshold_uncertainty_score":0.5307667,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04880348104982502,"score_gpt":0.4266068501876926,"score_spread":0.3778033691378676,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}