{"id":"W2775801178","doi":"10.1080/10401334.2017.1387553","title":"Assessing the Validity of a Multidisciplinary Mini-Clinical Evaluation Exercise","year":2017,"lang":"en","type":"article","venue":"Teaching and Learning in Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"University of Ottawa","keywords":"Generalizability theory; Context (archaeology); Multidisciplinary approach; Medicine; Psychology; Construct validity; Medical education; Family medicine; Clinical psychology; Psychometrics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02650838,0.0001018165,0.0003638545,0.0001309961,0.0008938502,0.00002892964,0.0001491843,0.0001077995,0.00006029458],"category_scores_gemma":[0.04475729,0.00006354557,0.0000335469,0.00008251843,0.0006286402,0.0001521961,0.00007469355,0.001966717,0.000002132641],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004533964,"about_ca_system_score_gemma":0.0001463258,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000284529,"about_ca_topic_score_gemma":0.000004423016,"domain_scores_codex":[0.9976224,0.0008955681,0.0005769119,0.0002301105,0.0005285312,0.0001464209],"domain_scores_gemma":[0.9981425,0.0007350036,0.0004408188,0.0004706686,0.0001644402,0.00004651101],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00002298733,0.0001196412,0.4537627,0.00008218075,0.00001033326,0.00000338819,0.005497905,0.00001485412,0.0001833734,0.00005670422,0.0006510145,0.5395949],"study_design_scores_gemma":[0.001750431,0.0002248143,0.9397287,0.001880163,0.0001687636,0.00001833256,0.00767168,0.04728593,0.000008375966,0.0002136743,0.000988349,0.00006074315],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9793996,0.0002088757,0.0004536879,0.01483128,0.0005073343,0.0003116568,7.947028e-8,0.000024802,0.004262727],"genre_scores_gemma":[0.9946561,0.00006253725,0.004188838,0.0001650164,0.0005024082,0.00001848246,0.000017572,0.00001182416,0.0003772417],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5395342,"threshold_uncertainty_score":0.9632891,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1609857727974281,"score_gpt":0.5213988753121205,"score_spread":0.3604131025146924,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}