{"id":"W2775801178","doi":"10.1080/10401334.2017.1387553","title":"Assessing the Validity of a Multidisciplinary Mini-Clinical Evaluation Exercise","year":2017,"lang":"en","type":"article","venue":"Teaching and Learning in Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"University of Ottawa","keywords":"Generalizability theory; Context (archaeology); Multidisciplinary approach; Medicine; Psychology; Construct validity; Medical education; Family medicine; Clinical psychology; Psychometrics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02375648,0.0004670965,0.000620966,0.00201824,0.0006353247,0.001259937,0.0008702376,0.0007141995,0.001127193],"category_scores_gemma":[0.1101683,0.000325613,0.001053094,0.001089016,0.001091202,0.001470858,0.002532944,0.0008209813,0.0002289555],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008743011,"about_ca_system_score_gemma":0.002106463,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006183459,"about_ca_topic_score_gemma":0.001422306,"domain_scores_codex":[0.9847306,0.006676906,0.002006765,0.0009783917,0.005111701,0.0004955801],"domain_scores_gemma":[0.8851261,0.05570857,0.02851716,0.007730855,0.01979177,0.003125472],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004444915,0.0008630793,0.9318041,0.0002480475,0.0002077674,0.00004089544,0.001360606,0.0003882837,0.001525556,0.0003936899,0.0004122694,0.06231124],"study_design_scores_gemma":[0.00005278781,0.001141472,0.9926549,0.0001722161,0.0000496489,0.0001494764,0.0009323345,0.002225063,0.001344332,0.0002761832,0.000976118,0.00002545218],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9913796,0.0002261996,0.00427512,0.000195912,0.00004123142,0.0006182782,0.0001046997,0.00003932547,0.00311963],"genre_scores_gemma":[0.9881292,0.0001187416,0.01022711,0.00009214918,0.00002496231,0.0008728328,0.0002326689,0.000009358214,0.0002929447],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9762435,"threshold_uncertainty_score":0.1256378,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1609857727974281,"score_gpt":0.5213988753121205,"score_spread":0.3604131025146924,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}