{"id":"W4295214727","doi":"10.4103/ehp.ehp_3_22","title":"A Mixed-Methods, Validity Informed Evaluation of a Virtual OSCE for Undergraduate Medicine Clerkship","year":2022,"lang":"en","type":"article","venue":"Education in the Health Professions","topic":"Innovations in Medical Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Thematic analysis; Objective structured clinical examination; Summative assessment; Medical education; Descriptive statistics; Stakeholder; Content validity; Psychology; Medicine; Qualitative research; Psychometrics; Clinical psychology; Formative assessment; Pedagogy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02127881,0.0001294008,0.0003165684,0.0005101957,0.0007520578,0.000004365445,0.0002573234,0.00007333335,0.000342581],"category_scores_gemma":[0.01174108,0.0000952254,0.00005501727,0.001595451,0.0001440644,0.00008402755,0.0000588753,0.0006817352,0.000003799294],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001099634,"about_ca_system_score_gemma":0.01478805,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001900235,"about_ca_topic_score_gemma":0.00004217913,"domain_scores_codex":[0.9941675,0.003052371,0.001075359,0.0002476424,0.001147582,0.0003095203],"domain_scores_gemma":[0.9962532,0.00150322,0.0007080499,0.0005953576,0.0008555931,0.00008459936],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"qualitative","study_design_scores_codex":[0.0001918651,0.002073116,0.002494992,0.0006072521,0.00002059656,5.998942e-8,0.03576972,0.00005674102,0.00008870446,0.05610193,0.4694344,0.4331606],"study_design_scores_gemma":[0.007395866,0.00360066,0.1912708,0.001738976,0.0003543752,0.00006986455,0.5182863,0.009847476,0.0001146973,0.1026268,0.1643311,0.0003631649],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5109944,0.0004884102,0.01266833,0.4548942,0.01050868,0.008434841,0.00002188965,0.00005305924,0.001936242],"genre_scores_gemma":[0.9572446,0.00004048953,0.02005966,0.01413365,0.0004880888,0.006230913,0.0007337427,0.00002313148,0.001045696],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4825165,"threshold_uncertainty_score":0.9965835,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2562007022104031,"score_gpt":0.5765591051616675,"score_spread":0.3203584029512644,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}