{"id":"W4294991525","doi":"10.3352/jeehp.2022.19.26","title":"Acceptability of the 8-case objective structured clinical examination of medical students in Korea using generalizability theory: a reliability study","year":2022,"lang":"en","type":"article","venue":"Journal of Educational Evaluation for Health Professions","topic":"Innovations in Medical Education","field":"Medicine","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Generalizability theory; Reliability (semiconductor); Objective structured clinical examination; Statistics; Psychology; Variance components; Medicine; Mathematics; Medical education","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03561888,0.000364424,0.0003731743,0.001474311,0.0005078425,0.0009338128,0.0006935053,0.0005116077,0.0006566835],"category_scores_gemma":[0.089927,0.0003147601,0.0010117,0.0008446589,0.001162417,0.001178275,0.001628975,0.0006768523,0.0001528278],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009009161,"about_ca_system_score_gemma":0.001218095,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001236798,"about_ca_topic_score_gemma":0.001820947,"domain_scores_codex":[0.9783343,0.01265461,0.002682577,0.001600037,0.004242549,0.0004860458],"domain_scores_gemma":[0.9241998,0.03607918,0.01352022,0.008440002,0.01642092,0.001339849],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002526893,0.0002209603,0.9683408,0.0001187367,0.0001475715,0.00006999583,0.005814797,0.0003957377,0.0008584018,0.0001764954,0.0001687658,0.02343499],"study_design_scores_gemma":[0.00003113487,0.001230631,0.9864917,0.00009950587,0.0001271623,0.0002787389,0.005420542,0.00393379,0.001083076,0.0002646406,0.001005877,0.00003328337],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.99717,0.00007176429,0.001708422,0.00007302383,0.00001521201,0.0001356052,0.00004116905,0.00001063694,0.0007742026],"genre_scores_gemma":[0.9984328,0.00002735663,0.001280707,0.00001872558,0.000006373624,0.00009087496,0.00006806531,0.000004255384,0.00007077766],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03561888,"threshold_uncertainty_score":0.1883729,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1615378778704149,"score_gpt":0.599957094874539,"score_spread":0.4384192170041241,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}