{"id":"W2766420476","doi":"10.1007/s10459-017-9800-3","title":"Applying Kane’s validity framework to a simulation based assessment of clinical competence","year":2017,"lang":"en","type":"article","venue":"Advances in Health Sciences Education","topic":"Simulation-Based Education in Healthcare","field":"Medicine","cited_by":58,"is_retracted":false,"has_abstract":false,"ca_institutions":"Sunnybrook Hospital; The Wilson Centre; Regional Municipality of Durham; University of Toronto; Health Sciences North; University Health Network","funders":"","keywords":"Generalizability theory; Competence (human resources); Extrapolation; Computer science; Inference; Psychology; Generalization; Reliability (semiconductor); External validity; Applied psychology; Machine learning; Statistics; Artificial intelligence; Social psychology; Mathematics; Developmental psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004101817,0.0001392863,0.0004512075,0.0003264117,0.0006777992,0.00005099399,0.000380009,0.0001001846,0.00006860602],"category_scores_gemma":[0.004195491,0.0001357549,0.00006441506,0.0005775993,0.0003351459,0.00055801,0.00003548047,0.0003193245,0.000007260296],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004185207,"about_ca_system_score_gemma":0.008094453,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008771482,"about_ca_topic_score_gemma":0.0001108482,"domain_scores_codex":[0.9967485,0.0002858793,0.001345837,0.0005714318,0.0006980626,0.0003502613],"domain_scores_gemma":[0.9938086,0.003166041,0.001270731,0.0008314356,0.000561052,0.0003621604],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002599116,0.0002637223,0.8438317,0.0004430834,8.988008e-7,1.211705e-7,0.0003337583,0.109524,0.000001855546,0.00212394,0.00001425316,0.04343665],"study_design_scores_gemma":[0.000270977,0.0004532067,0.8600408,0.001343432,0.000004816009,5.784299e-7,0.000897628,0.1322945,0.00001561315,0.002444626,0.002127641,0.0001061767],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8973475,0.000869001,0.06570079,0.02244643,0.007548149,0.004386753,0.00001033888,0.00006376922,0.001627335],"genre_scores_gemma":[0.8447375,0.0001109856,0.1512852,0.003136906,0.0003597318,0.0003320788,0.00001451187,0.000008833927,0.00001431797],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.08558437,"threshold_uncertainty_score":0.9975287,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2006527513812708,"score_gpt":0.6114210962764035,"score_spread":0.4107683448951327,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}