{"id":"W4391505767","doi":"10.1016/j.amj.2024.01.004","title":"Correlating Simulation Training and Assessment With Clinical Performance: A Feasibility Study","year":2024,"lang":"en","type":"article","venue":"Air Medical Journal","topic":"Simulation-Based Education in Healthcare","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Toronto; Fanshawe College; St. Michael's Hospital","funders":"","keywords":"Medicine; Odds ratio; Intubation; Confidence interval; Odds; Dash; Logistic regression; Emergency medicine; Retrospective cohort study; Cohort study; Cohort; Physical therapy; Internal medicine; Anesthesia; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003657347,0.0001251504,0.0002947176,0.000121969,0.00023945,0.00003988176,0.00005630477,0.000132153,0.0004429646],"category_scores_gemma":[0.0006637691,0.00008576596,0.00005550002,0.000248605,0.000120313,0.0001752214,0.00002003252,0.001709328,0.000007296535],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002210399,"about_ca_system_score_gemma":0.002826582,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000008931685,"about_ca_topic_score_gemma":0.000003704904,"domain_scores_codex":[0.9973457,0.0002671019,0.0007781113,0.0002905598,0.001092001,0.0002265461],"domain_scores_gemma":[0.9970641,0.001725972,0.0001145716,0.0001598117,0.000267138,0.0006683859],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00009633024,0.0002334293,0.8232957,0.00009546594,0.00006407514,0.0001116854,0.003212982,0.0009813133,2.598863e-7,0.00001344591,0.00003877834,0.1718565],"study_design_scores_gemma":[0.001345512,0.001246245,0.7012076,0.0006768625,0.00008963779,0.0004869871,0.004821454,0.2899,1.725162e-7,0.00003240821,0.0001300816,0.00006297325],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9905421,0.0002477263,0.002904502,0.004269959,0.0009775927,0.0004842823,7.078103e-7,0.00007888363,0.0004942329],"genre_scores_gemma":[0.9961283,0.00003367232,0.001673791,0.0007513007,0.001335727,0.00001053942,0.000006397058,0.00002104929,0.0000392529],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2889187,"threshold_uncertainty_score":0.7426273,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1680748256179949,"score_gpt":0.524506645653074,"score_spread":0.3564318200350791,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}