{"id":"W2951405082","doi":"10.1016/j.jsurg.2019.05.015","title":"Artificial Intelligence in Medical Education: Best Practices Using Machine Learning to Assess Surgical Expertise in Virtual Reality Simulation","year":2019,"lang":"en","type":"article","venue":"Journal of surgical education","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":283,"is_retracted":false,"has_abstract":false,"ca_institutions":"Montreal General Hospital; Montreal Neurological Institute and Hospital; McGill University","funders":"Montreal Neurological Institute and Hospital; Royal College of Physicians and Surgeons of Canada; McGill University; Williams","keywords":"Virtual reality; Checklist; Computer science; Artificial intelligence; Quality (philosophy); Psychomotor learning; Field (mathematics); Machine learning; Medicine; Psychology; Cognition","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01421024,0.00064872,0.0006776578,0.003773298,0.000651394,0.003578145,0.001868549,0.001273509,0.001242817],"category_scores_gemma":[0.05066212,0.000273293,0.0005706906,0.001676823,0.001236845,0.002088525,0.001613078,0.00152456,0.0005418791],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001576104,"about_ca_system_score_gemma":0.003016384,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004894369,"about_ca_topic_score_gemma":0.007533285,"domain_scores_codex":[0.9860764,0.008004574,0.001408987,0.0008597851,0.003375504,0.000274796],"domain_scores_gemma":[0.9630162,0.02060601,0.002388499,0.002416767,0.01051242,0.001060118],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003277051,0.0009204171,0.06420473,0.0007026581,0.0002780271,0.00007528223,0.001233699,0.009968393,0.002157991,0.003021909,0.002702013,0.9144072],"study_design_scores_gemma":[0.0004341702,0.005652193,0.3285072,0.01349323,0.001488978,0.003110716,0.009557775,0.4073935,0.0604048,0.08462053,0.08435248,0.0009844602],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.4788426,0.029813,0.4107011,0.02267798,0.0009623044,0.001137307,0.0004580098,0.001476065,0.05393167],"genre_scores_gemma":[0.7859245,0.005525267,0.2059687,0.0009273422,0.0001172114,0.0001927421,0.0001168868,0.00006686842,0.001160564],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01421024,"threshold_uncertainty_score":0.0751518,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1747863888737946,"score_gpt":0.4830863517665958,"score_spread":0.3082999628928011,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}