{"id":"W3099298482","doi":"10.1007/s00464-020-08152-9","title":"Development and prospective validation of a scoring system for the Basic Endoscopic Skills Training (BEST) box","year":2020,"lang":"en","type":"article","venue":"Surgical Endoscopy","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":5,"is_retracted":false,"has_abstract":false,"ca_institutions":"Toronto General Hospital; University of Toronto; University Health Network","funders":"Society of American Gastrointestinal and Endoscopic Surgeons","keywords":"Medicine; Receiver operating characteristic; Endoscopy; Prospective cohort study; Retrospective cohort study; Logistic regression; Medical physics; Surgery; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02969915,0.0007523252,0.0009036668,0.004113385,0.001462996,0.001927363,0.001791586,0.001594869,0.005926098],"category_scores_gemma":[0.04259347,0.0007215879,0.001221666,0.00148144,0.001104092,0.001930489,0.002489589,0.001109069,0.002911064],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001584018,"about_ca_system_score_gemma":0.003496753,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003812147,"about_ca_topic_score_gemma":0.006091597,"domain_scores_codex":[0.9820473,0.005878473,0.002067377,0.001454778,0.007745932,0.0008061742],"domain_scores_gemma":[0.935141,0.0147441,0.005661513,0.005802044,0.03709731,0.001554081],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001909151,0.001887215,0.7855303,0.0003278831,0.0002465919,0.000092518,0.0007091656,0.002314841,0.008564623,0.001464222,0.01274547,0.184208],"study_design_scores_gemma":[0.0004568804,0.003666956,0.9483609,0.0003733363,0.0002350399,0.0006943528,0.0006944701,0.01414854,0.01362546,0.0008330049,0.01677283,0.0001381015],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8775095,0.001129934,0.08188499,0.001205353,0.0008856417,0.01076401,0.008645733,0.001004866,0.01697],"genre_scores_gemma":[0.7881942,0.0005354906,0.1764639,0.0004873676,0.000167352,0.011223,0.01173257,0.0003788672,0.01081714],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02969915,"threshold_uncertainty_score":0.157066,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0512484015725226,"score_gpt":0.3064515041708012,"score_spread":0.2552031025982786,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}