{"id":"W2130963076","doi":"10.1016/j.jamcollsurg.2014.03.051","title":"A Global Delphi Consensus Study on Defining and Measuring Quality in Surgical Training","year":2014,"lang":"en","type":"article","venue":"Journal of the American College of Surgeons","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":42,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"National Institute for Health and Care Research","keywords":"Medicine; Trainer; Delphi method; Quality (philosophy); Likert scale; Delphi; Cronbach's alpha; Medical education; Scale (ratio); Medical physics; Psychology; Psychometrics; Computer science; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.365834,0.001469237,0.001669144,0.006194663,0.005259851,0.003998965,0.002817654,0.003583802,0.002771155],"category_scores_gemma":[0.2580507,0.001294398,0.00213054,0.004693039,0.007551764,0.005429307,0.01345582,0.003691345,0.0004451374],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01174178,"about_ca_system_score_gemma":0.03036312,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00287852,"about_ca_topic_score_gemma":0.002431827,"domain_scores_codex":[0.5621855,0.3807596,0.02364265,0.005663056,0.01952473,0.008224515],"domain_scores_gemma":[0.6637278,0.2602072,0.008657219,0.008541815,0.05500254,0.003863368],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.001066765,0.0005722326,0.01750873,0.01376179,0.0004330798,0.001100334,0.6981788,0.004457069,0.006436768,0.02918084,0.007682133,0.2196215],"study_design_scores_gemma":[0.0005842275,0.002797534,0.02692596,0.01766052,0.0003977958,0.001125877,0.8431351,0.0115999,0.005924009,0.03302169,0.05639639,0.0004310579],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6832877,0.005500097,0.1860921,0.01780093,0.001075022,0.05261796,0.0007283766,0.0001853794,0.05271236],"genre_scores_gemma":[0.8601078,0.002543799,0.09837672,0.00273852,0.00009929638,0.03434183,0.0003465619,0.00006562044,0.001379944],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.634166,"threshold_uncertainty_score":0.7820395,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07474428196894926,"score_gpt":0.3482183023058162,"score_spread":0.2734740203368669,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}