{"id":"W2419434607","doi":"10.1016/j.amjsurg.2016.03.005","title":"Assessment of technical and nontechnical skills in surgical residents","year":2016,"lang":"en","type":"article","venue":"The American Journal of Surgery","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":14,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Competence (human resources); Internal consistency; Reliability (semiconductor); Medical education; Medicine; Competency assessment; Psychology; Psychometrics; Clinical psychology; Social psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001783355,0.0000786618,0.0006123691,0.0001948745,0.00001624837,0.000004464132,0.00007261484,0.00002972012,0.00006975506],"category_scores_gemma":[0.0004444146,0.00003643891,0.000166395,0.0003029555,0.0004877819,0.0000547453,0.00003595086,0.0002161478,9.102183e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005027083,"about_ca_system_score_gemma":0.0001222056,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001204004,"about_ca_topic_score_gemma":9.760532e-7,"domain_scores_codex":[0.9985489,0.0001637877,0.0006638489,0.00008863525,0.0003827864,0.0001520411],"domain_scores_gemma":[0.9957826,0.003409224,0.0004509403,0.0001375543,0.00009177255,0.0001279594],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0005014509,0.0001837589,0.8482466,0.00000571969,0.00003517261,0.0003386841,0.00001445716,0.000003133697,0.00150345,0.0001514895,0.00003434627,0.1489817],"study_design_scores_gemma":[0.001206117,0.0001689083,0.9964944,0.0004842832,0.00002488062,0.0007452702,0.0000509559,0.000007662883,0.0001261704,0.0001157511,0.00052736,0.00004830554],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9966545,0.00009308322,0.0001518425,0.001860781,0.00004579631,0.00004773615,9.552359e-7,0.000007083608,0.00113824],"genre_scores_gemma":[0.9990072,0.0004343834,0.0003081463,0.0001407317,0.00007151555,0.000001003738,1.725324e-7,0.000008233308,0.00002859964],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1489334,"threshold_uncertainty_score":0.1797253,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02945821272138298,"score_gpt":0.3522304336276988,"score_spread":0.3227722209063158,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}