{"id":"W2143310255","doi":"10.1016/j.amjsurg.2006.01.041","title":"Self-assessment during a 2-day laparoscopic colectomy course: can surgeons judge how well they are learning new skills?","year":2006,"lang":"en","type":"article","venue":"The American Journal of Surgery","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":49,"is_retracted":false,"has_abstract":false,"ca_institutions":"St. Paul's Hospital; University of British Columbia","funders":"","keywords":"Credentialing; Inter-rater reliability; Medicine; Rating scale; Physical therapy; Psychology; Medical physics; Medical education","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001123996,0.0002146973,0.0008804084,0.0002076042,0.0002249967,0.00007541367,0.0001213695,0.00003621457,0.0001414611],"category_scores_gemma":[0.0001181734,0.0001439472,0.0003621898,0.000501302,0.0001241128,0.00009278696,0.00002856843,0.0006528783,0.000007917547],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001791673,"about_ca_system_score_gemma":0.0006298531,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002363773,"about_ca_topic_score_gemma":0.00003307066,"domain_scores_codex":[0.9978892,0.0003831342,0.0005289661,0.0001700412,0.0005902434,0.0004383846],"domain_scores_gemma":[0.9965591,0.001575021,0.001168209,0.0002057474,0.0001892732,0.000302614],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001570845,0.0002432759,0.9907585,0.00002146922,0.0002388485,0.0004276108,0.0002628016,0.001036199,0.0002092389,0.00002317902,0.0007179314,0.005903841],"study_design_scores_gemma":[0.001742044,0.00009914798,0.9874583,0.000268599,0.0002027287,0.0004175675,0.001343478,0.0001668157,0.0002223625,0.0000339696,0.007871541,0.0001734123],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9911727,0.0001914614,0.00009261356,0.007182044,0.0002756553,0.0001079823,0.000001634871,0.00006911628,0.0009068213],"genre_scores_gemma":[0.9978756,0.000131866,0.0001859153,0.0004027778,0.000533174,0.000002500373,0.000004244476,0.00003870047,0.0008252679],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.00715361,"threshold_uncertainty_score":0.5869995,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01283966292701463,"score_gpt":0.27254080410865,"score_spread":0.2597011411816353,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}