{"id":"W2972902261","doi":"10.1007/s00464-019-07089-y","title":"Video-based assessment for laparoscopic fundoplication: initial development of a robust tool for operative performance assessment","year":2019,"lang":"en","type":"article","venue":"Surgical Endoscopy","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":31,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University","funders":"","keywords":"Medicine; Competence (human resources); Medical physics; Computer science; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005149837,0.0002039208,0.0005516749,0.00008754843,0.0001310104,0.0000259221,0.00009540911,0.0001075329,0.0008956647],"category_scores_gemma":[0.0000484065,0.0001660042,0.000165816,0.000175527,0.00005176431,0.00009791803,0.00002618583,0.0001507784,0.00001431676],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001937246,"about_ca_system_score_gemma":0.0007544441,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000002028429,"about_ca_topic_score_gemma":0.00000111404,"domain_scores_codex":[0.9982391,0.00004334898,0.0006253389,0.0003861862,0.0003830326,0.0003229819],"domain_scores_gemma":[0.9982936,0.0008621085,0.0001551266,0.0002441627,0.0003114276,0.000133547],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.03742507,0.007780555,0.5551696,0.008570992,0.001934211,0.00004369208,0.002312174,0.05614263,0.008502528,0.07816139,0.0003405592,0.2436166],"study_design_scores_gemma":[0.2629437,0.004606016,0.1174299,0.001141362,0.0002610853,0.00001257625,0.0003462585,0.2978343,0.108052,0.000112153,0.2062603,0.00100026],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9608141,0.00002076339,0.02619555,0.0002784154,0.0002462144,0.002494233,0.00003062607,0.00006039349,0.009859714],"genre_scores_gemma":[0.9073083,0.000002335254,0.09088477,0.000233122,0.0001024088,0.000795524,0.0002938354,0.00002444421,0.0003552518],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4377396,"threshold_uncertainty_score":0.9806901,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05171052594489051,"score_gpt":0.3929129256454811,"score_spread":0.3412023997005906,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}