{"id":"W1997326164","doi":"10.1186/1472-6920-13-61","title":"Arthroscopic proficiency: methods in evaluating competency","year":2013,"lang":"en","type":"article","venue":"BMC Medical Education","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":50,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; Toronto Western Hospital","funders":"","keywords":"Arthroscopy; Competence (human resources); MEDLINE; Medical physics; Medicine; Psychomotor learning; Educational measurement; Computer science; Surgery; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001080862,0.00007886044,0.0001788243,0.0001061276,0.00003972118,0.0000147812,0.00005911609,0.00009686624,0.009939058],"category_scores_gemma":[0.006438557,0.00006205919,0.00003943321,0.0003286128,0.00005801753,0.00007566767,0.00001660542,0.0002032345,0.0002087203],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006160433,"about_ca_system_score_gemma":0.002554853,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001011071,"about_ca_topic_score_gemma":0.00002135005,"domain_scores_codex":[0.998563,0.0002349318,0.0003566695,0.0002000933,0.0004600583,0.0001852674],"domain_scores_gemma":[0.9988679,0.0005273367,0.00005967575,0.0001490031,0.000113497,0.0002825947],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00001425786,0.0005481195,0.2102643,0.0001100233,0.00000437875,8.72656e-7,0.0006574875,0.00001535181,0.0003629923,0.003090924,0.0001495925,0.7847817],"study_design_scores_gemma":[0.002436679,0.000145929,0.8867441,0.0005046882,0.00001747955,0.00001436474,0.001096481,0.1042628,0.0001398304,0.003139052,0.001374465,0.0001240828],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9599179,0.0002703784,0.008069837,0.00224657,0.0006113169,0.0006335714,7.123329e-8,0.00006045207,0.02818992],"genre_scores_gemma":[0.8906678,0.000007482208,0.1065208,0.001959771,0.0001819222,0.0001410766,0.00001656191,0.000008963691,0.0004955911],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7846576,"threshold_uncertainty_score":0.990966,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09696292795150178,"score_gpt":0.504179515529718,"score_spread":0.4072165875782162,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}