{"id":"W2921565575","doi":"10.2106/jbjs.17.01512","title":"Resident Surgical Skills Web-Based Evaluation","year":2019,"lang":"en","type":"article","venue":"Journal of Bone and Joint Surgery","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":29,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Medicine; Summative assessment; Physical therapy; Curriculum; Surgery; Medical education; Formative assessment; Psychology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006058036,0.0003397211,0.0003002048,0.001577328,0.0002080276,0.0005360909,0.0004372281,0.0001900944,0.004976576],"category_scores_gemma":[0.02129006,0.0001193099,0.0003545269,0.0007945033,0.0002312199,0.0006016922,0.0009213572,0.000275774,0.001302654],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006165104,"about_ca_system_score_gemma":0.0009803276,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009498834,"about_ca_topic_score_gemma":0.002105227,"domain_scores_codex":[0.9921135,0.003696785,0.0009199735,0.0003197164,0.002646798,0.0003032958],"domain_scores_gemma":[0.9772044,0.007222111,0.005261581,0.000719141,0.008054696,0.00153807],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001709232,0.001282116,0.6413811,0.0005849723,0.0001658246,0.0001546006,0.0009265303,0.001517891,0.003119022,0.0002155823,0.006897396,0.3420457],"study_design_scores_gemma":[0.0002121669,0.003668792,0.9717249,0.000303882,0.00008423487,0.0008937467,0.0009024421,0.004981365,0.007064262,0.00025761,0.009840403,0.00006617657],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9773521,0.0006868016,0.007147477,0.0002917511,0.00005268778,0.000846983,0.001324056,0.0002862408,0.01201205],"genre_scores_gemma":[0.984091,0.0004443723,0.01146192,0.0001124849,0.0000522533,0.0007105111,0.001257412,0.00002927147,0.001840833],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006058036,"threshold_uncertainty_score":0.03203833,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03485624686203842,"score_gpt":0.3189195288503497,"score_spread":0.2840632819883113,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}