{"id":"W971963990","doi":"10.1503/cjs.010614","title":"Evaluating the reliability of surgical assessment methods in an orthopedic residency program","year":2015,"lang":"en","type":"article","venue":"Canadian Journal of Surgery","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Inter-rater reliability; Medicine; Cronbach's alpha; Orthopedic surgery; Reliability (semiconductor); Medical education; Intra-rater reliability; Physical therapy; Family medicine; Medical physics; Confidence interval; Surgery; Psychometrics; Psychology; Clinical psychology; Rating scale; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01386992,0.00008406885,0.0004228066,0.0002855148,0.00004294937,0.00002095897,0.00008086525,0.00007279153,0.0002248517],"category_scores_gemma":[0.002921961,0.00005370807,0.0001612427,0.0004634124,0.0001282514,0.0001349414,0.000006934576,0.0004026564,5.579087e-7],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001959474,"about_ca_system_score_gemma":0.006543645,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001276576,"about_ca_topic_score_gemma":0.00141363,"domain_scores_codex":[0.9974703,0.000935505,0.0008341673,0.0001106854,0.0004094159,0.0002399409],"domain_scores_gemma":[0.9963315,0.001667824,0.0002953295,0.0001985181,0.0006140641,0.0008927927],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00008863422,0.00006095563,0.7895745,0.00001636558,0.00001336909,0.0004300233,0.0003062692,0.0006221444,0.000005884367,0.00006581181,0.00007892075,0.2087371],"study_design_scores_gemma":[0.002049606,0.0006971663,0.974225,0.0003263807,0.00007078224,0.0003271251,0.001074899,0.005834241,0.0000199596,0.0008832935,0.01437788,0.0001136093],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9952191,0.0003812027,0.00005397423,0.001799447,0.0003112339,0.0001713352,0.000001079367,0.000005580952,0.002057053],"genre_scores_gemma":[0.9884741,0.0000111196,0.0112175,0.00009431447,0.0001563721,0.000004011319,0.000003031596,0.00000975201,0.00002978353],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2086235,"threshold_uncertainty_score":0.9990883,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3569495608508862,"score_gpt":0.5348872314008267,"score_spread":0.1779376705499405,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}