{"id":"W4284891285","doi":"10.3138/jvme-2021-0164","title":"Excellent Agreement of In-Person Scoring versus Scoring of Digitally Recorded Simulated Suture Skills Examination","year":2022,"lang":"en","type":"article","venue":"Journal of Veterinary Medical Education","topic":"Simulation-Based Education in Healthcare","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Guelph","funders":"","keywords":"Rubric; Concordance; Medical physics; Psychology; Medical education; Medicine; Physical therapy; Mathematics education","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01971237,0.0003956084,0.0004684085,0.001527116,0.0003988302,0.00109081,0.0007535248,0.0004973533,0.001587178],"category_scores_gemma":[0.06146172,0.0003211146,0.0005414186,0.0006588098,0.0007489834,0.0006836392,0.001926153,0.0004207246,0.00117142],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004384197,"about_ca_system_score_gemma":0.0002965522,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00117492,"about_ca_topic_score_gemma":0.002230359,"domain_scores_codex":[0.9660555,0.01742152,0.004363847,0.004333384,0.006987478,0.0008382986],"domain_scores_gemma":[0.9140849,0.03898389,0.009331389,0.01354163,0.02280272,0.001255503],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.004132376,0.0005253245,0.754639,0.0006632079,0.001010231,0.0004885741,0.01221473,0.002692493,0.05374701,0.0007597769,0.002040423,0.1670869],"study_design_scores_gemma":[0.0000886246,0.002504352,0.931918,0.0001904907,0.0003293488,0.001228879,0.003470053,0.0129215,0.04013417,0.0006975374,0.006383075,0.0001339519],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9618647,0.0004052129,0.02722307,0.00007995413,0.0001789193,0.0002475053,0.000311028,0.0002620918,0.009427536],"genre_scores_gemma":[0.9900718,0.00009607064,0.008048737,0.00004533647,0.00003234041,0.00007306982,0.0002469583,0.00005577369,0.001329911],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01971237,"threshold_uncertainty_score":0.1042503,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09468450453581334,"score_gpt":0.4077932583155504,"score_spread":0.313108753779737,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}