{"id":"W4281559190","doi":"10.3138/jvme-2022-0011","title":"Validation of a Rubric Used for Skills-Based Assessment of Veterinary Students Performing Simulated Ovariohysterectomy on a Model","year":2022,"lang":"en","type":"article","venue":"Journal of Veterinary Medical Education","topic":"Veterinary Practice and Education Studies","field":"Health Professions","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Rubric; Reliability (semiconductor); Internal consistency; Medical education; Psychology; Medicine; Psychometrics; Mathematics education; Clinical psychology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003407681,0.0001831979,0.0005516955,0.0004946169,0.0004218387,0.000008060536,0.0004143607,0.0001142354,0.0003747741],"category_scores_gemma":[0.001075319,0.0001668891,0.0001941036,0.0003366362,0.00005501811,0.0002979731,0.0001769371,0.0007364071,0.000001501044],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000542452,"about_ca_system_score_gemma":0.004696236,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002975366,"about_ca_topic_score_gemma":4.750289e-7,"domain_scores_codex":[0.995596,0.0009566534,0.001555328,0.0002065884,0.001411489,0.0002739474],"domain_scores_gemma":[0.9951343,0.001538449,0.002151216,0.0002769544,0.0007137528,0.0001853495],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.03820902,0.1067015,0.2961339,0.01993585,0.00331525,0.0002034765,0.1623448,0.1494662,0.131019,0.0008243988,0.03962477,0.05222185],"study_design_scores_gemma":[0.04912682,0.1602673,0.2803572,0.01293564,0.002107603,0.001368861,0.1247055,0.2618662,0.00148521,0.001345337,0.102128,0.002306288],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9925912,0.00006260661,0.002003169,0.001664213,0.002774721,0.0007714079,0.00002542913,0.00001606629,0.00009120048],"genre_scores_gemma":[0.994937,0.00003938681,0.00358987,0.0006840927,0.0002852294,0.0002161757,0.00004255639,0.00003816757,0.000167511],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1295337,"threshold_uncertainty_score":0.8330921,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3528012317232591,"score_gpt":0.5901090453228095,"score_spread":0.2373078135995504,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}