{"id":"W7117156966","doi":"10.3138/jvme-2025-0065","title":"Development and Evaluation of the Script Concordance Test to Assess Veterinary Students on Equine Colic","year":2025,"lang":"en","type":"article","venue":"Journal of Veterinary Medical Education","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Concordance; Test (biology); Focus group; MEDLINE; Alternative medicine; Multiple choice","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02908619,0.000684622,0.001065206,0.002733888,0.0007021085,0.001686455,0.001519139,0.0009788213,0.001505745],"category_scores_gemma":[0.05439546,0.0005253232,0.001114232,0.001329254,0.000651226,0.001231413,0.001688992,0.001344248,0.0006885319],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001625044,"about_ca_system_score_gemma":0.004265334,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002265136,"about_ca_topic_score_gemma":0.003852938,"domain_scores_codex":[0.9784681,0.009933856,0.003032867,0.001007521,0.006791982,0.0007657005],"domain_scores_gemma":[0.9377241,0.02177077,0.004859789,0.002022198,0.03040845,0.003214754],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.003273432,0.01324484,0.5304661,0.0007367071,0.0002581032,0.0007817124,0.01086154,0.004818386,0.01268907,0.001380158,0.007287136,0.4142028],"study_design_scores_gemma":[0.0009130308,0.02646569,0.8762999,0.000707967,0.0001934976,0.00201647,0.008727074,0.0437609,0.02138929,0.001466747,0.01774551,0.0003139449],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.9606202,0.0003431083,0.0211965,0.0003631929,0.0002346127,0.007902617,0.0004358111,0.0003030676,0.008600871],"genre_scores_gemma":[0.8551446,0.0005915681,0.1304086,0.0002600849,0.00007642173,0.008953593,0.001335533,0.00009350019,0.003136131],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.02908619,"threshold_uncertainty_score":0.1538243,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1820405676654763,"score_gpt":0.5149897520788489,"score_spread":0.3329491844133726,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}