{"id":"W2004105051","doi":"10.3138/jvme.37.3.258","title":"Assessment of Technical Skills: Best Practices","year":2010,"lang":"en","type":"article","venue":"Journal of Veterinary Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":31,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Objective structured clinical examination; Competence (human resources); Medical education; Context (archaeology); Medicine; Competency assessment; Psychology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002340985,0.0001101485,0.0003306571,0.0003570959,0.00004713581,0.00001218365,0.0002530693,0.0002660139,0.001644783],"category_scores_gemma":[0.01911771,0.00008616754,0.0001067188,0.0004467992,0.0002528899,0.0002636679,0.00004124832,0.001416865,0.000008052501],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001311172,"about_ca_system_score_gemma":0.005870712,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001605485,"about_ca_topic_score_gemma":0.000002430296,"domain_scores_codex":[0.9973121,0.00007940127,0.00101801,0.0001328111,0.001311767,0.0001459342],"domain_scores_gemma":[0.9964635,0.0001900435,0.001640585,0.0003133271,0.00116839,0.0002241888],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0002920052,0.02294519,0.05914412,0.0008005968,0.0001679882,0.000119975,0.000470511,8.117242e-7,0.2669981,0.00403907,0.04768144,0.5973401],"study_design_scores_gemma":[0.002401546,0.00705756,0.6298626,0.002246909,0.0004328761,0.02529447,0.001660478,0.0003691415,0.001193757,0.0004312304,0.3287812,0.0002682381],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9731518,0.00009808366,0.0004937223,0.01623979,0.004039655,0.0001646839,5.446076e-7,0.00001026337,0.005801482],"genre_scores_gemma":[0.9359091,0.0001462838,0.06067987,0.001417833,0.001568989,0.00001277991,0.00001259572,0.00001456182,0.0002379929],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5970719,"threshold_uncertainty_score":0.9997651,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06169949378791807,"score_gpt":0.5030554352702676,"score_spread":0.4413559414823496,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}