{"id":"W2105301230","doi":"10.1136/vr.102633","title":"Standardised clients as assessors in a veterinary communication OSCE: a reliability and validity study","year":2014,"lang":"en","type":"article","venue":"Veterinary Record","topic":"Innovations in Medical Education","field":"Medicine","cited_by":26,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Guelph; University of Calgary","funders":"Zoetis","keywords":"Certification; Checklist; Objective structured clinical examination; Reliability (semiconductor); Scale (ratio); Rating scale; Construct validity; Medical education; Communication skills; Validity; Medicine; Psychology; Veterinary medicine; Psychometrics; Statistics; Mathematics; Clinical psychology; Geography; Cartography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002242239,0.0001650896,0.0003391128,0.0002029043,0.0001304997,0.00002895134,0.0001583036,0.0001109888,0.0001095508],"category_scores_gemma":[0.001698929,0.0001597984,0.00003772218,0.0004488274,0.0001394148,0.000173883,0.0001807795,0.0004098003,0.00002394234],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00024071,"about_ca_system_score_gemma":0.0000879349,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001950243,"about_ca_topic_score_gemma":0.000006673929,"domain_scores_codex":[0.997892,0.0006387907,0.0005199405,0.0003936897,0.0003365825,0.0002190611],"domain_scores_gemma":[0.9985418,0.0001815642,0.0001332009,0.0008944147,0.0001643813,0.00008465479],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002804592,0.004820394,0.6813354,0.000434501,0.00004397664,0.00007404497,0.003117004,0.000002876655,0.002021914,0.0001064665,0.001435391,0.3038034],"study_design_scores_gemma":[0.002741847,0.009710263,0.9507741,0.0002060193,0.00004012571,0.0001311722,0.001167514,0.0007546296,0.00001308019,0.0007479989,0.03352046,0.0001928296],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9955139,0.00002061922,0.000123507,0.0007601547,0.0003881253,0.0009316148,0.000003193034,0.00007279676,0.002186108],"genre_scores_gemma":[0.9946833,0.00005341346,0.004490939,0.0003392898,0.00006902817,0.0001748193,0.00003743162,0.00002292404,0.0001288647],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3036105,"threshold_uncertainty_score":0.651639,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06257616692878336,"score_gpt":0.396586882933842,"score_spread":0.3340107160050587,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}