{"id":"W3111316879","doi":"10.1136/bmjpo-2020-000856","title":"Rater training for standardised assessment of Objective Structured Clinical Examinations in rural Tanzania","year":2020,"lang":"en","type":"article","venue":"BMJ Paediatrics Open","topic":"Global Maternal and Child Health","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"Canadian Institutes of Health Research; Global Affairs Canada; International Development Research Centre","keywords":"Tanzania; Objective structured clinical examination; Medicine; Cohen's kappa; Competence (human resources); Medical education; Curriculum; Inter-rater reliability; Health care; Family medicine; Nursing; Psychology; Pedagogy; Statistics; Social psychology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007658404,0.0001029396,0.0004899998,0.00005274773,0.00004011316,0.00002531874,0.0001820569,0.00008309742,0.00005656102],"category_scores_gemma":[0.0004344892,0.00008290765,0.00009420794,0.0002474402,0.00002778729,0.000084374,0.0001106582,0.0001801365,0.000001773842],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007671925,"about_ca_system_score_gemma":0.0006431795,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00007026327,"about_ca_topic_score_gemma":0.00003373296,"domain_scores_codex":[0.9986327,0.00009892158,0.000628738,0.0002022651,0.0002391183,0.0001982224],"domain_scores_gemma":[0.9991446,0.0001837554,0.0001946274,0.0001223851,0.0001705903,0.0001840007],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00124886,0.0001773855,0.9766678,0.0003146823,0.00008260933,0.00003174106,0.001811105,0.00003136821,0.0002056817,0.002637519,0.003929537,0.01286174],"study_design_scores_gemma":[0.006257411,0.0008318853,0.9887764,0.00004849776,0.00007318375,0.00000420219,0.001479392,0.0007866106,0.00004193964,0.0006736352,0.0009286673,0.0000981216],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9866162,0.00004235953,0.001559168,0.004297731,0.0002551161,0.003460183,0.0003663467,0.00001615967,0.003386746],"genre_scores_gemma":[0.9892573,0.00002948218,0.008627922,0.001548859,0.0003658512,0.00006613164,0.0000562875,0.0000129583,0.00003517061],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01276361,"threshold_uncertainty_score":0.3380876,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09748784777370674,"score_gpt":0.4568447594909711,"score_spread":0.3593569117172644,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}