{"id":"W2115065139","doi":"10.3109/0142159x.2014.899687","title":"Weighting checklist items and station components on a large-scale OSCE: Is it worth the effort?","year":2014,"lang":"en","type":"article","venue":"Medical Teacher","topic":"Innovations in Medical Education","field":"Medicine","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"Medical Council of Canada; University of British Columbia","funders":"","keywords":"Weighting; Checklist; Reliability (semiconductor); Test (biology); Scale (ratio); Consistency (knowledge bases); Computer science; Licensure; Statistics; Data mining; Psychology; Artificial intelligence; Medicine; Mathematics; Medical education; Cognitive psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08381926,0.001022199,0.0009379154,0.001694057,0.0008765679,0.002658107,0.001538581,0.0009431666,0.001657034],"category_scores_gemma":[0.2889588,0.0005463004,0.001343495,0.002871127,0.002584873,0.003170256,0.002641056,0.001642348,0.0004775624],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003274005,"about_ca_system_score_gemma":0.003561695,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009411256,"about_ca_topic_score_gemma":0.01967804,"domain_scores_codex":[0.9246645,0.05398808,0.005296892,0.003183937,0.0118937,0.0009729582],"domain_scores_gemma":[0.7353359,0.1709104,0.03929804,0.0355052,0.01690461,0.002045891],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001160468,0.0004911819,0.5530066,0.0009983741,0.001154033,0.00008703681,0.003789764,0.01766192,0.003844677,0.005874929,0.003447932,0.4084831],"study_design_scores_gemma":[0.0003652161,0.002397906,0.8583351,0.001346864,0.001006694,0.0005064131,0.003941386,0.09793593,0.005578441,0.01966949,0.00858263,0.000333847],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8102274,0.0008555148,0.1792462,0.002663825,0.000162969,0.001576469,0.0002694786,0.0002973308,0.004700887],"genre_scores_gemma":[0.912259,0.0002441879,0.08607253,0.0002926397,0.00005504068,0.0005013985,0.0002119943,0.00005556206,0.0003075651],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9161807,"threshold_uncertainty_score":0.4432839,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01954355735836385,"score_gpt":0.3249957843628187,"score_spread":0.3054522270044549,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}