{"id":"W2937000671","doi":"10.1136/bmjqs-2018-008689","title":"Validity evidence for Quality Improvement Knowledge Application Tool Revised (QIKAT-R) scores: consequences of rater number and type using neurology cases","year":2019,"lang":"en","type":"article","venue":"BMJ Quality & Safety","topic":"Innovations in Medical Education","field":"Medicine","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Medicine; Neurology; Quality (philosophy); Evidence-based medicine; Quality management; Medical education; Family medicine; Alternative medicine; Medical physics; Psychiatry; Operations management; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.501572,0.0009996265,0.001803462,0.004645571,0.002048804,0.003870308,0.002763018,0.002422895,0.001481581],"category_scores_gemma":[0.8210049,0.001192797,0.005479171,0.005122122,0.004285859,0.004286254,0.005134696,0.002523524,0.0005303452],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005970853,"about_ca_system_score_gemma":0.005875223,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003195408,"about_ca_topic_score_gemma":0.002613902,"domain_scores_codex":[0.2854866,0.4670622,0.1060661,0.01746657,0.1215668,0.002351683],"domain_scores_gemma":[0.07578719,0.7610264,0.08194438,0.02868696,0.05132464,0.001230523],"domain_codex":"methods","domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.005025464,0.0006033122,0.7963794,0.005427858,0.005070959,0.0002007466,0.01461322,0.004242037,0.001398874,0.003800145,0.004685138,0.1585527],"study_design_scores_gemma":[0.001772087,0.007524822,0.9015079,0.01071229,0.003893811,0.001070678,0.00674864,0.03494171,0.009875856,0.01153123,0.009933054,0.0004879357],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.858598,0.008472921,0.09833139,0.007698271,0.0008694208,0.008147636,0.002255015,0.0004393768,0.01518791],"genre_scores_gemma":[0.9635249,0.0004965468,0.02974879,0.0006297517,0.00008568001,0.004670158,0.0005225015,0.0000856323,0.0002360277],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.501572,"threshold_uncertainty_score":0.6146505,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2309271766637223,"score_gpt":0.5152943465059662,"score_spread":0.2843671698422439,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}