{"id":"W3191847692","doi":"10.1097/phm.0000000000001859","title":"Interrater Reliability in the American Board of Physical Medicine and Rehabilitation Part II Certification Examination","year":2021,"lang":"en","type":"article","venue":"American Journal of Physical Medicine & Rehabilitation","topic":"Medical Education and Admissions","field":"Medicine","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Rehabilitation Institute; University of Toronto","funders":"","keywords":"Inter-rater reliability; Certification; Medicine; Reliability (semiconductor); Physical examination; Physical therapy; Intra-rater reliability; Rehabilitation; Oral examination; Medical physics; Physical medicine and rehabilitation; Family medicine; Rating scale; Psychology; Surgery; Confidence interval","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1074185,0.0004368596,0.0007385144,0.00227054,0.0008647268,0.00151384,0.0008671358,0.0004478962,0.0008164016],"category_scores_gemma":[0.2023099,0.0004359157,0.0008667731,0.001541407,0.00167206,0.0009265198,0.003043101,0.000738177,0.0004468262],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001037245,"about_ca_system_score_gemma":0.001551812,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00233264,"about_ca_topic_score_gemma":0.003741586,"domain_scores_codex":[0.879119,0.07721162,0.01196661,0.006501774,0.02372684,0.001474224],"domain_scores_gemma":[0.767567,0.1300846,0.02571403,0.0157315,0.05926166,0.001641208],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001119768,0.000131773,0.9056824,0.0005787624,0.0006061684,0.000132491,0.008067267,0.001255275,0.002537881,0.0005073353,0.001176699,0.07820412],"study_design_scores_gemma":[0.0001049658,0.001316308,0.9744492,0.0005120254,0.0004703828,0.0008446188,0.002618288,0.007766084,0.007053364,0.0006459652,0.004143498,0.00007523841],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9660937,0.002647415,0.02353375,0.0002834629,0.0003045431,0.0006591268,0.0002923756,0.0001283891,0.006057268],"genre_scores_gemma":[0.9905342,0.0002708766,0.008144811,0.00004502047,0.00007052357,0.0002018255,0.0001743098,0.00003347999,0.0005250266],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1074185,"threshold_uncertainty_score":0.5680901,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02120119612402987,"score_gpt":0.3597731413697832,"score_spread":0.3385719452457533,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}