{"id":"W175179728","doi":"10.1007/bf03020520","title":"The inter-rater and intra-rater reliability of a new Canadian oral examination format in anesthesia is fair to good","year":2002,"lang":"en","type":"article","venue":"Canadian Journal of Anesthesia/Journal canadien d anesthésie","topic":"Innovations in Medical Education","field":"Medicine","cited_by":27,"is_retracted":false,"has_abstract":false,"ca_institutions":"McMaster University; McMaster University Medical Centre; University of Alberta","funders":"","keywords":"Inter-rater reliability; Reliability (semiconductor); Medicine; Oral examination; Limits of agreement; Correlation; Psychology; Rating scale; Family medicine; Mathematics; Nuclear medicine; Oral health; Developmental psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08796247,0.0008170891,0.001626865,0.004054639,0.003326643,0.002850849,0.001725265,0.00199051,0.002729455],"category_scores_gemma":[0.235486,0.001005364,0.003222512,0.00272302,0.003527811,0.002446327,0.002385679,0.002000955,0.001341749],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004288501,"about_ca_system_score_gemma":0.003443475,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02794991,"about_ca_topic_score_gemma":0.07430921,"domain_scores_codex":[0.9030902,0.03681962,0.01563959,0.008839832,0.03326606,0.00234474],"domain_scores_gemma":[0.5881408,0.2210493,0.01920067,0.03063862,0.1368664,0.004104168],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.005571119,0.001091708,0.6306251,0.002118571,0.006179917,0.0007454917,0.02688086,0.002939603,0.01488492,0.005270659,0.03121296,0.272479],"study_design_scores_gemma":[0.0003892918,0.0008473001,0.9612774,0.0004796628,0.0009413364,0.000492616,0.003397778,0.005823328,0.004501374,0.002101742,0.01946383,0.0002842827],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8493509,0.006957426,0.06465022,0.003240641,0.004695174,0.004292293,0.004196545,0.001063077,0.06155376],"genre_scores_gemma":[0.9585571,0.0008272648,0.03082103,0.0008496309,0.0007016675,0.00117348,0.001856614,0.0003613057,0.004852042],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9120376,"threshold_uncertainty_score":0.4651956,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01414278348231779,"score_gpt":0.2425219722253273,"score_spread":0.2283791887430096,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}