{"id":"W2024754463","doi":"10.1197/j.aem.2003.06.011","title":"Reliability of a Structured Interview Scoring Instrument for a Canadian Postgraduate Emergency Medicine Training Program","year":2004,"lang":"en","type":"article","venue":"Academic Emergency Medicine","topic":"Medical Education and Admissions","field":"Medicine","cited_by":32,"is_retracted":false,"has_abstract":true,"ca_institutions":"The Wilson Centre; University of Toronto","funders":"","keywords":"Inter-rater reliability; Cronbach's alpha; Interview; Intraclass correlation; Reliability (semiconductor); Medicine; Physical therapy; Family medicine; Psychometrics; Clinical psychology; Rating scale; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03160431,0.0004303099,0.0004265592,0.002698012,0.001128964,0.0008651253,0.0009443455,0.0002723791,0.001620591],"category_scores_gemma":[0.06689753,0.0003035551,0.0007040593,0.002054497,0.001120799,0.0004689072,0.001236934,0.0006647076,0.0003465081],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.007146625,"about_ca_system_score_gemma":0.01657232,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.1248174,"about_ca_topic_score_gemma":0.1956158,"domain_scores_codex":[0.9756654,0.01002656,0.002134186,0.001448671,0.009624508,0.001100739],"domain_scores_gemma":[0.9607602,0.01087357,0.003211315,0.001117357,0.02251451,0.00152299],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001286219,0.0004218534,0.7783616,0.0008603106,0.0002991407,0.0001709986,0.02063618,0.002411655,0.006729197,0.00159032,0.00630413,0.1809284],"study_design_scores_gemma":[0.0001236635,0.0009353325,0.9735354,0.0002472671,0.00007268073,0.0001193708,0.00555922,0.009828749,0.002140704,0.0003301881,0.007029761,0.00007752467],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9579702,0.0003417867,0.02411945,0.0003991675,0.0001556102,0.004801012,0.001388184,0.0002079768,0.01061656],"genre_scores_gemma":[0.954522,0.0002690162,0.03842763,0.0001099835,0.00003610638,0.003380748,0.001697846,0.00003119501,0.001525578],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9928534,"threshold_uncertainty_score":0.2481818,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1627570022621117,"score_gpt":0.4303933899558942,"score_spread":0.2676363876937824,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}